URL: https://www.youtube.com/watch?v=nYA0yASgaZI 날짜: 2026-10-08 채널: t3dotgg
📌 핵심 질문 / 구독 가격과 모델 가치의 핵심 논점
==200달러 Codex 구독의 표시상 달러 한도는 크게 줄었지만, 저렴한 GPT-6.1 Soul을 쓰면 실제 작업량은 여전히 매우 크고, 비싼 GPT-6 Astra·UltraFast를 쓰면 플랜의 가치가 급락한다.==
- 불과 몇 주 전 200달러 Codex 플랜은 월 최대 12,000달러 상당의 추론(inference)을 제공하는 것처럼 보였지만, 사용량 계산 변경 뒤 실제 측정치는 주 570~574달러, 월 약 2,500달러 수준으로 내려갔다.
- API 가격은 기업에게 부과하는 인위적인 기준가이고, 실제 추론 컴퓨트·에너지 비용은 그보다 훨씬 낮으므로 구독의 ‘달러 가치’만으로 모델의 효율을 판단하면 안 된다.
- GPT-6.1 Soul은 Codex 플랜에서 사실상 무제한에 가까운 사용감을 주는 반면, Astra UltraFast는 200달러 또는 500달러 플랜을 몇 시간 만에 소진시킬 수 있다.
200달러 Codex 플랜은 Astra만 쓰려는 사람에게는 나빠졌고 Claude 200달러 플랜이 더 나은 선택이다. 그러나 GPT-6.1 Soul의 작업당 비용과 Codex의 개방적인 사용 범위를 고려하면, Claude가 작업을 주도하고 Codex가 컴퓨터·이메일 사용이나 코드 리뷰를 맡는 조합은 여전히 매우 강력하다.
1. 200달러 플랜의 ‘무제한’ 신화
1.1. 미래의 Sama 코인과 구독 경제
미래의 아이들이 Sama 코인으로 저녁을 사려 하고, 어린 시절 미국 달러로 Sama 코인을 사야 했던 시절을 설명하게 된다는 농담이 가격 논쟁의 출발점이 된다.
-
구독을 화폐처럼 쓰는 비유
- 과거에는 200달러를 내고 1,200달러 상당의 Sama 코인을 받는 것처럼, 200달러 Codex 구독으로 12,000달러 상당의 inference를 얻었다.
- Claude의 ‘Claw’ 플랜은 같은 200달러로 약 8,000달러 상당을 제공해 Codex보다는 작았지만 여전히 매우 큰 보조금이었다.
- “내가 너무 과장하는 것 같다”는 자기비판 뒤에도 이 수치는 불과 몇 주 전의 실제 사용 경험을 가리킨다.
-
처음부터 무제한이었던 것은 아니다
- 200달러 플랜은 하루 가장 바쁜 날에도 프롬프트 10~15개를 보내고, 몇 파일만 건드리는 짧은 작업에 5분 이내 응답을 받던 시절에 ‘무제한처럼’ 느껴지도록 설계됐다.
- 당시 코드베이스 탐색에 Sonnet을 주로 사용했기 때문에 200달러 플랜의 한도를 실제로 만지기 어려웠다.
- 모델이 더 강력해지고 비싸지면서 같은 플랜이 새 모델 출시 때 갑자기 유한해 보이는 상황을 OpenAI와 Anthropic 모두 원하지 않았다.
1.2. 보조금 경쟁과 사용량 계산 변경
Anthropic과 OpenAI는 200달러 고객이 ‘무제한’이라고 느끼게 하려고 구독에 점점 더 큰 보조금을 넣었고, 그 결과 API 기준 금액이 비현실적으로 커지는 경쟁에 들어갔다.
-
Dev Day 직전의 발표
- Tibo가 vibe coder에게 올해 가장 큰 OpenAI 발표 중 하나를 내놓았다.
- 200달러 플랜의 사용량 산정 방식을 바꾸어, 같은 돈으로 표시되는 달러 가치가 사실상 절반이 되었다.
- 체감상 12,000달러/월에서 2,000~2,500달러/월로 내려간 셈이라 “이제 Codex 대신 Claude를 써야 하는가”, “모두를 500달러 티어로 밀어 넣으려는 것인가”라는 의문이 생겼다.
-
실제 사용량의 첫 측정
- 일주일 동안 실제로 얻은 API 환산 사용량은 570달러 안팎이었다.
- 월간으로 환산하면 약 2,000달러이며, 이후 더 정밀한 측정에서는 573.86달러/주와 월 약 2,500달러라는 수치가 제시됐다.
- 사용량 창이 평균 3일마다 리셋되던 시기에는 매 창을 끝까지 채우면 월 24,000달러까지도 가능했지만, 변경 뒤에는 그 규모가 사라졌다.
2. API 가격과 구독 보조금의 실체
2.1. 오른쪽의 API 숫자도 가짜이고 왼쪽의 구독 숫자도 가짜다
구독 화면의 ‘얻은 달러’와 API 가격표의 달러는 모델 운영사의 실제 원가가 아니라 가격 전략을 표시하는 숫자다.
-
기업 API 가격의 성격
- 여러 장비에서 7일 동안 발생한 API 환산 사용량은 약 20,000달러였으며, 개인이 실제로 지불할 수 있는 금액이 아니었다.
- API 오른쪽 숫자는 기업 고객에게 청구해 시장이 얼마까지 받아들이는지 확인하는 가격에 가깝다.
- 모델 훈련, 직원, 인프라 구축 비용은 별도로 존재하지만, 토큰을 실제로 태우는 compute와 energy 비용은 토큰 100달러당 대략 2~5달러에 가깝다는 추정이 제시됐다.
-
약 95% 마진의 문제
- API 가격에는 하드웨어와 전력 원가 대비 최대 95%에 이르는 역사적 마진이 포함돼 있었다.
- 따라서 200달러 구독이 12,000달러 상당을 준다는 표현도, API 12,000달러가 실제로 12,000달러의 원가라는 표현도 모두 현실을 그대로 반영하지 않는다.
- 경쟁이 충분하다면 Anthropic과 OpenAI가 API 가격을 낮추고, 구독 보조금과 실제 원가 사이의 격차도 빠르게 줄어들어야 한다.
2.2. Claude와 Codex의 사용 범위 차이
같은 200달러라도 Claude 플랜은 모델 선택과 실행 환경의 제약이 크고, Codex 플랜은 비상업적 개인 작업에 훨씬 개방적이다.
-
Claude 플랜의 Claude Code 종속
- Claude 구독은 어디서든 Claude를 호출하는 8,000달러 크레딧이 아니라 Claude Code 안에서 대량 inference를 수행하는 구독이다.
- T3 Code에서는 Agent SDK를 통해 Claude Code를 직접 호출하므로 사용할 수 있지만, Pi·OpenClaw·Hermes처럼 Claude Code가 아닌 도구에 그대로 넣을 수는 없다.
- Claude Code 시스템 프롬프트에 Pi처럼 동작하라는 지시를 넣어 우회하려 해도 요청이 실패하며, 이런 제한은 매우 엄격하다.
-
Codex 플랜의 상대적 개방성
- Codex 구독은 사용자 트래픽을 판매하는 용도가 아니라면 사실상 어디서든 사용할 수 있다.
- 구독을 클라우드에 올리고 다른 사람에게 5달러를 받아 접속시키는 재판매는 금지된다.
- 반면 CI에서 들어오는 모든 pull request를 검토하는 데 구독을 사용하는 것은 대체로 허용된다.
-
가장 큰 Claude 모델의 추가 제한
- Fable을 사용하면 Claude 구독 전체를 쓸 수 없고, 할당량의 절반만 Fable에 사용할 수 있다.
- 나머지 절반은 다른 모델에 쓸 수 있지만, Fable 하나로 구독을 100% 소진할 수는 없다.
- OpenAI는 Astra에 같은 임의의 절반 제한을 두지 않고 전체 주간 한도를 사용하게 했다.
3. 모델 가격 전쟁과 GPT-6.1 Soul의 낮은 마진
3.1. 두 모델 그룹과 Project Glasswing
비용 구조를 비교하기 위해 모델이 두 그룹으로 나뉜다.
-
비교 대상
- 첫 그룹은 Opus 4.5부터 Opus 5.5까지와 GPT-5.6 Soul, GPT-6 Soul로 자막에 표기된 모델들이다.
- 두 번째 그룹은 Fable 5와 Fable 5.1, GPT-6 Astra로 자막에 표기된 모델들이다.
- 자막의 “GBD 56 Soul”, “GBD6 Soul”, “GBD6 Astra”는 문맥상 GPT 계열 제품명으로 보정해 적었으며, 고유명사 표기는 자동 자막의 오인식 가능성이 있다.
-
Project Glasswing과 Claude Mythos
- Anthropic은 Project Glasswing에서 Claude Mythos라는 내부 모델을 공개적으로 판매하지 않을 것처럼 발표했지만, 실제로는 참여 기업에 판매할 계획이었다.
- 예고 가격은 입력 백만 토큰당 25달러, 출력 백만 토큰당 125달러였다.
- 95% 마진을 가정하면 출력 125달러의 실제 compute 원가는 6.25달러가 되고, 나머지 118.75달러가 이익이 된다.
3.2. Fable 5가 시작한 보조금 축소
Fable 5와 Mythos 5는 같은 모델로 설명되지만, 출시 가격은 예고 가격보다 크게 낮아졌다.
-
가격 인하와 마진 변화
- Fable 5/Mythos 5의 가격은 입력 10달러, 출력 50달러/백만 토큰으로 정해졌다.
- 모델 크기나 호스팅 비용이 줄었다는 발표가 없었으므로 출력 원가 6.25달러가 같다고 가정하면, 50달러 판매의 마진은 약 87.5%다.
- 가격만 보면 마진은 95%에서 87.5%로 7.5%포인트 떨어졌지만, 같은 6.25달러를 써서 얻는 이익은 118.75달러에서 43.75달러로 급감했다.
-
Anthropic이 OpenAI를 압박한 효과
- Anthropic은 여전히 엄청난 돈을 벌지만, 에너지와 compute 1달러당 벌어들이는 매출은 Fable에서 의미 있게 낮아졌다.
- 이 가격은 OpenAI를 더 어렵게 만들기 위한 선택이었고 실제로 OpenAI 쪽에 패닉을 일으켰다.
- OpenAI는 Astra의 출시 가격을 Fable과 똑같이 맞췄으며, 원래 어떤 가격을 계획했는지는 알 수 없다.
3.3. GPT-6.1 Soul은 가격 구조를 뒤집었다
GPT-6.1 Soul은 경쟁 모델보다 싸게 보이는 정도가 아니라, OpenAI가 원래 예상했을 가격보다 훨씬 낮은 비용 구조를 가진 것으로 분석된다.
-
예상 가격과 실제 가격
- Opus 5가 입력 5달러, 출력 25달러/백만 토큰이므로 GPT-6.1 Soul도 원래 입력 5달러, 출력 25달러를 목표로 했다고 가정한다.
- 95% 마진이면 출력 25달러의 원가는 1.25달러이고 이익은 23.75달러가 된다.
- 실제 출시는 입력 2달러, 출력 10달러/백만 토큰으로 이루어졌으며, 캐시 읽기(cache read)는 20센트에서 10센트로 내려갔다.
-
캐시 비용의 5배 인하
- 이전에는 입력 비용 중 절반가량이 캐시 읽기였으므로, 백만 토큰당 50센트가 캐시에서 발생하는 구조로 볼 수 있었다.
- 캐시 읽기를 10센트로 낮추면 캐시 부분의 비용은 5분의 1이 된다.
- 전체 유효 비용은 원래 예상한 5.25달러/백만 출력 토큰에서 실제 2.10달러 안팎으로 내려가 약 2.5배 싸고, 캐시 항목만 보면 5배 싸다.
-
낮은 마진의 의미
- GPT-6.1 Soul은 95% 마진으로 ‘돈을 찍어내는’ 모델이 아니라 실제 마진이 약 50% 수준일 수 있다는 추정이 제시됐다.
- 50% 마진도 나쁜 사업은 아니지만, 과거처럼 추론량이 늘어날수록 압도적인 이익을 내는 구조와는 다르다.
- OpenAI는 이 모델에 별도의 절반 한도를 붙이는 대신, 사용자가 낮은 마진의 Soul을 많이 사용하도록 허용해 구독 보조금과 API 가격의 격차를 줄였다.
4. 실제 사용량과 GPT-6.1 Soul의 작업당 가치
4.1. 같은 응답 수, 10배 이상 다른 API 비용
실사용 데이터는 표시된 달러 한도보다 모델별 토큰 가격이 중요하다는 결론을 뒷받침한다.
-
주간·월간 소진 속도
- 과거에는 3일 평균 리셋을 합쳐 월 24,000달러 상당까지 쓸 수 있었지만, 변경 후에는 약 2,500달러/월만 측정됐다.
- 573.86달러 상당을 사용해 계정 하나를 반복 루프에서 29시간 만에 완전히 소진시켰다.
- 모든 현실적인 업무에서 GPT-6.1 Soul만 쓰고 Max를 피한다면 200달러 플랜은 여전히 사실상 무제한처럼 느껴질 수 있다.
-
Astra와 Soul의 비교 측정
- GPT-6 Astra는 약 1,800회 응답에서 출력 토큰 766,000개를 만들었고 API 가격 기준 534달러가 들었다.
- GPT-6.1 Soul은 약 1,500회 응답으로 Astra와 거의 같은 양의 출력 토큰을 만들었다.
- Soul 비용은 자동 자막에 “3827달러”로 인식됐지만, “10배 이상 감소”라는 문맥상 38.27달러로 해석된다.
- 응답 수와 출력 토큰이 비슷한데 비용이 10배 이상 차이 나는 것이 GPT-6.1 Soul에 보조금을 집중한 이유다.
4.2. Slop(ol)ytics와 Artificial Analysis 지표
모델의 subscription dollar value가 절반이 되어도, 한 작업을 완료하는 데 필요한 토큰과 토큰 단가가 낮으면 실제 생산량은 오히려 커진다.
-
시각화 프로젝트
- Slop(ol)ytics는 점수와 지출액의 관계를 보기 쉽게 만든 새 프로젝트다.
- Artificial Analysis Intelligence Index에서 GPT-6.1 Soul은 성능 대비 비용의 Pareto frontier에 깊숙이 놓인다.
- 선형 축으로 바꾸면 Soul과 Luna가 파레토 선 자체처럼 보여 다른 모델이 비교에서 밀려나는 모습이 더욱 과장된다.
-
Terminal-Bench 검증
- 기존 Terminal-Bench 실행 방식이 마음에 들지 않아 직접 다시 측정했다.
- 모델의 native harness를 사용하고 Codex와 Claude Code 양쪽으로 돌려 다른 측정치보다 더 높은 결과를 얻었다.
- GPT-6.1 Soul Max는 역대 최고 점수를 냈고, Soul xhigh는 Opus 5.5와 거의 정확히 동률이었다.
- Opus 5.5의 작업당 비용은 약 13.11달러, Soul의 비용은 약 0.96달러로 Soul이 약 13분의 1 가격이었다.
-
비교 기준을 작업당 비용으로 바꿔야 한다
- Opus 5.5 High와 Soul Max는 문제를 풀 때 쓰는 토큰 수가 비슷하다.
- Soul의 토큰 단가가 낮으므로 실제 Terminal-Bench 4 작업당 비용은 약 13배 낮다.
- Codex 구독의 표시 달러 가치가 절반이어도, 업무에 따라 같은 돈으로 완료하는 작업 수는 최대 5배까지 많아질 수 있다.
- API 가격으로 Opus를 쓰려면 Soul이 하지 못하는 일을 Opus만 할 수 있다는 확신이 있어야 한다.
5. Claude 200달러 플랜과 Codex 플랜의 실전 선택
5.1. 출하할 코드라면 Claude가 우세하다
실제로 출시할 코드를 작성하는 목적이라면 Opus 5.5가 포함된 200달러 Claude 플랜의 가치를 이기기 어렵다.
-
사용량을 끝까지 밀어붙인 Claude 플랜
- Claude 구독을 취소하려 했지만 결국 스스로 한도를 어디까지 쓸 수 있는지 시험하게 됐다.
- Claude 계정 6개를 운용했고, 측정 시점에 3개를 이미 소진했으며 2개는 그날 아침 리셋 직후 다시 소진됐다.
- Fable은 거의 사용하지 않았고 Fable 할당량이 600% 남아 있었지만, 계정별 주간 한도와 합쳐지는 구조 때문에 소진된 계정에서 Fable로 옮겨 쓸 수 없었다.
-
모델별 결론
- 전체 구독 가치는 여전히 Claude 플랜이 훨씬 높다.
- API 비용만 부담한다면 GPT-6.1 Soul을 망설임 없이 고른다.
- GPT-6.1 Soul은 역사상 가장 좋은 가치의 모델 중 하나이며, Codex 구독의 보조금이 줄어도 모델 자체가 싼 덕분에 균형이 맞는다.
5.2. 두 플랜을 함께 쓰는 조합
Claude는 작업을 지휘하고 Codex는 더 깊은 분석을 수행하는 역할 분담이 실전에서 유리하다.
-
Codex를 보조 에이전트로 활용
- Claude가 T3 Code를 통해 Codex를 호출해 자신의 작업을 리뷰하게 하면 Codex 모델이 Anthropic 모델보다 더 깊고 철저한 문제를 찾아내는 경우가 많다.
- 실제 Codex 사용량의 큰 부분은 이메일·컴퓨터 사용 자동화 또는 Claude가 T3 Code를 통해 Codex를 불러 코드 작업을 검토하는 데서 나온다.
- 따라서 두 플랜을 모두 감당할 수 있으면 200달러 Codex의 낮아진 달러 한도도 충분히 쓸모가 있다.
-
실전 선택 규칙
- 200달러 Codex를 Astra 전용 플랜으로 생각한다면 Claude 플랜을 선택하는 편이 낫다.
- GPT-6.1 Soul을 활용하고, 이메일·컴퓨터·CI·리뷰까지 폭넓게 쓰려면 Codex도 유지할 이유가 있다.
- 정기적으로 진지한 엔지니어링 결과물을 출시하려면 Claude 플랜이 사실상 필수라는 판단이 제시된다.
6. 두 번의 스폰서 구간에서 드러난 에이전트 도구
6.1. Browserbase와 Stagehand
에이전트는 아무리 똑똑해도 인터넷에서 필요한 자료에 접근하지 못하면 일을 잘할 수 없으므로 브라우저·검색·API 접근이 핵심 인프라가 된다.
-
Browserbase의 역할
- Browserbase는 에이전트가 전체 웹에 접근하도록 브라우저, 각종 API, 검색 기능을 묶어 제공한다.
- 단순한 브라우저 실행이 아니라 에이전트가 실제 작업에 필요한 웹 접근 계층을 제공한다.
-
Stagehand의 자연어 웹 조작
- 오픈소스 Stagehand SDK는 페이지의 모든 요소를 고정된 셀렉터로 정의하지 않고 자연어로 찾게 한다.
stagehand.observe("find the email input")이나stagehand.observe("find the password input")처럼 입력 필드를 설명하면 해당 필드를 찾아낸다.- 찾은 필드에 변수를 채우고, Zod 구현과 결합해 페이지에서 검증된 구조화 데이터(validated data)를 얻을 수 있다.
-
GitHub 릴리스 데모
- 세 개의 GitHub 저장소에서 최신 릴리스를 가져오는 에이전트 데모에서 Scan을 누르면 실제 브라우저가 열리고 페이지를 탐색한다.
- HTML만 수정하는 것이 아니라 브라우저를 실제로 제어하므로 자연어 지시로 올바른 페이지와 데이터를 찾는다.
- 페이지에서 요소 하나가 조금 이동해도 고정 셀렉터를 다시 쓰지 않아도 되므로 에이전트가 더 견고하다.
- 최종 결과는 선택한 저장소들의 릴리스를 모은 짧은 브리프가 된다.
6.2. General Translation
앱 번역과 localization은 기능 이름, 숫자 형식, 복수형, 여러 표면의 일관성을 동시에 맞춰야 하므로 단순 문자열 교체보다 어렵다.
-
제품 기능
- React JSX의 helper로 번역할 영역을 표시할 수 있다.
- 숫자 형식과 pluralization을 여러 언어의 규칙에 맞게 처리하는 helper가 제공된다.
- dictionary를 사용하면 모바일 앱, 데스크톱 앱, 웹사이트 등 서로 다른 표면에서 같은 기능명이 유지된다.
-
T3 Code 적용 사례
- T3 Code 마케팅 사이트를 두 번의 프롬프트로 여러 언어에 맞게 만들었고, 실제 구현 작업은 에이전트가 수행했다.
- 영어를 쓰지 않는 세계 인구 약 85%에 도달할 수 있다는 점이 핵심 가치 제안이다.
7. 500달러 플랜과 UltraFast의 실패
7.1. 문제는 500달러 플랜의 존재보다 출시 순서와 메시지다
200달러 플랜의 표시 가치가 20배에서 10배로 줄었다고 말한 직후, 2.5배 가격인 500달러를 내면 25배 플랜을 쓸 수 있다고 제시한 것은 최악의 광학적(optical) 실수였다.
- 자기부담형 악수
- 500달러 티어가 언젠가 필요했을 수는 있지만, 200달러 한도 삭감과 동시에 발표할 이유는 없었다.
- 500달러 플랜이 마케팅에 도움이 되지 못했다면 출시 목적을 달성하지 못한 것이다.
- 회사의 주된 매출은 8달러·20달러 소비자 플랜과 API 판매에서 나오며, 200달러 플랜은 직접 이익보다 마케팅 상품에 가깝다.
7.2. UltraFast 가격 폭발
GPT-6 Astra는 61 Soul과 정반대다. Astra의 높은 API 가격과 UltraFast의 추가 배수는 500달러 플랜을 빠르게 태우는 구조를 만든다.
-
기본 가격
- Astra는 캐시 입력(cache read) 백만 토큰당 1달러, 일반 입력 백만 토큰당 10달러, 출력 백만 토큰당 50달러로 제시된다.
- 긴 컨텍스트 창을 쓰면 가격이 두 배가 되므로, 컨텍스트가 큰 코드 작업은 시작부터 불리하다.
-
UltraFast 적용 가격
- UltraFast를 켜면 일반 입력이 10달러에서 60달러, 캐시 입력이 1달러에서 6달러로 오른다.
- 캐시 쓰기(cache write)는 75달러, 출력은 백만 토큰당 300달러가 된다.
- 더 큰 컨텍스트 조건에서는 일반 입력 120달러, 캐시 입력 12달러, 캐시 쓰기 150달러, 출력 450달러까지 올라간다.
- UltraFast로 Astra에게 pull request 두 개를 리뷰하게 한 결과 600달러가 청구됐다.
-
인프라 추정
- UltraFast는 Cerebras 특수 칩 기반의 별도 인프라를 사용하며, OpenAI가 충분한 compute를 확보하지 못해 과도하게 프로비저닝하고 있을 가능성이 제기된다.
- Nvidia와 Cerebras 중 어떤 선택이 실패했는지에 대한 추측이 오갔고, Cerebras 칩을 Jane Street가 모두 사들였다는 이야기도 덧붙었다.
- 어느 쪽이든 UltraFast의 실제 마진이 낮다는 점은 가격 구조와 과도한 소진 속도로 설명된다.
7.3. 2.1시간 만에 주간 한도를 태우는 플랜
500달러 플랜에서 UltraFast를 사용하면 일주일에 약 1,000달러 상당의 UltraFast API를 쓸 수 있지만, 생성 시간으로 환산하면 약 2.1시간뿐이다.
- 브랜딩의 역설
- 500달러 플랜을 UltraFast 플랜으로 브랜딩했지만, UltraFast는 그 플랜의 한도를 가장 빠르게 소진하는 기능이다.
- 새 플랜을 기대하고 업그레이드한 사용자가 프롬프트를 한두 시간 보낸 뒤 계정이 잠기는 것은 놀라운 일이 아니다.
- GPT-6.1 Soul 출시, 큰 폭의 한도 삭감, 500달러 플랜, UltraFast를 한꺼번에 배치하면서 Soul의 효율성으로 얻을 수 있었던 신뢰가 먼저 타버렸다.
8. 신뢰 회복을 위한 조건과 최종 답변
8.1. OpenAI가 잃은 우위
OpenAI의 과거 강점은 post-training과 reinforcement learning으로 작은 모델을 매우 유능하게 만드는 능력이었지만, 최근 Anthropic의 Sonnet과 Opus가 같은 격차를 좁혔다.
-
가치 하락의 체감
- 500달러 플랜의 UltraFast 사용량은 월 약 4,000달러 상당으로, 몇 주 전 200달러 플랜의 월 12,000달러보다 적다.
- 가격은 2.5배 올랐고 사용량은 3분의 1로 줄어 체감이 나쁠 수밖에 없다.
- 과거 GPT-5.4·5.5는 하루 종일 써도 최악의 경우 한 사용 창의 10~15%만 소진했지만, 이제 200달러나 500달러 플랜으로도 반나절을 버티기 어렵다.
-
필요한 개선
- Astra보다 실제로 더 나은 모델을 만들어 사용자가 비싼 Astra를 찾을 이유를 없애야 한다.
- Opus 5.5만큼 유능하고 쾌적하면서 현재보다 훨씬 빠르고, 합리적인 가격에서 구독으로 무제한처럼 느껴지는 모델이 필요하다.
- 500달러 플랜을 다시는 UltraFast 플랜이라고 전면에 내세우지 말아야 한다.
8.2. “200달러 Codex 플랜은 이제 별로인가?”에 대한 답
-
Astra 전용으로 생각하면 그렇다
- 200달러를 내고 Astra만 쓸 생각이라면 한도 삭감과 Astra의 높은 단가 때문에 Claude 200달러 플랜으로 가는 편이 낫다.
- Opus와 Fable을 쓰려는 목적으로 Claude 플랜을 사는 경우에도 같은 결론이 적용된다.
-
Soul과 조합하면 여전히 강하다
- GPT-6.1 Soul은 보조금 비율이 낮아졌다는 사실만으로 평가절하할 수 없는 역사적 수준의 가성비를 제공한다.
- Codex를 이메일·컴퓨터 작업, CI, 코드 리뷰에 사용하고 Claude가 Codex를 호출해 검증하게 하면 200달러 플랜에서 충분한 가치를 얻는다.
- Claude 플랜은 정기적으로 심각한 엔지니어링 결과물을 출시하는 사람에게 필수에 가깝고, Codex는 그 작업을 더 깊게 재검토하는 보조 엔진이 된다.
-
지금 당장 모두 가입할 필요는 없다
- 누구에게나 지금 당장 200달러 Codex 가입을 권할 수는 없다.
- 솔직히 Claude 플랜이 더 좋은 거래에 가깝다.
- 그러나 API 가격이 경쟁으로 내려가고 보조금이 더 줄더라도, 1년 뒤 같은 플랜으로 지금보다 더 많은 일을 할 수 있어야 하며 그렇지 않다면 모델 생태계에 큰 문제가 생긴 것이다.
주요 발언 모음
“200달러 구독의 달러 가치가 절반이 되어도, GPT-6.1 Soul은 너무 싸기 때문에 실제로 받는 가치는 의미 있게 줄지 않는다.”
“작업당 비용을 봐야 한다. Soul은 Opus 5.5와 비슷한 토큰으로 문제를 풀면서 작업당 가격은 약 13분의 1이다.”
“500달러 플랜의 존재 자체가 아니라, 지금 그 방식으로 내놓은 것이 실수였다.”
“UltraFast는 500달러 플랜의 기능이 아니라 그 한도를 태우는 가장 빠른 방법이다.”
“진지한 엔지니어링 작업을 정기적으로 출하하려면 Claude 플랜은 내 관점에서 절대적으로 필요하다.”
핵심 데이터 & 수치
- 초기 구독 가치: Codex 200달러 → 월 12,000달러 상당, Claude 200달러 → 약 8,000달러 상당.
- 변경 후 측정치: 주 570~573.86달러, 월 약 2,000~2,500달러.
- 과거 최대치: 3일 평균 리셋을 모두 채우면 월 약 24,000달러.
- 실제 API 지출: 여러 머신에서 7일간 약 20,000달러 상당.
- 추정 원가: 토큰 100달러 API 가격에 대응하는 compute·energy 원가는 약 2~5달러.
- Astra 사용량: 약 1,800회 응답, 출력 766,000토큰, API 환산 534달러.
- Soul 사용량: 약 1,500회 응답, 유사한 출력량, 자동 자막상 38.27달러로 해석되는 비용.
- Terminal-Bench: Soul xhigh가 Opus 5.5와 거의 동률, 작업당 약 0.96달러 대 13.11달러.
- UltraFast: 500달러 플랜에서 주 약 1,000달러 상당, 약 2.1시간 생성으로 한도 소진.
- UltraFast PR 리뷰: Astra가 PR 두 개를 처리하는 데 약 600달러.
결론 및 시사점
- API 환산 달러보다 모델이 문제 하나를 해결하는 작업당 비용을 구독 판단의 중심 지표로 삼아야 한다.
- GPT-6.1 Soul은 낮은 가격과 낮은 마진을 바탕으로 200달러 Codex 플랜을 다시 무제한처럼 느끼게 만든다.
- Astra와 UltraFast는 높은 단가 때문에 200달러·500달러 플랜을 빠르게 소진시키며, 특히 UltraFast는 구독 기능으로 브랜딩하기에 부적합하다.
- Claude 200달러 플랜은 Opus 5.5와 코드 출하 작업에서 여전히 가장 강력한 가성비를 보인다.
- Codex는 이메일·컴퓨터 자동화, CI, Claude 작업의 심층 리뷰에 배치할 때 별도의 가치를 만든다.
- OpenAI는 모델의 효율성만큼이나 한도 변경의 순서와 가격 메시지를 관리해야 신뢰를 회복할 수 있다.
핵심 요약 20줄
200달러 Codex 플랜의 표시상 API 환산 가치는 불과 몇 주 만에 월 12,000달러에서 약 2,000~2,500달러로 줄었다. 과거 200달러 플랜은 하루 10~15개의 짧은 프롬프트를 처리하던 시절에 무제한처럼 느껴지도록 설계됐다. OpenAI와 Anthropic은 모델 원가보다 훨씬 높은 API 가격을 기준으로 구독 보조금 경쟁을 벌여 왔다. API 가격 100달러에 대응하는 실제 compute와 energy 원가는 약 2~5달러라는 추정이 제시됐다. Claude 구독은 Claude Code 중심으로 제한되지만 Codex 구독은 CI 코드 리뷰 등 더 넓은 용도로 쓸 수 있다. Anthropic은 Fable 사용량을 구독 할당량의 절반으로 제한하지만 OpenAI는 Astra에 같은 제한을 두지 않았다. Fable 5는 같은 모델인 Mythos 5의 예고 가격보다 낮게 출시되어 Anthropic의 추론 마진을 낮췄다. GPT-6.1 Soul은 입력 2달러와 출력 10달러라는 낮은 가격으로 경쟁 모델보다 훨씬 싸게 출시됐다. GPT-6.1 Soul의 캐시 읽기 가격은 백만 토큰당 20센트에서 10센트로 내려갔다. GPT-6.1 Soul은 낮은 마진을 감수해 200달러 구독을 사실상 무제한처럼 만드는 역할을 한다. Astra는 약 1,800회 응답과 766,000 출력 토큰에 API 환산 534달러가 필요했다. Soul은 비슷한 응답량과 출력량을 약 38.27달러로 처리한 것으로 분석됐다. Terminal-Bench에서 Soul xhigh는 Opus 5.5와 비슷한 점수를 작업당 약 13분의 1 가격으로 냈다. 구독의 달러 가치가 절반이어도 모델의 작업당 비용이 낮으면 실제 완료 작업 수는 더 많아질 수 있다. 출하할 코드를 정기적으로 만드는 사람에게는 Opus 5.5가 포함된 Claude 200달러 플랜이 여전히 더 좋은 거래다. Claude가 Codex를 호출해 자신의 결과물을 검토하게 하면 두 구독의 강점을 함께 활용할 수 있다. 500달러 플랜은 200달러 한도 삭감과 동시에 출시되어 가격 인상과 사용량 감소를 한꺼번에 각인시켰다. UltraFast는 Astra의 입력·출력 단가를 크게 올려 PR 두 개에 600달러를 청구할 수 있다. 500달러 플랜의 UltraFast 사용량은 주 약 1,000달러 상당이지만 약 2.1시간 만에 주간 한도를 소진한다. 200달러 Codex 플랜은 Astra 전용으로 보면 별로지만 GPT-6.1 Soul과 보조 에이전트 조합으로 쓰면 여전히 강력하다.
메타데이터
- 원문 제목: Does the $200 Codex plan suck now?
- Video ID: nYA0yASgaZI
- 원문 발행일/처리일: 2026-10-08
- 재생 시간: 2013초
- 자막: 영어 자동 자막을 기준으로 한국어 작성, 한국어 자동 자막으로 고유명사·수치 교차 확인
