URL: https://www.youtube.com/watch?v=uogfQG6JZwA 날짜: 2026-08-26 채널: Tech Bridge
📌 핵심 질문 / 이 영상이 다루는 핵심 논점
==Codex가 코딩 성능에서 압도적으로 앞서서가 아니라, 컴퓨터 사용(computer use)과 모바일·업무 통합 경험을 통해 실제 작업을 더 넓게 자동화하기 때문에 Claude Code와 함께 선택할 가치가 있는가==를 다룬다.
- Chris는 Claude Code를 1년 넘게 주력으로 사용했지만 최근 Codex를 주력으로 전환했다.
- 두 도구의 고급 모델을 동시에 사용했을 때 코딩 결과는 대체로 비슷했고, 전환을 결정한 차이는 사용자 경험이었다.
- Codex는 백그라운드에서 마우스·키보드·브라우저·시뮬레이터를 직접 조작하고, 모바일 앱에서 업무와 코딩을 한 대화로 연결한다.
- Chris는 사용량이 빠르게 소진되어 Codex 200달러 구독 두 개와 Claude Code 200달러 Max 구독 하나를 유지하지만, 대부분의 사용자는 가장 낮은 요금제에서 시작해야 한다고 권한다.
Chris는 특정 제품의 무조건적인 전환을 권하지 않는다. Codex와 Claude Code 모두 충분히 강력하며, 각자의 워크플로에서 실제 일을 끝내는지가 제품 선택의 기준이 되어야 한다고 말한다.
1. Claude Code 중심에서 Codex 중심으로 바뀐 배경
Claude Code는 오랫동안 Chris의 생산성 앱 개발을 지탱한 핵심 도구였지만, Codex는 코딩 바깥의 업무까지 하나의 에이전트 경험으로 묶으면서 주력 자리를 차지했다.
1.1. 기존 워크플로와 전환 계기
-
Claude Code를 1년 이상 주력으로 사용한 경험
- Chris는 생산성 앱(productivity app)을 만드는 개발자이며, 지난 1년 넘게 Claude Code를 사용하고 추천했다.
- 직전 워크플로 영상에서 Claude Code가 중심인 설정을 공개했고, 시청자들이 Codex를 확인해 보라고 반복해서 권했다.
-
Codex를 몇 주간 병행한 뒤 주력 도구로 전환
- Chris는 시청자 의견을 따라 Codex를 몇 주간 사용했고, 성능이 매우 좋다는 판단을 내렸다.
- 현재는 Codex를 주로 사용하지만 Claude Code도 계속 사용하며, Codex 두 계정과 Claude Code Max 계정에 각각 월 200달러를 지불한다.
- 이번 선택은 OpenAI의 후원을 받은 결과가 아니며, 두 회사 모두 이 콘텐츠를 후원하지 않았다는 점을 먼저 밝혔다.
1.2. 코딩 성능보다 사용자 경험이 결정적이었던 이유
-
고급 모델을 동시에 비교한 결과
- Codex에서는 GPT-5.6 Soul을 Ultra 모드로, Claude Code에서는 Opus 5를 Ultra Code 설정으로 사용했다.
- 일부 작업에는 Fable 5를 High 또는 Ultra Code 설정으로 투입했다.
- 이처럼 양쪽에서 가장 높은 설정을 사용했을 때 코딩 결과는 대체로 비슷했다.
-
차이를 만든 두 가지 경험
- 코딩이 무승부라면 Codex를 택할 이유는 사용자 경험에 있으며, Chris가 특히 강조한 차이는 컴퓨터 사용과 모바일 경험이다.
- Codex는 작업을 백그라운드에서 계속 수행하게 하고, 모바일에서도 새 대화와 원격 제어를 자연스럽게 시작하게 한다.
2. 백그라운드 컴퓨터 사용이 바꾼 자동화 범위
Codex의 컴퓨터 사용은 단순한 코드 생성이 아니라 실제 데스크톱을 사람처럼 조작하고 결과를 검증하는 기능이다.
2.1. 마우스·키보드·여러 에이전트를 동시에 다루는 구조
-
컴퓨터 사용의 기본 동작
- Codex는 마우스를 움직이고 키보드로 입력하며, 사람이 컴퓨터에서 할 수 있는 작업을 직접 수행한다.
- Claude Desktop과 Claude Code에도 기술적으로 컴퓨터 사용 기능이 있지만, Chris의 체감 평가는 Claude가 5점 만점에 10점 중 5점, Codex가 9점이다.
-
백그라운드 실행과 멀티태스킹
- Codex의 컴퓨터 사용은 백그라운드 조작에 맞춰져 있어 Codex가 컴퓨터를 쓰는 동안에도 사람이 같은 컴퓨터를 계속 사용할 수 있다.
- 여러 Codex 에이전트가 동시에 컴퓨터를 제어할 수 있지만, Claude Desktop은 에이전트가 데스크톱을 독점하므로 사람이 화면을 건드리면 작업이 중단된다.
- Chris는 한 에이전트에게 App Store 리뷰를 분석하게 하고, 다른 에이전트에게 시뮬레이터를 조작하게 하며, 또 다른 에이전트에게 Cloudflare 설정 최적화를 맡긴 채 자신은 별도의 큰 작업에 집중한다.
2.2. iOS 앱 테스트와 복잡한 제스처
-
Xcode Build MCP의 한계 보완
- Claude Code에서 Xcode Build MCP를 사용하면 iOS 시뮬레이터를 제어할 수 있다.
- Xcode Build MCP는 시뮬레이터를 탭할 수 있지만, 목록을 길게 눌러 재배치하는 멀티 드래그(multi-drag) 동작은 효과적으로 테스트하기 어렵다.
-
구현부터 검증까지 이어지는 테스트 흐름
- Codex는 변경 사항을 구현한 뒤 Xcode Build MCP로 시뮬레이터를 빌드하고, 컴퓨터 사용으로 마우스와 키보드를 조작해 복잡한 멀티 드래그까지 실제 사용자처럼 테스트한다.
- Amy 앱의 Apple Watch 연동을 테스트할 때는 iPhone 시뮬레이터와 Apple Watch 시뮬레이터를 동시에 열어 두 기기의 동기화를 확인해야 했고, 여러 시뮬레이터를 동시에 조작하는 컴퓨터 사용이 큰 도움이 됐다.
2.3. 개발자 대시보드와 설정 작업의 위임
-
CLI나 MCP가 없는 화면형 업무
- Vercel, AWS, Cloudflare 같은 개발자 서비스에는 CLI나 MCP가 제공되는 경우가 많지만, 모든 서비스가 개발자 중심으로 설계된 것은 아니다.
- 대시보드에 클릭 가능한 설정이 있다면 99%의 경우 Codex가 브라우저에서 작업을 처리할 수 있다는 점이 핵심이다.
-
Substack 커스텀 도메인 설정 사례
- Chris는 새 뉴스레터를 위해 Substack을 설정하면서 Substack과 Cloudflare 양쪽에서 커스텀 도메인과 여러 DNS 설정을 직접 바꿔야 했다.
- 작업 자체는 어렵지 않았지만 다른 일을 하던 중이었기 때문에 Codex에 Substack과 Cloudflare에서 도메인 설정을 끝내 달라고 요청했다.
- Codex는 화면을 클릭하며 DNS를 구성했고, Chris는 원하면 실시간 과정을 확인할 수 있었으며 약 10분 뒤 설정이 완료됐다.
- 이런 작은 작업을 하루에 100번씩 처리하면 상당한 시간이 누적되므로, 컴퓨터 사용은 개인 비서처럼 자잘한 일을 오프로드하는 효과를 낸다.
2.4. 실제 결제 직전까지 검증한 항공권 검색
-
기존 에이전트가 실패한 이유
- Chris는 항공사 포인트로 특정 조건의 좋은 항공권을 찾는 일을 ChatGPT, Poke, Claude에 맡겨 봤지만 모두 실패했다.
- 에이전트가 Reddit 글 같은 곳에서 거래를 찾아도 오래된 정보이거나 본인이 충족하지 못하는 예외 조건이어서 실제 예약 단계에서 유효하지 않은 경우가 많았다.
-
Codex가 찾은 거래와 검증 절차
- Codex는 약 3~4시간 동안 작업했고, 막대한 양의 토큰을 사용한 끝에 댈러스에서 일본으로 가는 직항 왕복 비즈니스석을 약 4,000달러어치의 포인트로 예약할 수 있는 거래를 찾았다.
- 같은 항공권의 일반 판매가는 약 16,000달러였으므로 항공사 포인트 관점에서 매우 좋은 거래였다.
- Codex는 거래를 찾는 데서 멈추지 않고 Japan Airlines 웹사이트의 체크아웃 흐름에서 Chris의 자격을 확인했으며, 신용카드 입력과 결제 버튼 직전 단계까지 진행해 실제로 유효한지 검증했다.
- Airbnb나 주택 매물처럼 로그인과 사용자별 조건이 중요한 업무에서도 실제 브라우저를 사람처럼 사용해 공개 인터넷을 긁는 데 그치지 않고 마지막 1%를 확인할 수 있다.
2.5. 컴퓨터 사용이 강한 배경
-
Sky 팀 인수에 대한 Chris의 설명
- OpenAI가 Sky라는 회사를 인수했고, Chris가 이해한 바로는 Sky가 Apple Shortcuts를 만든 팀과 관련된 조직이다.
- 해당 팀은 Apple을 떠나 컴퓨터 사용과 에이전트 자동화를 만드는 회사를 시작하려 했고, OpenAI가 팀을 영입해 컴퓨터 사용에 집중시켰다.
-
제품 경험에 대한 결론
- OpenAI의 컴퓨터 사용이 강한 이유는 좋은 실적을 가진 팀 전체가 이 경험을 정교하게 만드는 데 집중하기 때문이라고 Chris는 추정한다.
- 기능의 핵심 가치는 화면을 조작하는 데 있지 않고, 에이전트가 실제 환경에서 작업을 끝냈는지 확인하는 데 있다.
3. 모바일 경험과 업무·코딩의 통합
Codex의 모바일 앱은 새 대화를 시작하고, 컴퓨터 사용과 연결하며, 이동 중에도 실제 개발 업무를 맡기는 통합 창구로 작동한다.
3.1. Claude 원격 제어와 Codex 모바일의 차이
-
원격 제어 체감 평가
- Claude도 세션에서 원격 제어를 시작한 뒤 모바일 앱으로 넘겨 계속 작업할 수 있지만, Chris의 평가는 10점 중 3점이다.
- Codex 모바일 경험은 10점 중 9점이며, 새 대화·안정성·스트리밍·완성도에서 앞선다.
-
대화 시작과 폴더 구조
- Claude는 컴퓨터에서 먼저 시작한 기존 스레드를 사용해야 하고, 모바일에서 처음부터 새 스레드를 열 수 없다.
- Codex는 모바일 앱을 열어 버튼을 누르고 새 대화를 바로 시작할 수 있다.
- Claude의 모든 스레드는 폴더 안에 있어야 하지만, Codex는 폴더 안이나 폴더 밖에서 일회성 작업을 시작할 수 있다.
-
안정성과 모바일 앱의 완성도
- Codex 원격 제어는 더 안정적으로 느껴지고 스트리밍이 일관되게 이어진다.
- 양쪽 앱을 장기간 사용하면 Codex 모바일 경험이 뛰어난 iOS 엔지니어들이 만든 결과라는 차이가 체감된다고 Chris는 말한다.
3.2. 휴대전화에서 이메일을 읽고 앱을 고치는 흐름
-
Amy 앱 장애 대응 사례
- 외출 중 사용자가 Amy 앱이 고장 났다고 이메일을 보내면, Chris는 휴대전화에서 Codex를 열어 새 스레드를 시작하고 마지막 이메일을 확인하라고 요청할 수 있다.
- Codex는 Gmail에 연결되어 이메일 스레드를 읽고, 코드베이스에 접근해 실제 원인을 수정하며, 컴퓨터 사용으로 시뮬레이터를 열어 수정 사항을 테스트한다.
- 검증이 끝나면 수정 사항을 배포하고 사용자에게 보낼 이메일 초안까지 한 번의 모바일 프롬프트로 작성할 수 있다.
-
Claude에서 같은 흐름이 어려운 이유
- Claude Code는 코딩을 담당하고 Claude Cowork는 비코딩 작업을 담당하는 별도 제품이라 두 기능이 서로 원활하게 대화하지 않는다.
- Gmail 스레드를 Claude Cowork에서 읽은 뒤 Claude Code로 넘겨 수정하고 결과를 다시 연결하는 흐름을 만들기 어렵다.
- Claude Cowork의 모바일 사용에는 Dispatch가 필요하고, 한 번에 하나의 스레드만 컴퓨터를 제어할 수 있어 구조가 복잡하고 직관적이지 않다.
3.3. 일과 개인 생활을 하나로 묶는 선택
-
통합이 특히 잘 맞는 사용자
- Chris는 업무와 개인 생활의 도구가 서로 얽혀 있기 때문에 코딩과 일반 업무를 한 에이전트에서 다루는 Codex 방식이 생활을 단순하게 만든다고 말한다.
- 회사 환경에서 업무와 개인 계정을 분리해야 하는 사람에게 같은 구성이 적합하다고 단정할 수는 없다.
-
Anthropic의 개선 여지
- Anthropic도 Claude Code와 Claude Cowork를 통합하려는 작은 변화를 보이고 있다고 Chris는 추정한다.
- 그러나 현재 시점에는 코딩과 일반 업무를 한곳에서 연결하는 경험에서 Codex가 분명히 앞선다고 평가한다.
4. 음성 입력과 모델을 조합하는 실제 워크플로
Chris는 대부분의 프롬프트를 직접 타이핑하지 않고 음성으로 받아쓰며, 작업 난이도와 분야에 따라 모델을 교차 배치한다.
4.1. 코딩 모델의 개인 순위
-
Fable 5를 가장 어려운 문제에 배치
- Chris의 개인적인 코딩 모델 순위에서 Fable 5가 가장 뛰어난 모델이다.
- 다만 비용이 매우 높아 모든 작업에 사용할 수 없으므로 가장 어려운 문제에만 예약한다.
-
GPT-5.6 Soul을 일상적인 주력으로 사용
- GPT-5.6 Soul은 Fable 5보다 조금 낮은 능력으로 평가되지만 문제 해결력이 매우 탄탄하다.
- Chris는 GPT-5.6 Soul을 Ultra 설정으로 사용하며 대부분의 작업을 처리하는 데일리 드라이버로 둔다.
-
Opus 5를 디자인 업무에 배치
- Opus 5는 GPT-5.6 Soul보다 코딩 능력이 약간 낮다고 느끼지만, 디자인 관련 작업에서는 GPT-5.6 Soul보다 나은 결과를 낸다.
- Chris는 디자인 업무를 Opus 5의 Ultra Code 설정으로 넘긴다.
4.2. 모델을 서로 검증하는 라우팅 패턴
-
첫 번째 모델의 결과를 두 번째 모델로 재검토
- Codex가 큰 작업을 마치면 Chris는 Codex에게 Claude Code를 Opus 5 최고 설정으로 실행해 같은 결론에 도달하는지 확인하라고 요청한다.
- 두 모델이 동시에 실행되어 서로의 결과를 비교하면 한 모델만 쓸 때 놓칠 수 있는 문제가 드러난다.
-
Fable 5로 단계적으로 올리는 방식
- GPT-5.6 Soul과 Opus 5가 모두 어려워하는 작업은 Fable 5 High 설정으로 넘긴다.
- Fable 5 High도 해결하지 못하는 매우 복잡한 문제에만 Fable 5 Max를 사용한다.
- Fable 5 Max는 프롬프트 세 번만으로 주간 사용량을 소진시킬 수 있어 극히 제한적으로 사용한다.
-
Claude Code를 계속 구독하는 이유
- Claude 계열 모델은 여전히 Chris의 워크플로에서 역할이 있다.
- 특히 디자인과 글쓰기, 그중에서도 YouTube 스크립트 작성에서는 Claude 모델이 더 강하다고 평가하므로 월 200달러 Max 구독을 유지한다.
4.3. 최고 설정이 항상 필요한가
-
낮은 설정에서도 가능한 코딩
- 낮은 등급 모델도 많은 코딩 작업에서 같은 결과를 낼 수 있지만, 프롬프트를 더 신중하게 작성해야 한다.
- Chris는 프롬프트 작성에 들이는 사고를 줄이기 위해 비용을 더 내고 최고 설정을 계속 사용한다.
-
받아쓰기 중심의 효율성
- 음성으로 대부분의 요청을 전달하면 최고 설정과 모델 라우팅을 이용해 생각을 세밀하게 구조화하지 않고도 작업을 맡길 수 있다.
- 이 선택은 모든 사용자에게 필요한 사양이 아니라, AI 에이전트를 사실상 하루 종일 사용하는 Chris의 개인적인 생산성 비용이다.
5. 요금제 선택과 월 600달러의 경제성
월 600달러는 대부분의 사람에게 과하지만, 소비자 요금제가 엔터프라이즈 API 사용량을 보조하는 구조를 고려하면 Chris에게는 일시적으로 매우 유리한 거래다.
5.1. 대부분의 사용자를 위한 요금제 선택
-
낮은 요금제부터 시작하는 원칙
- 처음부터 월 200달러 요금제를 결제하지 말고 가장 낮은 요금제에서 사용을 시작해야 한다.
- 사용량이 늘어날 때 월 20달러에서 100달러, 필요한 경우에만 200달러로 단계적으로 올린다.
-
처음 선택할 도구
- AI 도구를 처음 쓰는 사람에게는 코딩과 개인적인 생활 업무를 결합하는 경험이 직관적인 Codex를 먼저 권한다.
- 이미 Claude 생태계에 있거나 Claude의 결과를 더 좋아하면 월 20달러 Claude 구독으로 시작하면 된다.
- 디자인과 글쓰기가 주된 업무라면 Claude 모델이 강하므로 Claude 구독이 더 적합할 수 있다.
5.2. 작업별 권장 모델과 설정
-
Codex 사용 기준
- 코딩은 GPT-5.6 Soul Medium에서 시작하고, 결과가 좋으면 그 설정을 유지하거나 더 낮춰도 되는지 시험한다.
- 결과가 부족할 때만 High와 Ultra로 올린다.
- Chris 본인도 대부분의 코딩을 GPT-5.6 Soul High로 처리할 수 있다고 보지만, 프롬프트를 덜 고민하려고 Ultra를 사용한다.
-
비코딩 작업과 컴퓨터 사용 기준
- 비코딩 작업은 GPT-5.6 Soul Medium으로 시작하며, Chris의 경험상 약 90%를 이 설정으로 해결할 수 있다.
- 컴퓨터 사용에서 에이전트가 버벅이면 High 또는 Ultra로 올린다.
-
Claude 사용 기준
- 월 20달러 요금제에서는 대부분의 작업에 Sonnet을 최고 설정으로 사용한다.
- 월 100달러 요금제에서는 Opus 5 High가 대부분의 작업에 적절하다.
- 비코딩 작업에 Opus를 최고 설정으로 계속 사용해도 주간 사용량을 소진하기 어렵다고 느낄 만큼 Claude가 비교적 넉넉한 사용량을 제공한다고 말한다.
5.3. 소비자 구독이 사실상 보조되는 구조
-
200달러 요금제의 손실 구조
- Chris가 확인한 추정치에 따르면 Anthropic은 Claude Code 200달러 요금제를 최대로 사용하면 사용자 한 명당 약 4,000달러를 잃을 수 있다.
- OpenAI도 Codex 200달러 구독에서 약 4,000~5,000달러를 잃을 수 있으며, 정확한 수치는 모르지만 양쪽 회사가 소비자 요금제에서 큰 손실을 감수한다고 설명한다.
-
엔터프라이즈 API로 손실을 보전하는 방식
- Capital One 같은 대기업은 소비자용 200달러 구독을 사용할 수 없고 API 기반 가격을 지불해야 한다.
- 소비자 구독자가 200달러로 얻는 수준의 사용량을 기업이 API로 확보하려면 약 5,000달러를 지출해야 한다.
- 기업의 높은 API 매출이 소비자 요금제의 손실을 메우고, 회사는 소비자에게 사실상 원가 이하로 사용량을 제공한다.
-
Chris의 세 계정 가치 계산
- Codex 두 계정과 Claude Code 한 계정에 각각 200달러씩 지불하는 월 600달러 구성은 API 가격으로 환산하면 약 15,000달러에 가까운 사용량을 얻는 셈이다.
- 생산성 앱 개발을 생업으로 삼는 Chris에게는 도구가 제공하는 가치가 월 600달러를 훨씬 넘기 때문에 이 지출을 정당한 거래로 본다.
5.4. 현재의 보조금이 영원하지 않을 가능성
-
사용량 제한이 이미 강화된 사례
- 약 7개월 전 Claude Max 200달러 요금제에는 5시간 또는 주간 제한이 없었다.
- 일부 사용자는 200달러 요금제로 약 100,000달러 상당의 API 비용을 발생시켰고, 현재는 이런 구조가 사라졌다.
- 기업이 손실을 계속 떠안기 어렵기 때문에 앞으로 사용량 제한이 더 늘고 소비자 보조금은 줄어들 가능성이 크다.
-
1달러 Uber 비유
- Chris가 대학생이던 약 10년 전에는 투자자 보조금 덕분에 Uber를 1달러에 이용할 수 있었다.
- 친구들과 너무 저렴해서 어디든 Uber를 타고 다녔던 경험은 현재 AI 코딩 도구의 200달러 구독과 비슷한 구조다.
- 추론 비용(inference cost)이 내려가지 않으면 3~4년 뒤 월 200달러 클라우드 구독이 5,000달러가 된 상황을 사람들이 회상할 수도 있다.
- Chris는 지금의 가격과 사용량이 영원히 지속되지 않을 것으로 보고, 보조금이 유지되는 동안 현재의 좋은 거래를 최대한 활용한다.
주요 발언 모음
“코딩이 아니라 사용자 경험이 Codex를 선택하게 만든 핵심 이유다.”
“대시보드가 있고 클릭할 수 있다면, 99%의 경우 컴퓨터 사용이 처리할 수 있다.”
“Codex는 이메일을 읽고, 코드를 고치고, 시뮬레이터에서 테스트하고, 배포한 뒤 사용자에게 보낼 이메일까지 한 번의 프롬프트로 작성할 수 있다.”
“대부분의 사람은 AI 구독에 600달러를 쓸 필요가 없으며, 가장 낮은 요금제에서 시작해 사용량에 맞게 올려야 한다.”
“결국 중요한 것은 어떤 도구를 고르는지가 아니라 그 도구로 무엇을 하고 일을 끝내는지다.”
핵심 데이터 & 수치
- 월 구독료: Codex 200달러 계정 두 개와 Claude Code Max 200달러 계정 하나로 총 600달러를 지불한다.
- 사용량 소진 속도: 빠른 모드를 쓰지 않고 보수적으로 사용해도 Codex 주간 사용량을 약 3일 만에 소진한다.
- 컴퓨터 사용 평가: Claude는 10점 중 5점, Codex는 10점 중 9점으로 체감 평가한다.
- 모바일 원격 제어 평가: Claude는 10점 중 3점, Codex는 10점 중 9점으로 체감 평가한다.
- 항공권 사례: 댈러스-일본 직항 왕복 비즈니스석을 약 4,000달러어치 포인트로 찾았고, 일반 판매가는 약 16,000달러다.
- 설정 완료 시간: Substack 커스텀 도메인과 Cloudflare DNS 설정을 약 10분 만에 완료했다.
- 권장 요금제 단계: 월 20달러에서 100달러, 필요할 때 200달러 순서로 올린다.
- 비코딩 작업 성공 체감: GPT-5.6 Soul Medium으로 약 90%의 비코딩 작업을 처리한다.
- API 비용 환산: 월 200달러 소비자 구독의 사용량은 기업 API 가격으로 약 5,000달러에 해당할 수 있고, 세 계정은 약 15,000달러 수준으로 환산된다.
- 미래 가격 비유: 10년 전 1달러 Uber처럼 현재의 200달러 AI 구독도 추론 비용에 따라 사라질 수 있는 보조금 가격이다.
결론 및 시사점
- Codex의 핵심 경쟁력은 코드 한 줄의 품질보다 브라우저·대시보드·시뮬레이터를 백그라운드에서 실제로 조작하고 검증하는 컴퓨터 사용에 있다.
- 모바일에서 새 대화를 시작하고 Gmail, 코드베이스, 시뮬레이터, 배포를 하나로 연결하는 구조는 업무와 개인 생활이 섞인 개발자에게 특히 큰 생산성 이점을 준다.
- Claude Code는 디자인과 글쓰기, 높은 난도의 교차 검증에서 여전히 가치가 있으므로 두 도구를 경쟁 관계가 아닌 모델 라우팅 조합으로 사용할 수 있다.
- 대부분의 사용자는 GPT-5.6 Soul Medium이나 월 20달러 요금제에서 시작하고, 실제 사용량과 결과가 부족할 때만 더 비싼 요금제와 높은 설정으로 올려야 한다.
- 월 600달러 구성은 일반 소비자에게 과하지만, 에이전트를 생업에 24시간 활용하고 소비자 구독의 보조금 구조를 이해하는 사용자에게는 한시적으로 높은 투자 수익을 낼 수 있다.
- 소비자 구독의 손실 보전 구조와 사용량 제한 강화는 현재의 저렴한 고사용량 시대가 영원하지 않다는 신호이므로, 지금의 가격을 장기적인 권리로 간주하면 안 된다.
핵심 요약 (20줄)
Codex는 Claude Code보다 코딩 결과가 압도적으로 좋아서가 아니라 사용자 경험이 더 통합적이어서 Chris의 주력 도구가 됐다. Chris는 Claude Code를 1년 넘게 사용한 뒤 시청자들의 권유로 Codex를 몇 주간 시험했다. GPT-5.6 Soul Ultra와 Opus 5 Ultra Code를 비교한 결과 고급 코딩 성능은 대체로 비슷했다. Codex의 가장 큰 차별점은 여러 에이전트가 컴퓨터를 백그라운드에서 동시에 조작할 수 있다는 점이다. 사람은 Codex가 마우스와 키보드를 사용하는 동안에도 같은 컴퓨터에서 자신의 작업을 계속할 수 있다. Codex는 App Store 리뷰 분석, 시뮬레이터 테스트, Cloudflare 설정을 여러 에이전트에게 동시에 맡길 수 있다. Xcode Build MCP와 Codex 컴퓨터 사용을 결합하면 iOS 앱의 멀티 드래그 제스처까지 실제처럼 검증할 수 있다. Apple Watch 연동 테스트에서는 iPhone과 Watch 시뮬레이터를 동시에 조작하는 기능이 특히 유용했다. Codex는 CLI나 MCP가 없는 Substack과 Cloudflare의 커스텀 도메인 설정을 약 10분 만에 완료했다. 항공권 검색에서 Codex는 댈러스-일본 비즈니스석 거래를 찾은 뒤 Japan Airlines 결제 직전까지 자격을 검증했다. 해당 항공권은 약 4,000달러어치 포인트가 필요했지만 일반 판매가는 약 16,000달러였다. OpenAI가 인수한 Sky 팀의 컴퓨터 사용 전문성이 Codex 경험의 강점에 기여했을 가능성이 있다. Codex 모바일 앱은 새 스레드와 폴더 없는 일회성 대화를 바로 시작할 수 있어 Claude보다 편리하다. Codex는 Gmail 이메일을 읽고 코드를 수정하고 시뮬레이터에서 테스트하고 배포하는 흐름을 휴대전화에서 연결한다. Chris는 Fable 5를 가장 어려운 문제에, GPT-5.6 Soul을 일상 코딩에, Opus 5를 디자인 작업에 배치한다. Codex가 큰 작업을 끝내면 Claude Code의 Opus 5로 두 번째 검토를 수행해 서로의 결론을 비교한다. Fable 5 Max는 프롬프트 세 번만으로 주간 사용량을 소진할 수 있어 극히 제한적으로 사용한다. 대부분의 사용자는 월 20달러에서 시작해 사용량에 따라 100달러와 200달러로 단계적으로 올려야 한다. Chris는 Codex 두 계정과 Claude Code Max 계정에 월 600달러를 지불하지만 도구 가치가 그보다 크다고 판단한다. 소비자 구독 보조금과 추론 비용 변화로 현재의 월 200달러 고사용량 혜택은 영원히 지속되지 않을 수 있다.
