Codex에서 100만 토큰 컨텍스트 켜는 법 — 요금 구간부터 확인하세요
어제 OpenAI에서 Codex를 이끄는 티보 소티오(Tibo Sottiaux)가 설정법을 공개했어요. 그동안 API 키로만 되던 100만 토큰 컨텍스트를 이제 ChatGPT 구독 계정에서도 켤 수 있습니다.
컨텍스트는 AI가 한 번에 붙들고 있는 분량이에요. 넓히면 큰 저장소를 통째로 물려도 앞부분을 잊지 않아요.
켜는 법
설정 파일에 세 줄을 넣으면 됩니다.
# 이 파일은 홈 폴더 안 .codex/config.toml 이에요
# 어떤 모델을 쓸지 정하는 줄이에요
model = "gpt-5.6-sol"
# 컨텍스트 창을 100만 토큰으로 넓혀요
model_context_window = 1000000
# 90만 토큰쯤 차면 알아서 요약해 자리를 비워요
model_auto_compact_token_limit = 900000model_context_window는 창 크기고, model_auto_compact_token_limit은 대화가 그만큼 차면 알아서 요약해 자리를 비우는 지점이에요. 창 크기의 90%를 넘겨 잡으면 조용히 무시되니 90만이 상한입니다.
켜기 전에 볼 것
GPT-5.6 Sol 스펙은 105만 토큰인데, 입력이 27만 2천 토큰을 넘으면 요금 구간이 바뀌어요. 넘은 만큼만 더 받는 게 아니라 그 요청 전체가 비싼 단가로 다시 계산됩니다. 27만 3천 토큰짜리 요청은 마지막 천 토큰만 할증되는 게 아니라 통째로 두 배예요.
Claude Opus 5는 같은 100만 토큰인데 구간이 없어요. 9천 토큰이든 90만 토큰이든 단가가 같습니다. 그록 4.6도 구간제를 쓰고 있어서, 긴 컨텍스트에 값을 더 받는 쪽과 안 받는 쪽이 갈리는 중이에요.
확인된 것과 아닌 것
확인된 것 — 모델 스펙은 105만 토큰이고, Codex 기본값은 그보다 작게 잡혀 있으며, 설정으로 올릴 수 있어요. 기본값은 성능과 비용에 맞춰 일부러 낮춰둔 값이라고 Codex 책임자가 직접 밝혔습니다.
아직 아닌 것 — 깃허브에는 "실제 쓸 수 있는 창이 37만에서 27만으로, 다시 25만 8천으로 줄었다"는 신고가 올라와 있어요. 7월 13일자이고 OpenAI 공식 답변은 아직 없습니다. 사용자 관측이지 발표가 아니에요.
이럴 때 켜세요
Codex 책임자가 밝힌 효과는 이거예요. 요약해서 버리기 전까지 코드·도구 출력·대화 기록을 더 오래 들고 있는다는 것. 그러니 값어치가 있는 건 한 번에 넓게 봐야 하는 작업이에요.
- 저장소 전체 리팩터링 — 이름 하나 바꾸는데 서비스·테스트·빌드 설정·문서가 같이 걸릴 때. 한 군데 고치고 다른 호출부를 놓치는 사고가 줄어요
- 장애 원인 추적 — 로그·최근 변경분·설정·에러 리포트를 한꺼번에 펼쳐놓고 봐야 할 때
- 파일을 건너뛰는 의존성 문제 — 규칙은 A에 정의돼 있고 구현은 B, 검사는 C에 있는 경우
반대로 켜지 말아야 할 때
파일 몇 개 고치는 작업엔 그냥 두세요. 창을 넓히면 그만큼 더 담게 돼서 요금이 따라 오르고, 길어질수록 정확도가 떨어진다는 측정도 있습니다. 제3자 벤치마크에서는 4천 토큰과 12만 8천 토큰 사이에 정확도가 15–30% 떨어졌고, 특히 가운데 묻힌 내용을 잘 놓쳤어요.
그래서 순서가 중요해요. 첫 지시를 촘촘히 쓰는 것이 먼저고, 창을 넓히는 건 그다음입니다. 필요한 작업에만 켜고 끝나면 되돌리는 쪽이 안전해요.
100만 토큰 컨텍스트 써보신 분 계세요? 카톡 오픈채팅 ⚡ AI랑 코딩하는 사람들에 후기 들려주세요.