그록 4.6 나왔어요 — 성능은 동률, 요금은 구간제예요
그저께(8월 12일) Grok 4.6이 나왔어요. 4.5가 7월 초에 나왔으니 다섯 주 만이에요. 커서, 그록 빌드, API에서 바로 쓸 수 있습니다.
잠깐, SpaceXAI가 뭐예요?
문서에 xAI 대신 SpaceXAI라고 적혀 있어서 당황하실 수 있어요. 지난 2월 SpaceX가 xAI를 인수했고, 5월부터 그록과 X가 SpaceX 산하 SpaceXAI로 넘어갔습니다. 그록을 만드는 곳이 이제 로켓 회사의 AI 사업부인 셈이죠. 우리 입장에서 달라지는 건 API 이름과 청구서에 찍히는 회사명 정도예요.
성능은 사실상 동률
아래는 Artificial Analysis라는 제3자 평가기관이 낸 지능 지수예요. 회사가 자기 점수를 발표한 게 아니라는 점이 중요해요.
| 모델 | 지능 지수 |
|---|---|
| Claude Opus 5 | 63 |
| Grok 4.6 | 61 |
| GPT-5.6 Sol | 61 |
| Grok 4.5 | 56 |
4.5에서 5점 올라 GPT-5.6 Sol과 동률, Claude Opus 5에 2점 뒤예요. 지식 업무와 법률 추론에 강한 대신 터미널 작업에는 약하다는 평가라, 코딩 에이전트로 쓸 거면 이 부분을 감안하세요.
진짜 봐야 할 건 요금표예요
값은 4.5와 같은 입력 $2 / 출력 $6입니다. GPT-5.6 Sol($5/$30)보다 한참 싸요. 그런데 값을 볼 땐 조건을 하나 같이 봐야 해요.
요청이 20만 토큰을 넘으면 그 요청 전체가 두 배 요금으로 계산돼요. 넘은 만큼만 더 받는 게 아니라 처음부터 다시 매기는 방식이에요.
컨텍스트 창은 50만 토큰인데 요금은 20만에서 뛰니, 뒤쪽 30만 토큰은 두 배 값을 내고 쓰는 구간인 셈이죠.
참고로 이건 그록만의 방식이 아니에요. GPT-5.6 Sol도 27만 2천 토큰을 넘으면 $5/$30에서 $10/$45로 똑같이 두 배가 됩니다. 긴 요청은 GPU를 훨씬 오래 붙잡고 있어서 그래요 — 토큰이 늘면 계산량과 메모리가 그 이상으로 불어나거든요. 그러니 긴 컨텍스트를 쓸 거면 어느 모델이든 분기점이 어디인지부터 확인하는 게 맞아요.
2천 토큰 차이로 값이 두 배
말로만 들으면 감이 안 오니 계산해볼게요. 아래는 토큰 수만 살짝 다른 요청 두 개의 값을 비교하는 코드예요.
# Grok 4.6 입력 요금 (100만 토큰당 달러)
싼값 = 2.00
# 20만 토큰을 넘기면 이 값으로 바뀌어요
비싼값 = 4.00
# 요금이 바뀌는 분기점
분기점 = 200_000
# 토큰 수만 살짝 다른 요청 두 개를 비교해봐요
for 토큰 in [199_000, 201_000]:
단가 = 비싼값 if 토큰 >= 분기점 else 싼값
비용 = 토큰 / 1_000_000 * 단가
print(f"{토큰:,}토큰 -> ${비용:.3f}")결과는 이렇게 나와요.
199,000토큰 -> $0.398
201,000토큰 -> $0.8042천 토큰, 전체의 1%를 더 넣었을 뿐인데 값이 2.02배가 됐어요. 긴 파일을 통째로 넣는 습관이 있다면 이 선을 넘는지 한 번 확인해볼 만해요.
정리
- 성능은 프론티어급, 값은 더 낮은 편인데, 20만 토큰 선을 넘으면 단가가 두 배가 돼요 (그래도 $4/$12라 GPT-5.6 Sol보다는 낮아요)
- 터미널 작업이 약하다니 코딩 에이전트로는 싼 모델·비싼 모델 나눠 쓰기가 여전히 유효해요
- 그록이 처음이면 4.5 정리 편부터 보세요
20만 토큰 선, 넘겨보신 분 계세요? 청구서가 어땠는지 카톡 오픈채팅 ⚡ AI랑 코딩하는 사람들에 공유해 주세요.