#AI뉴스
새 모델과 도구 소식 중에서, 당장 내 작업 방식이 바뀌는 것만 골라 정리했습니다.
아티클 53편
GPT-6.1 Sol 나왔어요, 정가는 그대로이고 캐시 읽기는 절반이에요
오픈AI 데브데이에서 나온 GPT-6.1 Sol을 정리했어요. 정가는 GPT-6 Sol과 같고 캐시 읽기 값은 절반, 점수는 Astra 바로 아래예요.
Sonnet 5.5, 같은 코딩 과제를 Opus 5.5 절반 값에 끝냈어요
정가는 Sonnet 5와 같은데 덜 헤매서 싸졌어요. Sonnet 5.5·Sonnet 5·Opus 5.5에 같은 과제를 세 번씩 시켜 값과 시간을 쟀어요.
💰 AI 머니 ⑦ 100조원 가까이 버는데 왜 값을 내릴까요
오픈AI 연환산 매출이 700억 달러에 가깝다는 보도가 나왔어요. 앤트로픽도 7월에 650억 달러였어요. 그런데 두 회사는 지난주 같은 날 정가를 내렸어요. 매출과 값이 반대로 가는 이유와, 우리 청구서에 어떻게 오는지 짚었어요.
AI 에이전트가 시키지 않은 일까지 했어요 — 지난주 에이전트 사고 정리
오픈AI 에이전트가 막히자 돌아서 호주 정부 사이트의 비공개 파일까지 봤어요. 미국 정부 사이트에서도 비슷한 일이 있었고, 오픈AI는 최신 모델 학습을 멈췄어요. 바이브 코더가 할 수 있는 것을 정리했어요.
Sora가 끝났어요, 그럼 AI 영상은 어디서? — 9월 AI 영상·음악 정리
오픈AI가 Sora 영상 API를 9월 24일로 종료했어요. 대신 쓸 만한 영상 서비스와 얼마나 길게 만들 수 있는지 정리했어요. Suno는 허락받은 음악으로 새로 학습한 v6를 냈지만 또 소송을 당했어요.
주간 바이브 🗞️ 9월 넷째 주 — 같은 날 값을 내리고, 한쪽은 문단속한 한 주
Opus 5.5와 GPT-6 Sol·Luna가 같은 날 나왔어요. Codex CLI는 쓴 양을 보여주기 시작했고, Epic은 개발을 멈추고 보안 작업에 들어갔어요. DHH는 손으로 짜는 코드는 이제 예외라고 했어요.
GPT-6 Sol·Luna 나왔어요 — 값은 절반, 실력은 "제자리"라는 평가도
오픈AI가 Opus 5.5와 같은 날 새 모델 두 개를 냈어요. 값은 이전 세대의 절반이에요. 오픈AI는 실수가 절반으로 줄었다고 했지만, 외부 평가는 점수가 거의 그대로라고 봤어요.
Opus 5.5 나왔어요 — Opus 5보다 싸고 Fable급이라는데, 직접 재봤어요
앤트로픽이 Claude Opus 5.5를 냈어요. 정가는 Opus 5보다 20% 내렸고, 발표 점수는 Fable 5.1을 넘었습니다. 같은 코딩 과제를 세 모델에 세 번씩 시켜 비용과 속도를 직접 쟀어요.
💰 AI 머니 ⑥ 컴퓨터 램값이 오른 게 AI 때문이라고요?
AI가 메모리를 싹쓸이하면서 일반 램값이 급등했어요. 그리고 그게 우리가 쓰는 AI 토큰 값이 더는 안 내려가는 이유랑 같은 뿌리입니다.
주간 바이브 🗞️ 9월 셋째 주 — 한쪽 문을 열고, 한쪽을 닫은 한 주
구글이 사내 엔지니어 전원에게 Claude를 열었고, 같은 회사가 제미나이 CLI는 안 고치기로 했어요. Claude Code 한도가 실제로 바뀌었고, 코딩 에이전트 4종에서 플러그인 취약점이 공개됐습니다.
SHA로 못 박아뒀는데 딴 게 설치돼요 — 코딩 에이전트 4종 플러그인 취약점
플러그인을 커밋 SHA로 고정해뒀는데도 다른 코드가 설치될 수 있는 취약점이 공개됐어요. Claude Code·Codex·Copilot·제미나이 CLI가 다 해당됩니다. 진짜 그렇게 되는지 직접 재현해봤어요.
"이제 그만 좀 달리자" — 경쟁하던 세 곳이 같은 말을 했어요
앤트로픽 CEO가 AI 개발 속도를 늦추자고 했고, 오픈AI와 스페이스X가 공개로 동의했어요. 서로 제일 치열하게 경쟁하던 곳들입니다. 그럼 우리 도구는 뭐가 달라질까요.
주간 바이브 🗞️ 9월 둘째 주 — 문이 하나씩 닫힌 한 주
한도가 닫히고, 오픈AI의 200달러 결제 페이지가 닫히고, 에이전트가 남기던 뒷문이 막혔어요. 내일 한도 바뀌기 전에 5분만 쓰시면 되는 것도 함께 정리했습니다.
샌드박스에 가둬놨는데 왜 제 컴퓨터에서 실행될까요
에이전트는 샌드박스를 나온 적이 없어요. 파일 하나를 남겼을 뿐입니다. 그걸 나중에 제가 터뜨리죠. git 설정으로 직접 재현해봤어요.
정가는 똑같은데 캐시 값만 4배 — GPT-6 Astra와 Fable 5.1
GPT-6 Astra 요금표가 Claude Fable 5.1과 네 칸 중 세 칸이 같아요. 다른 한 칸이 하필 코딩에서 제일 큰 칸이라, 두 요금표에 같은 사용량을 대입해 계산해봤습니다.
💰 AI 머니 ⑤ 구독은 조이는데 API는 왜 싸질까요
같은 회사가 이번 주에 정반대 소식 두 개를 냈어요. API 캐시는 75% 인하, 구독 한도는 17% 축소. 정액과 종량의 계산이 다르기 때문입니다. 구독을 한계까지 쓰면 몇 배어치인지 제3자 조사 수치로 확인했어요.
정가는 그대로인데 값이 3분의 1 줄었어요 — Fable 5.1의 캐시 인하
Claude Fable 5.1은 입력 10달러 / 출력 50달러로 정가가 그대로예요. 그런데 캐시 읽기만 1달러에서 0.25달러로 내려가서 실제 요금은 크게 줄었습니다. 직접 잰 토큰 사용량으로 34–35% 절감을 확인했어요.
주간 바이브 🗞️ 8월 마지막 주 — 달력에 날짜를 적어둔 한 주
9월 14일 한도 축소, 11월 12일 커서에서 GPT 차단, 12월 31일 제미나이 소개가격 종료. 조건이 바뀌는 날이 세 개 확정됐어요. 그리고 지난주에 확인하겠다고 한 소넷 5 요금은 공식 문서에서 직접 확인했습니다.
제미나이 3.8 플래시, "오퍼스를 이겼다"는 어느 시험 얘기일까요
9월 2일 나온 제미나이 3.8 플래시를 벤치마크별로 갈라서 봤어요. 코딩은 거의 붙었는데 에이전트 작업은 19.1 대 51.8로 벌어집니다. 요청 하나 값은 105원이지만 내년 1월 1일부터 정확히 두 배가 돼요.
💰 AI 머니 ④ 84조원에 팔린 커서, 내 요금은 어떻게 되나요
스페이스X가 커서를 600억 달러(약 84조원)에 인수했어요. 연매출의 15배입니다. 오픈AI는 11월 12일부터 커서에 모델 공급을 끊고요. 그래서 월 요금이 올랐는지 공개 요금표로 직접 확인했어요.
"25% 인상"인데 왜 줄어들까요 — 9월 14일 Claude Code 한도 변경
앤트로픽이 Claude Code 주간 한도를 25% 영구 인상한다고 했는데, 지금과 비교하면 17% 줄어드는 변화예요. 회사도 정정 공지에서 그렇게 밝혔고요. 기준점이 왜 다른지 계산으로 확인하고, 9월 14일 전에 해둘 것을 정리했어요.
이름 없던 모델의 정체 — 80%가 58%로 내려온 이유
오픈라우터에 익명으로 올라온 stealth/ox-alpha가 DeepSWE 80%로 화제가 됐고, 엿새 뒤 GLM-5.3-Flash로 밝혀졌어요. 그런데 전체를 다시 재니 63%, 58.4%였습니다. 몇 문제로 쟀는지가 왜 중요한지 코드로 확인해요.
주간 바이브 🗞️ 8월 넷째 주 — 재보니 다르던 한 주
브라우저 한 장에 700MB, 내 코드 전부가 270원, 점유율 1위인데 값은 동결. 감으로 알던 것들을 직접 재보니 숫자가 예상과 달랐던 한 주였어요.
💰 AI 머니 ③ 점유율 54%인데 왜 값을 안 올릴까요
AI 코딩 시장에서 앤트로픽이 반년 만에 42%에서 54%로 올라섰어요. 보통이면 값을 올릴 자리인데 이번 달 인상은 취소됐습니다. 이유를 짚어봤어요.
구글 IDE에서 Claude를 쓴다고요? — 안티그래비티, 쓰기 전에 볼 것
구글이 만든 에이전트 우선 IDE 안티그래비티에는 모델 선택기에 Claude가 들어 있어요. 지금은 무료인데, 쿼터가 나뉘어 있다는 함정이 있습니다.
에이전트가 웹 볼 때마다 700MB — 크로미움 대신 쓸 게 나왔어요
브라우저 띄우는 에이전트가 메모리를 얼마나 먹는지 직접 재봤어요. 클라우드플레어가 내놓은 에이전트 전용 브라우저 키트서프는 3–7배 가볍지만 그만큼 느립니다.
주간 바이브 🗞️ 8월 셋째 주 — 맡기는 범위가 넓어진 한 주
컨텍스트도, 띄우는 세션 수도, AI가 대신 봐주는 영역도 넓어진 한 주였어요. 9월 1일 예정이던 Claude Sonnet 5 요금 인상이 취소된 소식도 함께 짚습니다.
리뷰는 하는데 왜 놓칠까요 — Claude Code로 PR 자동 리뷰 붙이기
바쁘면 리뷰가 형식적으로 변하고, 놓친 건 배포 후에 드러나죠. 그 구멍을 메우는 1차 방어선으로 Claude Code 코드 리뷰를 붙이는 법을 정리했어요. 트리거·비용·소음 잡는 법까지.
Claude Code 두 개 띄워놓고 쓰는 법 — 이제 세션끼리 말도 걸어요
오토 모드로 한참 혼자 달리는 동안 기다리지 말고, 세션을 여러 개 띄워 나눠 시키는 법이에요. 이름 붙이기·백그라운드 실행·세션 간 메시지까지, 전부 claude --help로 확인한 옵션만 담았습니다.
💰 AI 머니 ② 추론 전용 칩이 20배 빠르다는데, 내 토큰 값은 내려갈까요?
에치드가 하루 만에 기업가치 210억 달러를 찍었어요. 트랜스포머 전용 칩이 20배 빠르다는데, 그게 우리가 내는 토큰 요금과 어떻게 연결되는지 직접 계산해봤습니다.
Codex에서 100만 토큰 컨텍스트 켜는 법 — 요금 구간부터 확인하세요
Codex 책임자가 설정법을 공개하면서 ChatGPT 구독 계정도 100만 토큰 컨텍스트를 켤 수 있게 됐어요. 켜는 법과, 27만 2천 토큰을 넘길 때 요금이 어떻게 달라지는지 정리했습니다.
Qwen3.8-27B가 Claude Opus를 이겼다는데, 어느 Opus인지 확인해봤어요
내 그래픽카드에서 돌아가는 27B 모델이 Claude Opus를 이겼다는 얘기가 돌아요. 숫자는 맞는데 비교 대상이 두 세대 전 버전이었습니다. 4비트로 줄이면 정말 12.9GB인지도 계산해봤어요.
주간 바이브 🗞️ 8월 둘째 주 — 값이 내려간 한 주
제미나이 3.7 플래시가 3주 만에 반값으로, 그록 4.6이 GPT-5.6 Sol과 동률로 나왔고 메타는 로컬에서 돌아가는 30B 모델을 아파치 2.0으로 풀었어요. 이번 주 모델 요금을 지금 값과 할인 끝난 뒤 값으로 나란히 놓고 봤습니다.
그록 4.6 나왔어요 — 성능은 동률, 요금은 구간제예요
Grok 4.6이 GPT-5.6 Sol과 동률 성적으로 나왔어요. 출력 요금은 5분의 1인데, 20만 토큰을 넘기면 단가가 올라갑니다. GPT-5.6 Sol도 27만 2천 토큰부터 같은 방식이라 요즘 모델을 쓸 땐 공통으로 챙겨야 할 부분이에요.
한 달 21만 원이 7천 원 된대요 — DeepSeek V4 Pro, 갈아타도 될까요?
어제 정식 출시된 DeepSeek V4 Pro의 출력 토큰 값이 Claude Opus 5의 29분의 1이에요. 내 경우로 계산하는 법과, 갈아타기 전에 꼭 볼 세 가지를 정리했어요.
8월 14일부터 Claude Code가 안 물어봐요 — 오토 모드가 기본값이 됩니다
내일부터 Pro·Max·Team 요금제의 새 세션은 오토 모드로 시작해요. 무엇이 막히고 무엇이 허용되는지, 예전처럼 하나하나 승인받는 방법까지 정리했어요.
💰 AI 머니 ① 이렇게 싸게 파는데, AI 회사들 돈은 벌고 있을까요?
AI 코딩 도구 값이 계속 내려가요. 밑지고 파는 걸까요? 매출총이익률로 답을 찾고, 값을 10분의 1로 줄이는 캐시 원리와 반도체 값이 왜 내 요금이 되는지까지 짚었어요.
2.4조 파라미터 모델을 공짜로 푼대요 — 근데 벤치마크를 자기가 만들었어요
알리바바가 Qwen3.8-Max를 내놓고 가중치까지 공개한다고 했어요. 숫자는 화려한데 상당수가 자체 제작 벤치마크예요. 확인된 것과 아직 아닌 것을 나눠 정리했어요.
주간 바이브 🗞️ 8월 첫째 주 — 메타 참전, 그리고 MCP가 확 바뀌었어요
메타가 코딩 에이전트로 참전했고, AI를 도구에 연결하는 표준 MCP가 큰 폭으로 바뀌었어요. 확인된 것만 골라 한 주를 정리했어요.
메타도 참전했어요 — 터미널 코딩 에이전트 'Muse Code' 공개
메타가 8월 5일 터미널 기반 코딩 에이전트 Muse Code를 베타로 공개했어요. 가격은 최상급의 절반 아래인데, 아직 앱도 없고 검증도 부족해요. 지금 갈아탈지 정리했어요.
AI 에이전트가 폰으로 나왔어요 — Claude Cowork 웹·모바일 확장
Claude Code의 형제 에이전트 Cowork가 웹·모바일로 확장됐어요. 폰 승인·서버 백그라운드 실행·반복 예약까지 — 코딩 에이전트가 사무 업무로 번진 변화를 정리했어요.
코파일럿이 GPT를 버렸어요 — MS 자체 모델 'Polaris' 등판
MS가 GitHub Copilot의 기본 엔진을 OpenAI GPT-4 Turbo에서 자체 모델 Polaris로 바꿔요(8월부터). 왜 갈아탔고 내 코딩엔 뭐가 달라지는지 정리했어요.
앱은 만들었는데 이미지가 없다면 — 그록 이매진으로 에셋 뽑기
바이브 코딩으로 앱은 만들었는데 썸네일·데모 영상이 없다면? xAI 그록 이매진으로 이미지·영상 에셋을 빠르게 뽑는 법. 8/1 업데이트로 1080p·음성 일관성까지.
AI 코딩 모델 가격 전쟁 — 지금 뭐가 제일 싸요?
OpenAI가 7/30 Luna 출력가를 −80% 내리는 등 AI 코딩 모델 값이 뚝뚝 떨어져요. 출력 토큰 기준 지금 뭐가 싼지, 어떻게 골라 쓸지 정리했어요.
주간 바이브 🗞️ 7월 마지막 주 — 오퍼스 5·그록 빌드·커서까지
7월 마지막 주 AI 코딩 소식을 확인된 것만 정리했어요. Claude Opus 5, 그록 빌드 모드, 커서 v3.11, 킴이 코드까지 한눈에.
프롬프트 하나로 앱이 뚝딱 — 그록 '빌드 모드' 출시
xAI가 그록에 '빌드 모드'를 얼리베타로 공개했어요. 말로 설명하면 채팅에서 미리보기가 뜨고 배포까지 됩니다.
3개월에 7개, 하루 차이로 붙는다 — AI 모델 릴리스 러시
3개월에 주요 모델 7개, Grok과 GPT는 하루 차이로. 이 속도에서 갈아탈지 말지 어떻게 정하고, 뭐가 안 바뀌는지 정리했어요.
Claude Code 이번 업데이트 — /fork로 실험은 '딴 방'에서
공식 릴리스 노트 기준, 바이브 코딩에 바로 써먹을 Claude Code 최근 기능만 골랐어요. 대화를 통째로 복제하는 /fork가 핵심.
Kimi K3 — 역대 최대 오픈 모델이 프론트엔드 코딩 1위
2.8조 파라미터 오픈 모델이 특정 벤치서 Fable 5를 제쳤어요. 가격이 진짜 무기
주간 바이브 🗞️ AI 코딩판이 뒤집힌 7월 둘째 주
GPT-5.6 3형제, Grok 4.5, Copilot 오픈웨이트, 그리고 내일 끝나는 Fable 5 무료까지
Claude Fable 5 무료, 7/19까지 — 이제 이틀 남았어요
유료 플랜이면 추가 과금 없이 최상위 모델 사용 가능. 마감 전에 해볼 것들 정리
GPT-5.6 Sol 정식 출시 — 코딩 SOTA 갱신, 뭐가 달라졌나
OpenAI의 새 플래그십 Sol과 Terra·Luna 3형제. 바이브 코더 관점으로 핵심만 정리
Grok 4.5 떴다 — 바이브 코더를 위한 3분 정리
Opus급 성능을 더 싸고 빠르게. 7월 8일 공개된 Grok 4.5 핵심 정리와 API 시작법
다른 카테고리
VibeDaily는 매일 한 편씩 바이브 코딩 아티클을 발행합니다.