Kimi K3 — 역대 최대 오픈 모델이 프론트엔드 코딩 1위
오픈 모델이 특정 벤치에서 1위를 찍었어요 🇨🇳
지난 7월 16일, Moonshot AI가 Kimi K3를 공개했습니다. 지난주 Copilot에 들어간 Kimi K2.7의 후속인데, 규모가 껑충 뛰었어요 — 2.8조(2.8T) 파라미터로, 지금까지 나온 오픈 모델 중 최대입니다. 참고로 Moonshot AI는 중국 베이징 회사예요. 미국의 대중국 반도체 규제 속에서 나온 대형 오픈 모델이라 업계에서 더 주목받았습니다.
확인된 사실
- 프론트엔드 코딩 벤치 1위 — LMArena의 Frontend Code Arena에서 1,679점으로 Claude Fable 5를 제치고 1위. 개발자 블라인드 테스트라 "실전 코딩 체감"에 가까운 지표예요
- 단, 전체 실력은 아직 — 종합 성능은 여전히 Fable 5·GPT-5.6 Sol 같은 최상위 상용 모델에 뒤집니다. "프론트엔드에서 강하다"이지 "제일 세다"가 아니에요
- 구조 — Kimi Delta Attention(KDA)이라는 하이브리드 어텐션 + 1M 토큰 컨텍스트, 896개 전문가 중 16개만 활성화하는 방식
- 웨이트 공개 예정 — 7월 27일까지 오픈웨이트 배포 약속. 풀리면 자체 서버에서도 돌릴 수 있어요
뭘 잘하고, 뭐가 아직인가
| 강점 💪 | 아직 약한 곳 ⚠️ |
|---|---|
| 프론트엔드·UI 코딩 (블라인드 벤치 1위) | 종합 성능은 Fable 5·GPT-5.6 Sol에 뒤짐 |
| 출력 가격 — 플래그십의 약 1/3 | 복잡한 백엔드·추론은 상용이 우위 |
| 1M 토큰 초장문 컨텍스트 | 특정 벤치 1위 ≠ 모든 작업 1위 |
| 이미지 입력(비주얼) 네이티브 지원 | 상용 대비 검증된 실사용 사례는 아직 적음 |
| 7/27 오픈웨이트 예정 — 자체 실행 가능 |
정리하면 — "UI·프론트엔드는 싸고 강하게, 어려운 건 플래그십" 조합에 딱 맞는 모델이에요.
진짜 포인트는 '가격'
오픈 모델의 무기는 언제나 가격입니다. 상용 플래그십과 나란히 놓으면:
출력 100만 토큰당 공식 단가 — Kimi K3 입력은 캐시히트 $0.30 / 캐시미스 $3. 출처: 각 사 공식 가격표, 2026.07
출력 기준 Fable 5의 약 1/3 가격에 프론트엔드 벤치 1위를 낸다는 게 K3의 셀링포인트예요. "최고 성능이 필요 없는 UI 작업엔 K3, 어려운 문제엔 플래그십" 같은 티어 나누기 전략에 새 선택지가 하나 생긴 셈입니다.
유료인가요?
공짜로 맛볼 수 있어요. kimi.com 웹 채팅에서 신용카드 없이, 사용량 제한 안에서 무료로 돌려볼 수 있습니다. 더 많이 쓰려면 유료예요:
- 구독 — 무료 티어 위로 월 $19–$199 (사용량·에이전트 크레딧 차등)
- API — 입력 $3 / 출력 $15 (100만 토큰, 캐시 시 입력 $0.30)
- 7/27 이후 — 오픈웨이트가 풀리면 자체 서버·로컬에서 무료 실행 가능 (하드웨어만 있으면)
일단 성능만 확인하려면 kimi.com 무료로 충분합니다.
써보려면
지금은 Moonshot API로 바로 호출할 수 있어요 (OpenAI 호환):
# OpenAI 공식 라이브러리 재사용
from openai import OpenAI
# 접속 주소만 Moonshot으로 바꾸면 됨
client = OpenAI(
# ← 이 줄이 핵심
base_url="https://api.moonshot.ai/v1",
api_key="MOONSHOT_API_KEY",
)
res = client.chat.completions.create(
# 모델 이름만 지정
model="kimi-k3",
messages=[{"role": "user", "content": "반응형 가격표 UI 컴포넌트 만들어줘"}],
)
print(res.choices[0].message.content)7월 27일 웨이트가 풀리면 로컬/자체 서버 실행 이야기도 다뤄볼게요.
🇰🇷 그럼 한국 모델은?
솔직히 말하면, K3가 1위를 찍은 이 프론트엔드 코드 아레나 상위권은 미국·중국 모델이 거의 독식하고 있어요. 한국 모델은 아직 이 최상위 리더보드에 이름을 올리진 못했습니다. 대신 한국도 자체 프론티어 모델을 키우고 있어요:
| 모델 | 만든 곳 | 특징 |
|---|---|---|
| EXAONE 4.0 | LG AI연구원 | 오픈웨이트 공개, 글로벌 벤치서 한국 모델 상위권 |
| HyperCLOVA X | 네이버클라우드 | 한국어·한국 지식 특화 |
| Solar Pro 2 | 업스테이지 | "한국 첫 프론티어급"으로 주목받은 모델 |
2.8조 파라미터로 밀어붙인 K3와 규모로 맞붙기보다, 한국어 처리·효율·특화 영역에서 승부하는 포지션이에요. 국산 모델 써보신 분 있으면 후기도 궁금합니다!
여러분은 오픈 모델, 실제로 써보시나요? K3 프론트엔드 결과가 궁금하면 방에 한 줄 남겨주세요 🇨🇳⚡
참고: Tom's Hardware — Fable 5 제친 오픈 모델 · MarkTechPost — 아키텍처 · Simon Willison