중국 문샷AI가 2조8000억 파라미터 규모의 Kimi K3를 공개하고 Kimi.com과 Kimi Work, Kimi Code, API에서 서비스를 시작했다. 모델은 네이티브 비전 기능과 최대 100만 토큰 문맥을 지원한다. 다만 7월 20일 현재 서비스 출시와 가중치 공개는 구분해야 한다. 문샷은 전체 모델 가중치를 7월 27일까지 내놓겠다고 밝혔으므로, 현시점의 정확한 표현은 ‘오픈웨이트 공개 예정 모델’이다.
K3는 896개 전문가 가운데 16개를 선택적으로 활성화하는 희소 혼합전문가 구조를 쓴다. 문샷은 Kimi Delta Attention과 Attention Residuals, Stable LatentMoE를 결합해 Kimi K2보다 전체 스케일링 효율을 약 2.5배 높였다고 설명했다. API 가격은 캐시 미적중 입력 100만 토큰당 3달러, 출력 15달러이며 캐시 적중 입력은 0.3달러다.

문샷이 공개한 코딩·에이전트 평가에서는 K3가 여러 항목에서 기존 오픈 모델을 앞섰고 일부 시험에서는 폐쇄형 최상위 모델과 경쟁했다. 그러나 모든 수치를 같은 조건의 정면 대결로 읽어서는 안 된다. K3는 최대 추론 강도로 평가됐고, 모델에 따라 KimiCode와 Claude Code, Codex 등 서로 다른 실행 하네스를 사용했다. 일부 경쟁 모델 점수는 외부 리더보드와 각 회사 발표에서 인용됐다.
SWE Marathon도 공식 과제를 그대로 쓴 것이 아니라 H20 GPU에 맞춰 성능 기준과 참조 결과를 재조정했다. 이 평가에서 Claude Fable 5는 작업의 35%에서 fallback이 발생해 결과가 불리해졌을 가능성이 있다. Terminal-Bench 2.1 역시 K3에는 KimiCode를 적용한 반면 경쟁 모델에는 각기 가장 높은 하네스 점수를 사용했다. 개별 점수만으로 모델 전체의 절대 우위를 선언하기 어려운 이유다.
문샷도 K3의 종합 성능이 Claude Fable 5와 GPT-5.6 Sol에는 아직 미치지 못한다고 명시했다. 현재 확인할 수 있는 의미는 중국 업체가 초대형 멀티모달 모델을 실제 서비스로 내놓고 가중치 공개 일정까지 제시했다는 데 있다. 오픈웨이트 여부와 독립 성능 평가는 7월 27일 가중치와 기술 보고서가 공개된 뒤 다시 확인해야 한다.
저작권자 © STORIUM 무단전재 및 재배포 금지














