글로벌 3위 도약, ‘키미 K3’ 문샷, 2.8조 매개변수 공개

문샷 AI가 초거대 신모델 공개

중국 AI 기업 문샷이 약 2조 8천억 개 매개변수를 갖춘 최상위 모델 ‘키미 K3’를 공식 출시했습니다. 이 모델은 세계 인공지능 성능 평가에서 세계 3위를 기록하며 화제가 되고 있습니다.

성능 평가 결과

주요 벤치마크 테스트에서 미국 안트로픽의 ‘클로드 페이블 5’와 오픈AI의 ‘GPT-5.6 솔’보다 약간 뒤처졌지만, ‘클로드 오퍼스 4.8’이나 ‘GPT-5.5’ 같은 모델들은 앞섰습니다. 지능 지수 평가에서 57점을 받아 페이블 5(60점), GPT-5.6 솔(59점)에 이어 3위를 차지했으며, 이전 모델 ‘키미 K2.6’의 44점보다 무려 13점이나 상승한 수치입니다.

이는 중국 모델 사상 최고 기록으로, 미국 중심의 글로벌 AI 경쟁 구도에 변화를 가져올 것으로 전망됩니다.

코딩과 자율 작업 능력

이 모델은 코딩과 에이전트 기능에서도 두각을 나타냈습니다. 사람 개입을 최소화한 테스트 환경에서 24시간 동안 GPU 커널 최적화 시험을 진행해 페이블 5와 대등한 성과를 거뒀습니다. 또한 3차원 오픈월드 게임과 칩 설계 같은 복잡한 엔지니어링 과제도 스스로 해결하는 능력을 보여줬습니다.

다양한 업종별 벤치마크 성과

실제 업무 능력을 측정하는 44개 직종 평가에서는 1687점으로 페이블 5, GPT-5.6 솔에 이어 3위, 클로드 오퍼스 4.8보다는 앞섰습니다. 장기 지식 작업 평가에서는 페이블 5에 이어 2위를 기록했습니다. 정보 검색 시험에서는 역대 최고 점수를 받았고, 프론트엔드 코드 분야 평가에서도 페이블 5를 제치고 1위에 올랐습니다.

기술적 특징

2조 8천억 개 매개변수는 중국 모델은 물론 전 세계 오픈소스 모델 가운데 가장 큰 규모입니다. 100만 토큰 분량의 문맥을 한 번에 처리할 수 있고, 이미지와 텍스트를 함께 다루는 기능도 기본으로 지원합니다. 896개 전문가 모듈 중 16개만 작동시키는 방식의 ‘스테이블 레이턴트MoE’ 기술을 적용해, 이전 세대 대비 전체 학습 효율을 2.5배 높였습니다.

자체 개발한 ‘키미 델타 어텐션’과 ‘어텐션 레지듀얼’ 기술 덕분에 100만 토큰 문맥에서 최대 6.3배 빠른 응답이 가능하며, 학습 효율도 25% 향상됐다고 회사 측은 설명했습니다.

가격 정책

API 이용 가격은 입력 기준 100만 토큰당 약 3달러, 출력 기준 15달러로 책정됐습니다. 중국 모델치고는 비교적 높은 수준이지만 미국 중간급 모델과 비슷한 가격이라 성능 대비 합리적이라는 평가입니다. 작업당 비용은 약 0.94달러로, GPT-5.6 솔과 비슷하고 클로드 오퍼스 4.8의 절반 정도입니다. 이전 K2.6 모델보다 출력량을 21% 줄이면서도 성능은 더 높아졌습니다.

업계 반응과 전망

전문가들은 이번 출시를 ‘오픈소스 AI의 중요한 전환점’으로 평가했습니다. 이제 오픈소스가 미국 폐쇄형 모델보다 6개월 뒤처지지 않았다는 의견이 나왔습니다. K3의 내부 설정값이 공개되면, 일반 기업들도 최고 수준 성능의 거대 모델을 직접 만들거나 맞춤 조정할 수 있게 돼, 오픈AI와 앤트로픽 양대산맥에 상당한 위협이 될 것으로 분석됩니다.