Moonshot AI, 2.8조 파라미터 Kimi K3 공개, '펠리컨 테스트' 결과는?

Kimi K3, and what we can still learn from the pelican benchmark

Moonshot AI, 2.8조 파라미터 Kimi K3 공개, '펠리컨 테스트' 결과는?

중국 AI 연구소 Moonshot AI가 2.8조 파라미터의 대형 언어 모델 Kimi K3를 발표했습니다. 이 모델은 현재 웹사이트와 API를 통해 이용 가능하며, 7월 27일까지 오픈 가중치로 공개될 예정입니다. 자체 벤치마크에서 대부분의 작업에서 Claude Opus 4.8과 GPT-5.5를 능가하지만, Claude Fable 5와 GPT-5.6 Sol에는 미치지 못합니다. 특히 Kimi K3는 중국 AI 연구소가 출시한 모델 중 가장 비싼 가격($3/백만 입력 토큰, $15/백만 출력 토큰)으로 주목받고 있습니다. Simon Willison은 OpenRouter를 통해 Kimi K3를 테스트하고, '자전거를 타는 펠리컨 SVG 생성' 프롬프트를 실행하여 모델의 추론 능력, 비전 능력, 비용 등을 분석했습니다. 그는 이 테스트가 모델 비교에 완벽하지 않지만, 모델을 빠르게 파악하고 비용과 추론 토큰 사용량을 가늠하는 데 유용하다고 말합니다.

Kimi K3의 펠리컨 생성에는 입력 토큰 95개, 출력 토큰 16,658개(추론 토큰 13,241개 포함)가 사용되어 총 25센트가 들었습니다.

이 날의 다른 글

2026-07-17