클로드 파블 5, AI 코딩 순위 2위로 하락

요약:중국 문샷 AI의 키미-K3가 아레나 프론트엔드 코드 순위에서 1,679점으로 클로드 페이블 5(1,631점)를 제치고 1위에 올랐습니다. 18위에서 단번에 도약한 이 모델은 7개 코딩 영역 중 6개에서 1위를 차지했고, 페이블 5는 게이밍 부문만 지켰습니다. 키미-K3는 가격도 경쟁사보다 저렴하며(입력 100만 토큰당 3달러, 출력 15달러), 문샷은 7월 27일까지 전체 가중치를 공개할 예정입니다.

클로드 페이블 5가 왕좌를 내주었습니다. 중국의 문샷 에이아이(Moonshot AI)에서 개발한 새로운 모델 키미-K3가 최근 아레나(Arena)의 순위에서 최고의 웹사이트 코드 작성 모델로 등극했습니다. 키미-K3는 1,679점을 획득했고, 페이블 5는 1,631점을 기록했습니다.

아레나는 AI 모델 순위를 매우 단순하게 매깁니다. 사람들은 두 개의 숨겨진 모델에 동일한 작업을 부여하고, 더 나은 결과에 투표합니다. 웹 코딩 순위판만 놓고 보아도 96개 모델에 걸쳐 약 47만 표가 집계되었습니다.

키미-K3가 클로드 페이블 5를 어떻게 이겼는가

이 승리는 예고 없이 나타났습니다. 문샷의 이전 모델 키미-K2.6은 18위에 머물렀습니다. 새 모델은 단번에 1위로 올라섰습니다.

후원

This is a 17-place jump from Kimi-k2.6 (#18 -> #1).

48점 차이는 간발의 승부가 아닙니다. 페이블 5는 3위 GPT-5.6(OpenAI)보다 불과 13점 앞서 있습니다. 키미-K3는 마케팅 페이지, 데이터 대시보드, 소비자 앱 등 7개 코딩 부문 중 6개에서 1위를 차지했습니다. 클로드 페이블 5는 ‘게이밍’ 부문에서만 1위를 지켰습니다.

아레나 프론트엔드 코드 순위표에서 키미-K3가 클로드 페이블 5를 앞서 있는 모습입니다. 출처: Arena.ai

앤트로픽(Anthropic)은 여전히 20위 내에 9개 모델을 올려놓으며 저변을 넓게 차지하고 있습니다. 그러나 이번 시점은 앤트로픽에게도 뼈아픕니다. 며칠 전 일론 머스크는 “앤트로픽이 업계의 선두주자”라고 평가했습니다. 순위는 논쟁을 일으키기도 합니다. 과거 클로드 관련 AI 벤치마크 논란이 그 예입니다.

마크 저커버그의 뮤즈 스파크 1.1도 출시 후 며칠 만에 11위에 올랐습니다.

단순 순위 이상의 의미

더 큰 맥락이 있습니다. 키미-K3는 경쟁 모델보다 가격이 저렴합니다. 문샷은 공식 문서에서 입력 100만 토큰당 3달러, 출력은 15달러로 책정했습니다. 한편 아레나는 페이블 5의 가격을 각각 10달러, 50달러로 안내합니다.

문샷은 키미-K3의 전체 모델 가중치를 7월 27일까지 공개하겠다고 밝혔습니다. 누구나 이 최고 코딩 모델을 무료로 사용할 수 있게 됩니다. 이는 중국 모델들이 월간 토큰 사용량 측면에서 미국 경쟁사를 앞서는 변화와 맞물리고 있습니다.

경쟁 구도는 상호적입니다. 알리바바는 보안상의 이유로 7월 10일부터 클로드 코드 사용을 중단하라고 직원들에게 통보했습니다.

향후 몇 주 동안 더 많은 투표가 이뤄지면서 키미-K3가 1위를 유지할지 확인할 수 있을 것입니다.

면책 성명

본 기사의 견해는 저자의 개인적 견해일 뿐이며 본 플랫폼은 투자 권고를 하지 않습니다. 본 플랫폼은 기사 내 정보의 정확성, 완전성, 적시성을 보장하지 않으며, 개인의 기사 내 정보에 의한 손실에 대해 책임을 지지 않습니다.
전편

애플, 세계 최고 기업 등극…왕좌 유지하나?

다음

존 디튼, XRP 보유자 4000명 리플 SEC 승소 도움 밝혔다