🏆 AI 모델 벤치마크 순위

주요 AI 모델의 순위를 두 관점으로 보여줍니다 — 실사용자 선호(Arena Elo)와 실제 능력(LiveBench 종합점수). 매일 자동 갱신됩니다.

기준일: Jul 19, 2026

실제 사용자가 두 모델의 답변을 블라인드로 비교 투표해 산출한 Elo 순위입니다. 말투·서식 선호가 반영되며, 능력 정답률과는 다를 수 있습니다.

순위모델제작사점수(ELO)
🥇claude-fable-5Anthropic1,507
🥈claude-opus-4-6-thinkingAnthropic1,504
🥉claude-opus-4-7-thinkingAnthropic1,502
4claude-opus-4-6Anthropic1,498
5muse-spark-1.1Meta1,495
6claude-opus-4-7Anthropic1,494
7muse-sparkMeta1,487
8kimi-k3Moonshot1,487
9gpt-5.6-sol-xhighOpenAI1,486
10gemini-3-proGoogle1,486
11gemini-3.1-pro-previewGoogle1,486
12claude-opus-4-8-thinkingAnthropic1,485
13gpt-5.5-highOpenAI1,481
14gpt-5.4-highOpenAI1,478
15gemini-3.5-flash-highGoogle1,476
16gpt-5.2-chat-latest-20260210OpenAI1,476
17gpt-5.5OpenAI1,476
18qwen3.7-max-previewAlibaba1,475
19gemini-3.5-flash-mediumGoogle1,475
20claude-opus-4-8Anthropic1,474

데이터 출처: Arena (구 LMArena) 리더보드. 점수는 사용자 블라인드 비교 투표 기반 Elo이며, 순위는 수시로 변동됩니다.