Valumigo

Artificial Analysis · 지능 지수

공개된 벤치마크 자료(LMArena 사용자 투표 순위, Epoch AI 시험 점수, OpenRouter 사용량 순위)를 정기적으로 받아 보여 줍니다. 각 순위표의 공개일과 가져온 날을 함께 표시합니다. 이 사이트가 직접 매긴 점수가 아닙니다.

LMArena 점수는 사람들이 두 모델의 답을 나란히 보고 더 나은 쪽에 투표한 결과(Elo 방식)입니다. 점수 차이가 신뢰 구간 안이면 사실상 비슷한 수준으로 보세요.

이 순위표 읽는 법

무엇을 재나: Artificial Analysis가 여러 평가를 직접 실행해 하나로 묶은 종합 지능 지수입니다. OpenRouter 공개 데이터 API를 통해 받았습니다.

점수 읽는 법: 높을수록 여러 시험에서 고르게 좋은 결과를 냈다는 뜻입니다. 같은 모델도 추론 설정(Max, High 등)에 따라 따로 표시됩니다.

주의할 점: 지수에 포함된 시험 구성은 Artificial Analysis가 버전마다 바꿀 수 있어, 시기가 다른 점수끼리는 비교하지 마세요.

이번 순위에서 읽을 점

  • 최고 점수는 Claude Opus 5.5 (Max, Default Fallback)의 57.6입니다.
  • 1위와 5위의 차이는 4.9입니다.
  • 상위 10개 중 Anthropic 모델이 5개로 가장 많습니다.

지능 지수 Artificial Analysis

공개일 2026-10-05 · 가져온 날 2026-10-05

AnthropicClaude Opus 5.5 (Max, Default Fallback)
57.6
AnthropicClaude Sonnet 5.5 (Max, Default Fallback)
56.0
AnthropicClaude Fable 5.1 (Max, Default Fallback)
53.4
AlibabaQwen3.8 Max
53.4
OGPT-6 Astra (max)
52.7
OGPT-6.1 Sol (max)
51.8
AnthropicClaude Opus 5 (Max)
50.8
AnthropicClaude Fable 5 (Max, Opus 4.8 Fallback)
49.6
OGPT-6 Sol (Max)
47.6
OGPT-5.6 Sol (Max)
47.0
xGrok 4.7 (Xhigh)
46.4
XiaomiMiMo-V2.6-Pro
46.3
AlibabaQwen3.8 Max (0902)
45.4
ZGLM-5.3 (Max)
44.8
xGrok 4.6 (High)
44.3
Moonshot AIKimi K3 (Max)
43.6
OGPT-5.6 Terra (Max)
42.1
AnthropicClaude Opus 4.8 (Max)
41.8
ZGLM 5.3 Flash
41.8
iLing 3.1 Flash
41.1

그래프에는 같은 모델의 추론 설정(high·max 등) 중 가장 높은 하나만 표시합니다. 표에는 설정별 순위가 모두 나옵니다.

표로 보기 (상위 60개)
순위모델만든 곳점수
1#1AnthropicClaude Opus 5.5 (Max, Default Fallback)Anthropic57.6
2#2AnthropicClaude Sonnet 5.5 (Max, Default Fallback)Anthropic56
3#3AnthropicClaude Fable 5.1 (Max, Default Fallback)Anthropic53.4
4#4AlibabaQwen3.8 MaxAlibaba53.4
5#5OGPT-6 Astra (max)OpenAI52.7
6#6OGPT-6.1 Sol (max)OpenAI51.8
7#7AnthropicClaude Opus 5 (Max)Anthropic50.8
8#8AnthropicClaude Fable 5 (Max, Opus 4.8 Fallback)Anthropic49.6
9#9OGPT-6 Sol (Max)OpenAI47.6
10#10OGPT-5.6 Sol (Max)OpenAI47
11#11xGrok 4.7 (Xhigh)xAI46.4
12#12XiaomiMiMo-V2.6-ProXiaomi46.3
13#13AlibabaQwen3.8 Max (0902)Alibaba45.4
14#14ZGLM-5.3 (Max)Z.ai44.8
15#15xGrok 4.6 (High)xAI44.3
16#16Moonshot AIKimi K3 (Max)Moonshot AI43.6
17#17OGPT-5.6 Terra (Max)OpenAI42.1
18#18AnthropicClaude Opus 4.8 (Max)Anthropic41.8
19#19ZGLM 5.3 FlashZ.ai41.8
20#20iLing 3.1 FlashinclusionAI41.1
21#21GoogleGemini 3.8 Flash (High)Google40.9
22#22AlibabaQwen3.8 2.4T A95BAlibaba39.9
23#23MetaMuse Spark 1.2 (Xhigh)Meta39.6
24#24DeepSeekDeepSeek V4.1 Flash (Reasoning, Max Effort)DeepSeek39.5
25#25GoogleGemini 3.7 Flash (High)Google39.1
26#26xGrok 4.5 (High)xAI38.8
27#27OGPT-5.5 (Xhigh)OpenAI38.4
28#28AnthropicClaude Sonnet 5 (Max)Anthropic38.2
29#29OGPT-6 Luna (Max)OpenAI38.1
30#30XiaomiMiMo-V2.6-FlashXiaomi37.9
31#31OGPT-5.6 Luna (Max)OpenAI37.3
32#32DeepSeekDeepSeek V4 Pro 0813 (Max)DeepSeek36
33#33DeepSeekDeepSeek V4 Flash 0731 (Max)DeepSeek34.3
34#34GoogleGemini 3.6 Flash (High)Google34
35#35MetaMuse Spark 1.1 (Xhigh)Meta33.7
36#36ZGLM-5.2 (Max)Z.ai33.7
37#37AlibabaQwen3.8 27B (Xhigh)Alibaba33.7
38#38GoogleGemini 3.5 Flash (High)Google32.6
39#39DeepSeekDeepSeek V4 Pro 0424 (Max)DeepSeek30.4
40#40AnthropicClaude Sonnet 4.6 (Max)Anthropic30.1
41#41GoogleGemini 3.1 Pro PreviewGoogle29.7
42#42AlibabaQwen3.7 MaxAlibaba29.5
43#43MiniMaxMiniMax-M3MiniMax29.2
44#44Moonshot AIKimi K2.6 (Reasoning)Moonshot AI27
45#45ZGLM-5.1 (Reasoning)Z.ai26.1
46#46XiaomiMiMo-V2.5-Pro (Reasoning)Xiaomi26
47#47Moonshot AIKimi K2.7 CodeMoonshot AI25.8
48#48TInkling SmallThinkingmachines25.7
49#49THy3Tencent25.3
50#50AlibabaQwen3.7 PlusAlibaba25.2
51#51TInkling (Xhigh)Thinkingmachines25
52#52xGrok 4.3 (High)xAI24.9
53#53iLing-3.0-flash-VLinclusionAI24.6
54#54DeepSeekDeepSeek V4 Flash 0420 (High)DeepSeek24.4
55#55OGPT-5.4 mini (Xhigh)OpenAI24.1
56#56USolar Mini 4Upstage24.1
57#57NVIDIANemotron 3 Ultra 550B A55B (Reasoning)NVIDIA22.9
58#58MiniMaxMiniMax-M2.7MiniMax22.8
59#59iLing-3.0-flash-FininclusionAI22.6
60#60GoogleGemini 3.5 Flash-LiteGoogle22.2

Source: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0.

데이터: LMArena leaderboard dataset (CC BY 4.0). 변경: 각 순위표의 상위 50개만 표시, 점수는 반올림. https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset회사 로고는 각 회사의 상표이며 구분을 돕기 위해서만 씁니다(아이콘: Simple Icons).데이터: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Source: OpenRouter evals (openrouter.ai) via OpenRouter (openrouter.ai/rankings). Source: Design Arena (www.designarena.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0. Source: OpenRouter (openrouter.ai/rankings), as of 2026-10-05. Licensed under CC BY 4.0. https://openrouter.ai/rankings