Valumigo

Artificial Analysis · 知能指数

公開されているベンチマーク資料(LMArenaのユーザー投票順位、Epoch AIのテストスコア、OpenRouterの使用量順位)を定期的に取得して表示します。各ランキングの公開日と取得日を併記します。このサイトが独自に採点したものではありません。

LMArenaのスコアは、2つのモデルの回答を並べて見たユーザーが、よりよい方に投票した結果(Elo方式)です。スコアの差が信頼区間内なら、実質的には同程度と考えましょう。

このランキングの読み方

測定する能力: Artificial Analysisが複数の評価を直接実施し、まとめた総合知能指数です。OpenRouterの公開データAPIを通じて取得しました。

スコアの読み方: 高いほど、複数のテストで全体的に良い結果を出したことを意味します。同じモデルでも、推論設定(Max、Highなど)ごとに個別に表示されます。

注意点: 指数に含まれるテストの構成は、Artificial Analysisがバージョンごとに変更する場合があるため、時期が異なるスコア同士は比較しないでください。

今回のランキングから読み取れること

  • 最高スコアはClaude Opus 5.5 (Max, Default Fallback)の57.6です。
  • 1位と5位の差は4.9です。
  • 上位10モデルのうち、Anthropicのモデルが5モデルで最も多くなっています。

知能指数 Artificial Analysis

公開日 2026-10-05 · 取得日 2026-10-05

AnthropicClaude Opus 5.5 (Max, Default Fallback)
57.6
AnthropicClaude Sonnet 5.5 (Max, Default Fallback)
56.0
AnthropicClaude Fable 5.1 (Max, Default Fallback)
53.4
AlibabaQwen3.8 Max
53.4
OGPT-6 Astra (max)
52.7
OGPT-6.1 Sol (max)
51.8
AnthropicClaude Opus 5 (Max)
50.8
AnthropicClaude Fable 5 (Max, Opus 4.8 Fallback)
49.6
OGPT-6 Sol (Max)
47.6
OGPT-5.6 Sol (Max)
47.0
xGrok 4.7 (Xhigh)
46.4
XiaomiMiMo-V2.6-Pro
46.3
AlibabaQwen3.8 Max (0902)
45.4
ZGLM-5.3 (Max)
44.8
xGrok 4.6 (High)
44.3
Moonshot AIKimi K3 (Max)
43.6
OGPT-5.6 Terra (Max)
42.1
AnthropicClaude Opus 4.8 (Max)
41.8
ZGLM 5.3 Flash
41.8
iLing 3.1 Flash
41.1

グラフには、同じモデルの推論設定(high・maxなど)のうち、スコアが最も高いものだけを表示しています。表には設定ごとの順位をすべて掲載しています。

表で見る(上位60件)
順位モデル開発元スコア
1#1AnthropicClaude Opus 5.5 (Max, Default Fallback)Anthropic57.6
2#2AnthropicClaude Sonnet 5.5 (Max, Default Fallback)Anthropic56
3#3AnthropicClaude Fable 5.1 (Max, Default Fallback)Anthropic53.4
4#4AlibabaQwen3.8 MaxAlibaba53.4
5#5OGPT-6 Astra (max)OpenAI52.7
6#6OGPT-6.1 Sol (max)OpenAI51.8
7#7AnthropicClaude Opus 5 (Max)Anthropic50.8
8#8AnthropicClaude Fable 5 (Max, Opus 4.8 Fallback)Anthropic49.6
9#9OGPT-6 Sol (Max)OpenAI47.6
10#10OGPT-5.6 Sol (Max)OpenAI47
11#11xGrok 4.7 (Xhigh)xAI46.4
12#12XiaomiMiMo-V2.6-ProXiaomi46.3
13#13AlibabaQwen3.8 Max (0902)Alibaba45.4
14#14ZGLM-5.3 (Max)Z.ai44.8
15#15xGrok 4.6 (High)xAI44.3
16#16Moonshot AIKimi K3 (Max)Moonshot AI43.6
17#17OGPT-5.6 Terra (Max)OpenAI42.1
18#18AnthropicClaude Opus 4.8 (Max)Anthropic41.8
19#19ZGLM 5.3 FlashZ.ai41.8
20#20iLing 3.1 FlashinclusionAI41.1
21#21GoogleGemini 3.8 Flash (High)Google40.9
22#22AlibabaQwen3.8 2.4T A95BAlibaba39.9
23#23MetaMuse Spark 1.2 (Xhigh)Meta39.6
24#24DeepSeekDeepSeek V4.1 Flash (Reasoning, Max Effort)DeepSeek39.5
25#25GoogleGemini 3.7 Flash (High)Google39.1
26#26xGrok 4.5 (High)xAI38.8
27#27OGPT-5.5 (Xhigh)OpenAI38.4
28#28AnthropicClaude Sonnet 5 (Max)Anthropic38.2
29#29OGPT-6 Luna (Max)OpenAI38.1
30#30XiaomiMiMo-V2.6-FlashXiaomi37.9
31#31OGPT-5.6 Luna (Max)OpenAI37.3
32#32DeepSeekDeepSeek V4 Pro 0813 (Max)DeepSeek36
33#33DeepSeekDeepSeek V4 Flash 0731 (Max)DeepSeek34.3
34#34GoogleGemini 3.6 Flash (High)Google34
35#35MetaMuse Spark 1.1 (Xhigh)Meta33.7
36#36ZGLM-5.2 (Max)Z.ai33.7
37#37AlibabaQwen3.8 27B (Xhigh)Alibaba33.7
38#38GoogleGemini 3.5 Flash (High)Google32.6
39#39DeepSeekDeepSeek V4 Pro 0424 (Max)DeepSeek30.4
40#40AnthropicClaude Sonnet 4.6 (Max)Anthropic30.1
41#41GoogleGemini 3.1 Pro PreviewGoogle29.7
42#42AlibabaQwen3.7 MaxAlibaba29.5
43#43MiniMaxMiniMax-M3MiniMax29.2
44#44Moonshot AIKimi K2.6 (Reasoning)Moonshot AI27
45#45ZGLM-5.1 (Reasoning)Z.ai26.1
46#46XiaomiMiMo-V2.5-Pro (Reasoning)Xiaomi26
47#47Moonshot AIKimi K2.7 CodeMoonshot AI25.8
48#48TInkling SmallThinkingmachines25.7
49#49THy3Tencent25.3
50#50AlibabaQwen3.7 PlusAlibaba25.2
51#51TInkling (Xhigh)Thinkingmachines25
52#52xGrok 4.3 (High)xAI24.9
53#53iLing-3.0-flash-VLinclusionAI24.6
54#54DeepSeekDeepSeek V4 Flash 0420 (High)DeepSeek24.4
55#55OGPT-5.4 mini (Xhigh)OpenAI24.1
56#56USolar Mini 4Upstage24.1
57#57NVIDIANemotron 3 Ultra 550B A55B (Reasoning)NVIDIA22.9
58#58MiniMaxMiniMax-M2.7MiniMax22.8
59#59iLing-3.0-flash-FininclusionAI22.6
60#60GoogleGemini 3.5 Flash-LiteGoogle22.2

Source: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0.

データ: LMArena leaderboard dataset(CC BY 4.0)。変更: 各ランキングは上位50件のみ表示。スコアは四捨五入。 https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset企業ロゴは各社の商標であり、識別のためにのみ使用しています(アイコン:Simple Icons)。データ:Epoch AI — Capabilities & benchmarking(CC BY 4.0)。 https://epoch.ai/benchmarksSource: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Source: OpenRouter evals (openrouter.ai) via OpenRouter (openrouter.ai/rankings). Source: Design Arena (www.designarena.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0. Source: OpenRouter (openrouter.ai/rankings), as of 2026-10-05. Licensed under CC BY 4.0. https://openrouter.ai/rankings