Valumigo

LMArena · 創作

公開されているベンチマーク資料(LMArenaのユーザー投票順位、Epoch AIのテストスコア、OpenRouterの使用量順位)を定期的に取得して表示します。各ランキングの公開日と取得日を併記します。このサイトが独自に採点したものではありません。

LMArenaのスコアは、2つのモデルの回答を並べて見たユーザーが、よりよい方に投票した結果(Elo方式)です。スコアの差が信頼区間内なら、実質的には同程度と考えましょう。

このランキングの読み方

測定する能力: LMArenaのテキスト会話のうち、小説・詩・コピーなどの創作文章の質問に分類された投票を使ったランキングです。

スコアの読み方: 創作文章の質問で、ユーザーがより好んだ回答の相対ランキングです。面白さや文体を個別に客観評価したスコアではありません。

注意点: 自分の用途や文体の好みに合うかは、同じ依頼で直接比較して確認してください。

今回のランキングから読み取れること

  • 1位のgemini-4-argon-highと2位のclaude-opus-5.5-highの95%信頼区間は重なっています。この集計だけで2つのモデルの順位を確定するのは困難です。
  • 1位と信頼区間が重なるモデルが、ほかに4件あります。小さな順位差は、投票数も踏まえて慎重に解釈してください。
  • 上位10モデルのうち、Anthropicのモデルが6モデルで最も多くなっています。
  • 1位のモデルが獲得した投票は1,097票で、このランキングには411件のモデルがあります。

創作 LMArena

公開日 2026-10-02 · 取得日 2026-10-04

14401470150015301560
Googlegemini-4-argon-high
1519
Anthropicclaude-opus-5.5-high
1516
Anthropicclaude-fable-5-high
1503
Anthropicclaude-opus-4-6-high
1501
Googlegemini-3.7-flash-high
1493
Anthropicclaude-opus-4-7-high
1489
Googlegemini-3.8-flash-high
1485
Googlegemini-3-pro
1484
Anthropicclaude-fable-5.1-max
1482
Googlegemini-3.1-pro-preview
1480
Anthropicclaude-opus-5-high
1471
Googlegemini-3.6-flash-high
1471
Anthropicclaude-opus-4-5-20251101-high-32k
1470
Anthropicclaude-opus-4-8-high
1470
Googlegemini-3.5-flash-medium
1469
Ogpt-5.6-sol-xhigh
1468
Alibabaqwen3.8-max
1468
Metamuse-spark
1465
xgrok-4.20-beta1
1463
Anthropicclaude-opus-4-5-20251101
1462

点はスコア、横線は95%信頼区間です。線が重なる場合、実質的に同程度です。 グラフには、同じモデルの推論設定(high・maxなど)のうち、スコアが最も高いものだけを表示しています。表には設定ごとの順位をすべて掲載しています。 会話・ビジョンのランキングは、LMArenaサイトのデフォルトと同じ「口調・長さ補正(style control)」ランキングです。

企業別の最高順位

  • GoogleGooglegemini-4-argon-high#1
  • AnthropicAnthropicclaude-opus-5.5-high#2
  • OOpenAIgpt-5.6-sol-xhigh#19
  • AlibabaAlibabaqwen3.8-max#20
  • MetaMetamuse-spark#21
  • xxAIgrok-4.20-beta1#24
  • Moonshot AIMoonshot AIkimi-k3-max#26
  • ZZ.aiglm-5.2-max#32
  • XiaomiXiaomimimo-v2.6-pro#47
表で見る(上位50件)
順位モデル開発元スコア95%信頼区間投票数
1#1Googlegemini-4-argon-highGoogle15191499–15381,097
2#2Anthropicclaude-opus-5.5-highAnthropic15161497–15361,058
3#3Anthropicclaude-fable-5-highAnthropic15031495–15108,182
4#4Anthropicclaude-opus-4-6-highAnthropic15011494–150714,085
5#5Googlegemini-3.7-flash-highGoogle14931484–15034,776
6#6Anthropicclaude-opus-4-7-highAnthropic14891482–149611,812
7#7Googlegemini-3.8-flash-highGoogle14851476–14945,697
8#8Googlegemini-3-proGoogle14841476–14936,510
9#9Anthropicclaude-opus-4-7Anthropic14831476–149012,043
10#10Anthropicclaude-fable-5.1-maxAnthropic14821469–14942,645
11#11Googlegemini-3.1-pro-previewGoogle14801475–148622,309
12#12Anthropicclaude-opus-4-6Anthropic14791473–148514,240
13#13Anthropicclaude-opus-5-highAnthropic14711465–147813,263
14#14Googlegemini-3.6-flash-highGoogle14711463–14797,580
15#15Anthropicclaude-opus-5-maxAnthropic14711462–14796,526
16#16Anthropicclaude-opus-4-5-20251101-high-32kAnthropic14701461–14785,676
17#17Anthropicclaude-opus-4-8-highAnthropic14701463–147612,798
18#18Googlegemini-3.5-flash-mediumGoogle14691461–14769,445
19#19Ogpt-5.6-sol-xhighOpenAI14681460–14767,537
20#20Alibabaqwen3.8-maxAlibaba14681458–14784,555
21#21Metamuse-sparkMeta14651452–14792,040
22#22Googlegemini-3.5-flash-highGoogle14641457–14719,476
23#23Anthropicclaude-opus-4-8Anthropic14631457–147012,836
24#24xgrok-4.20-beta1xAI14631453–14734,158
25#25Anthropicclaude-opus-4-5-20251101Anthropic14621456–146811,392
26#26Moonshot AIkimi-k3-maxMoonshot AI14601451–14695,694
27#27Ogpt-6.1-sol-maxOpenAI14601436–1483686
28#28Metamuse-spark-1.3-maxMeta14591446–14712,631
29#29Googlegemini-3-flashGoogle14571448–14664,814
30#30Ogpt-5.5-instantOpenAI14561447–14664,346
31#31Metamuse-spark-1.2 (xHigh)Meta14551435–1476852
32#32Zglm-5.2-maxZ.ai14541447–14628,979
33#33Anthropicclaude-sonnet-4-5-20250929Anthropic14541448–146012,367
34#34Zglm-5.3-maxZ.ai14541444–14644,034
35#35Ogpt-5.5-highOpenAI14511445–145813,120
36#36xgrok-4.5xAI14501443–14588,291
37#37Anthropicclaude-sonnet-4-5-20250929-high-32kAnthropic14501444–145612,644
38#38Anthropicclaude-sonnet-4-6Anthropic14491443–145612,339
39#39Ogpt-6-astra-maxOpenAI14491435–14632,029
40#40Zglm-5Z.ai14491440–14584,837
41#41Ogpt-5.5OpenAI14481442–145513,354
42#42Anthropicclaude-sonnet-5.5-xhighAnthropic14471424–1471658
43#43Metamuse-spark-1.1Meta14471439–14557,706
44#44xgrok-4.20-multi-agent-beta-0309xAI14471440–145411,279
45#45Googlegemini-3-flash (thinking-minimal)Google14471441–145315,198
46#46Zglm-5.1Z.ai14461440–145311,254
47#47Xiaomimimo-v2.6-proXiaomi14461425–1467788
48#48DeepSeekdeepseek-v4-proDeepSeek14461439–14539,721
49#49Anthropicclaude-opus-4-1-20250805-thinking-16kAnthropic14461438–14536,815
50#50xgrok-4.20-beta-0309-reasoningxAI14451439–145211,425

データ: LMArena leaderboard dataset(CC BY 4.0)。変更: 各ランキングは上位50件のみ表示。スコアは四捨五入。 https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset企業ロゴは各社の商標であり、識別のためにのみ使用しています(アイコン:Simple Icons)。データ:Epoch AI — Capabilities & benchmarking(CC BY 4.0)。 https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings