Valumigo

LMArena · 韩语

定期获取并展示公开的基准测试资料(LMArena 用户投票排名、Epoch AI 测试分数、OpenRouter 使用量排名)。每个榜单均标注数据发布日期和获取日期。这些分数并非本站自行评定。

LMArena 分数来自用户并排查看两个模型的回答,再投票选出更好的一方(Elo 方式)。如果分数差异在置信区间内,可视为水平基本相近。

如何解读此排行榜

衡量什么: 根据 LMArena 文本对话中被归类为 韩语 的问题所获投票计算的排名。

如何解读分数: 显示投票者在 韩语 问题中更偏好的模型。问题的语言并不代表投票者的母语或身份。

注意事项: 投票数量和置信区间宽度因语言和模型而异。对于新模型,请同时查看投票数量、更新日期及汇总条件。

本次排名的解读要点

  • 第 1 名 claude-fable-5.1-max 与第 2 名 muse-spark-1.3-max 的 95% 置信区间重叠。仅凭本次统计难以确定两个模型的先后顺序。
  • 还有 24 个模型的置信区间与第 1 名重叠。解读细微排名差异时,请结合投票数量保持谨慎。
  • 前 10 个模型中,Anthropic 的模型有 4 个,数量最多。
  • 第 1 名模型获得了 177 票,此排行榜包含 278 个模型。

韩语 LMArena

发布日期:2026-10-02 · 获取日期:2026-10-04

14001440148015201560
Anthropicclaude-fable-5.1-max
1514
Metamuse-spark-1.3-max
1513
Anthropicclaude-opus-5-max
1498
Anthropicclaude-fable-5-high
1497
Zglm-5.3-max
1481
Googlegemini-3.7-flash-high
1480
Metamuse-spark-1.1
1477
Moonshot AIkimi-k3-max
1473
Metamuse-spark
1472
Anthropicclaude-opus-4-7
1472
Anthropicclaude-opus-4-6
1465
DeepSeekdeepseek-v4-pro-high-20260813
1462
Alibabaqwen3.8-max
1460
Googlegemini-3.1-pro-preview
1458
Googlegemini-3.8-flash-high
1456
Ogpt-5.5-instant
1451
Anthropicclaude-opus-4-8-high
1450
Zglm-5.2-max
1450
Ogpt-5.6-sol-xhigh
1449
Googlegemini-3-pro
1449

圆点表示得分,横线表示 95% 置信区间。横线重叠意味着水平基本相近。 图表仅显示同一模型各推理设置(high、max 等)中排名最高的一项。表格列出所有设置各自的排名。 对话与视觉排名采用与 LMArena 网站默认设置相同的“语气与长度校正(style control)”排名。

各公司最高排名

  • AnthropicAnthropicclaude-fable-5.1-max#1
  • MetaMetamuse-spark-1.3-max#2
  • ZZ.aiglm-5.3-max#6
  • GoogleGooglegemini-3.7-flash-high#7
  • Moonshot AIMoonshot AIkimi-k3-max#9
  • DeepSeekDeepSeekdeepseek-v4-pro-high-20260813#14
  • AlibabaAlibabaqwen3.8-max#15
  • OOpenAIgpt-5.5-instant#18
  • xxAIgrok-4.20-beta1#27
查看表格(前 50 名)
排名模型开发方分数95% 置信区间投票数
1#1Anthropicclaude-fable-5.1-maxAnthropic15141468–1560177
2#2Metamuse-spark-1.3-maxMeta15131472–1554205
3#3Anthropicclaude-opus-5-maxAnthropic14981472–1524568
4#4Anthropicclaude-fable-5-highAnthropic14971473–1520722
5#5Anthropicclaude-opus-5-highAnthropic14931473–15131,126
6#6Zglm-5.3-maxZ.ai14811446–1515298
7#7Googlegemini-3.7-flash-highGoogle14801449–1511404
8#8Metamuse-spark-1.1Meta14771453–1500708
9#9Moonshot AIkimi-k3-maxMoonshot AI14731449–1497615
10#10Metamuse-sparkMeta14721433–1511252
11#11Anthropicclaude-opus-4-7Anthropic14721453–14911,144
12#12Anthropicclaude-opus-4-6Anthropic14651447–14821,486
13#13Anthropicclaude-opus-4-7-highAnthropic14641444–14831,100
14#14DeepSeekdeepseek-v4-pro-high-20260813DeepSeek14621421–1502195
15#15Alibabaqwen3.8-maxAlibaba14601432–1488493
16#16Googlegemini-3.1-pro-previewGoogle14581443–14722,145
17#17Googlegemini-3.8-flash-highGoogle14561427–1484487
18#18Ogpt-5.5-instantOpenAI14511421–1481432
19#19Anthropicclaude-opus-4-8-highAnthropic14501431–14701,094
20#20Zglm-5.2-maxZ.ai14501429–1471879
21#21Ogpt-5.6-sol-xhighOpenAI14491426–1473723
22#22Googlegemini-3-proGoogle14491426–1472719
23#23Anthropicclaude-opus-4-5-20251101Anthropic14491430–14671,163
24#24Anthropicclaude-opus-4-6-highAnthropic14461428–14641,310
25#25Ogpt-5.5-highOpenAI14451427–14641,187
26#26Googlegemini-3-flashGoogle14451420–1470579
27#27xgrok-4.20-beta1xAI14441416–1473467
28#28Anthropicclaude-opus-4-8Anthropic14441425–14641,064
29#29Googlegemini-3.5-flash-mediumGoogle14431422–1465855
30#30Googlegemini-3.5-flash-highGoogle14391419–1459960
31#31Zglm-5.3-flashZ.ai14381408–1469397
32#32Googlegemini-3.6-flash-highGoogle14371414–1460685
33#33DeepSeekdeepseek-v4-pro-high-previewDeepSeek14371417–1457980
34#34Xiaomimimo-v2.5-proXiaomi14361418–14541,305
35#35xgrok-4.20-multi-agent-beta-0309xAI14361416–14551,045
36#36Ogpt-5.4-highOpenAI14351415–14541,106
37#37Anthropicclaude-sonnet-4-6Anthropic14341415–14521,146
38#38xgrok-4.20-beta-0309-reasoningxAI14331414–14531,058
39#39xgrok-4.1xAI14321413–14501,142
40#40Anthropicclaude-sonnet-5-highAnthropic14321410–1454792
41#41xgrok-4.6-highxAI14311403–1460468
42#42Ogpt-5.5OpenAI14301411–14481,180
43#43Googlegemini-3-flash (thinking-minimal)Google14291412–14461,408
44#44xgrok-4.1-thinkingxAI14271408–14461,119
45#45Zglm-5Z.ai14271401–1452552
46#46Ogpt-5.4OpenAI14261407–14461,159
47#47Moonshot AIkimi-k2.6Moonshot AI14241402–1447729
48#48Ogpt-5.2-chat-latest-20260210OpenAI14241398–1450555
49#49Ogpt-5.6-terra-xhighOpenAI14241401–1446733
50#50Googlegemini-3.5-flash-liteGoogle14231399–1446708

数据:LMArena leaderboard dataset(CC BY 4.0)。修改:各榜单仅显示前 50 名,分数四舍五入。 https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset公司标志为各公司的商标,仅用于帮助区分(图标:Simple Icons)。数据:Epoch AI — Capabilities & benchmarking(CC BY 4.0)。 https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings