LMArena · 西班牙语
定期获取并展示公开的基准测试资料(LMArena 用户投票排名、Epoch AI 测试分数、OpenRouter 使用量排名)。每个榜单均标注数据发布日期和获取日期。这些分数并非本站自行评定。
如何解读此排行榜
衡量什么: 根据 LMArena 文本对话中被归类为 西班牙语 的问题所获投票计算的排名。
如何解读分数: 显示投票者在 西班牙语 问题中更偏好的模型。问题的语言并不代表投票者的母语或身份。
注意事项: 投票数量和置信区间宽度因语言和模型而异。对于新模型,请同时查看投票数量、更新日期及汇总条件。
本次排名的解读要点
- 第 1 名 claude-fable-5-high 与第 2 名 claude-opus-4-6 的 95% 置信区间重叠。仅凭本次统计难以确定两个模型的先后顺序。
- 还有 27 个模型的置信区间与第 1 名重叠。解读细微排名差异时,请结合投票数量保持谨慎。
- 前 10 个模型中,Anthropic 的模型有 6 个,数量最多。
- 第 1 名模型获得了 1,167 票,此排行榜包含 295 个模型。
西班牙语 LMArena
发布日期:2026-10-02 · 获取日期:2026-10-04
圆点表示得分,横线表示 95% 置信区间。横线重叠意味着水平基本相近。 图表仅显示同一模型各推理设置(high、max 等)中排名最高的一项。表格列出所有设置各自的排名。 对话与视觉排名采用与 LMArena 网站默认设置相同的“语气与长度校正(style control)”排名。
各公司最高排名
- Anthropicclaude-fable-5-high#1
- Googlegemini-4-argon-high#4
- OOpenAIgpt-5.5-instant#8
- Moonshot AIkimi-k3-max#9
- Alibabaqwen3.8-max#11
- Metamuse-spark-1.3-max#12
- DeepSeekdeepseek-v4.1-flash-max#17
- ZZ.aiglm-5.2-max#18
- Baiduernie-5.0-preview-1203#28
查看表格(前 50 名)
| 排名 | 模型 | 开发方 | 分数 | 95% 置信区间 | 投票数 |
|---|---|---|---|---|---|
| 1 | #1claude-fable-5-high | Anthropic | 1507 | 1489–1525 | 1,167 |
| 2 | #2claude-opus-4-6 | Anthropic | 1500 | 1487–1513 | 2,707 |
| 3 | #3claude-opus-4-7-high | Anthropic | 1499 | 1484–1513 | 2,043 |
| 4 | #4gemini-4-argon-high | 1497 | 1456–1538 | 201 | |
| 5 | #5gemini-3.7-flash-high | 1494 | 1471–1518 | 639 | |
| 6 | #6claude-opus-4-6-high | Anthropic | 1493 | 1480–1506 | 2,627 |
| 7 | #7claude-fable-5.1-max | Anthropic | 1487 | 1457–1516 | 375 |
| 8 | #8Ogpt-5.5-instant | OpenAI | 1485 | 1463–1507 | 811 |
| 9 | #9kimi-k3-max | Moonshot AI | 1485 | 1465–1505 | 843 |
| 10 | #10claude-opus-5-max | Anthropic | 1484 | 1463–1506 | 803 |
| 11 | #11qwen3.8-max | Alibaba | 1483 | 1459–1506 | 689 |
| 12 | #12muse-spark-1.3-max | Meta | 1482 | 1451–1514 | 365 |
| 13 | #13gemini-3.1-pro-preview | 1481 | 1470–1492 | 3,868 | |
| 14 | #14claude-opus-4-8-high | Anthropic | 1481 | 1466–1496 | 1,840 |
| 15 | #15muse-spark | Meta | 1480 | 1453–1507 | 518 |
| 16 | #16gemini-3-flash | 1478 | 1460–1497 | 999 | |
| 17 | #17deepseek-v4.1-flash-max | DeepSeek | 1478 | 1442–1513 | 274 |
| 18 | #18Zglm-5.2-max | Z.ai | 1477 | 1460–1494 | 1,314 |
| 19 | #19gemini-3.8-flash-high | 1476 | 1456–1497 | 848 | |
| 20 | #20muse-spark-1.1 | Meta | 1476 | 1458–1495 | 1,106 |
| 21 | #21claude-opus-4-5-20251101-high-32k | Anthropic | 1476 | 1459–1494 | 1,137 |
| 22 | #22gemini-3.6-flash-high | 1476 | 1456–1497 | 914 | |
| 23 | #23Ogpt-5.2-chat-latest-20260210 | OpenAI | 1475 | 1457–1492 | 1,206 |
| 24 | #24claude-opus-4-7 | Anthropic | 1474 | 1460–1488 | 2,099 |
| 25 | #25claude-opus-5-high | Anthropic | 1474 | 1458–1490 | 1,676 |
| 26 | #26gemini-3-pro | 1472 | 1454–1489 | 1,215 | |
| 27 | #27gemini-3.5-flash-high | 1471 | 1455–1488 | 1,410 | |
| 28 | #28ernie-5.0-preview-1203 | Baidu | 1470 | 1433–1507 | 238 |
| 29 | #29Ogpt-5.5-high | OpenAI | 1469 | 1455–1484 | 1,937 |
| 30 | #30dola-seed-2.0-pro | ByteDance | 1469 | 1456–1482 | 2,565 |
| 31 | #31Thy3 | Tencent | 1469 | 1439–1498 | 371 |
| 32 | #32xgrok-4.20-beta1 | xAI | 1468 | 1449–1488 | 952 |
| 33 | #33claude-opus-4-1-20250805 | Anthropic | 1468 | 1454–1481 | 2,293 |
| 34 | #34Ogpt-5.6-sol-xhigh | OpenAI | 1467 | 1448–1486 | 1,040 |
| 35 | #35gemini-3.5-flash-medium | 1467 | 1450–1485 | 1,274 | |
| 36 | #36claude-sonnet-4-6 | Anthropic | 1466 | 1452–1480 | 2,177 |
| 37 | #37claude-opus-4-8 | Anthropic | 1466 | 1452–1481 | 1,918 |
| 38 | #38claude-opus-4-1-20250805-thinking-16k | Anthropic | 1466 | 1448–1483 | 1,292 |
| 39 | #39Zglm-5.3-flash | Z.ai | 1466 | 1444–1487 | 792 |
| 40 | #40xgrok-4.1-thinking | xAI | 1466 | 1451–1480 | 1,944 |
| 41 | #41xgrok-4.20-multi-agent-beta-0309 | xAI | 1465 | 1451–1480 | 1,997 |
| 42 | #42claude-opus-4-5-20251101 | Anthropic | 1465 | 1452–1479 | 2,156 |
| 43 | #43claude-sonnet-4-5-20250929 | Anthropic | 1465 | 1453–1478 | 2,487 |
| 44 | #44Zglm-5.1 | Z.ai | 1465 | 1450–1479 | 1,897 |
| 45 | #45mimo-v2.5-pro | Xiaomi | 1464 | 1450–1479 | 2,126 |
| 46 | #46Ogpt-5.6-luna-xhigh | OpenAI | 1463 | 1444–1482 | 1,070 |
| 47 | #47xgrok-4.20-beta-0309-reasoning | xAI | 1462 | 1448–1476 | 2,057 |
| 48 | #48Ogpt-5.6-terra-xhigh | OpenAI | 1462 | 1443–1481 | 1,083 |
| 49 | #49Ogpt-5.4 | OpenAI | 1461 | 1446–1475 | 2,037 |
| 50 | #50kimi-k2.6 | Moonshot AI | 1460 | 1443–1476 | 1,371 |
数据:LMArena leaderboard dataset(CC BY 4.0)。修改:各榜单仅显示前 50 名,分数四舍五入。 https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset公司标志为各公司的商标,仅用于帮助区分(图标:Simple Icons)。数据:Epoch AI — Capabilities & benchmarking(CC BY 4.0)。 https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings