Valumigo

GPT-5.6 Luna

OpenAI · 2026-07-09

基本信息

开发机构
OOpenAI
发布日期
2026-07-09
综合能力指数(ECI)
156.5

测试分数(Epoch AI)

同时显示模型在每项测试的参评模型中的排名。

O博士级科学问题(GPQA Diamond) · 共 30 个,排名第 26
91.6%
O顶级难度数学(FrontierMath) · 共 30 个,排名第 14
82.1%
O陌生谜题推理(ARC-AGI-2) · 共 30 个,排名第 27
59.5%

柱状条表示正确率(%),从 0% 起绘制。

用户投票排名(LMArena)

该排名基于用户比较两个模型的回答后进行的投票。模型不会出现在投票数尚不足的排行榜中。

  • 综合共 413 个,排名第 75 · 1453
  • 中文共 389 个,排名第 100 · 1476
  • 文档理解共 44 个,排名第 23 · 1457
  • 德语共 307 个,排名第 32 · 1476
  • 智能体综合共 50 个,排名第 35 · -0.012
  • 智能体任务成功共 50 个,排名第 35 · -0.033
  • 数学共 396 个,排名第 39 · 1477
  • 图像理解(视觉)共 50 个,排名第 44 · 1260
  • 西班牙语共 295 个,排名第 46 · 1463
  • 网页开发共 50 个,排名第 47 · 1518
  • 法语共 290 个,排名第 50 · 1482
  • 日语共 274 个,排名第 54 · 1430
  • 韩语共 278 个,排名第 63 · 1414
  • 英语共 413 个,排名第 66 · 1467
  • 编程共 408 个,排名第 74 · 1501
  • 创意写作共 411 个,排名第 93 · 1409

在哪里使用

OpenAI 的模型主要可在 ChatGPT 中使用。各订阅方案可使用的模型和用量不同,请在价格与免费额度页面查看。

查看 ChatGPT 价格与免费额度 →

分数和排名均原样转载自公开资料,并非本站自行测评的结果。由于各资料中的模型名称略有差异,本站采用自动匹配,因此偶尔可能混入其他版本的数据。

来源: Epoch AI (CC BY 4.0) · 核实日期 2026-10-04 · LMArena (CC BY 4.0) · 核实日期 2026-10-04