GPT-6 Astra
OpenAI · 2026-09-03
基本信息
- 开发机构
- OOpenAI
- 发布日期
- 2026-09-03
- 综合能力指数(ECI)
- 166.5
官方视频
测试分数(Epoch AI)
同时显示模型在每项测试的参评模型中的排名。
O博士级科学问题(GPQA Diamond) · 共 30 个,排名第 1
95.8%
O顶级难度数学(FrontierMath) · 共 30 个,排名第 1
93.7%
O各领域顶级难题(HLE) · 共 30 个,排名第 1
54.8%
O陌生谜题推理(ARC-AGI-2) · 共 30 个,排名第 1
95.0%
O事实问答准确率(SimpleQA Verified) · 共 30 个,排名第 1
75.6%
柱状条表示正确率(%),从 0% 起绘制。
用户投票排名(LMArena)
该排名基于用户比较两个模型的回答后进行的投票。模型不会出现在投票数尚不足的排行榜中。
- 综合共 413 个,排名第 29 · 1477
- 中文共 389 个,排名第 43 · 1510
- 网页开发共 50 个,排名第 2 · 1788
- 智能体综合共 50 个,排名第 4 · 0.123
- 智能体任务成功共 50 个,排名第 6 · 0.132
- 编程共 408 个,排名第 7 · 1543
- 文档理解共 44 个,排名第 16 · 1468
- 图像理解(视觉)共 50 个,排名第 20 · 1284
- 英语共 413 个,排名第 26 · 1488
- 法语共 290 个,排名第 26 · 1497
- 数学共 396 个,排名第 27 · 1490
- 创意写作共 411 个,排名第 39 · 1449
- 日语共 274 个,排名第 68 · 1418
- 西班牙语共 295 个,排名第 86 · 1437
在哪里使用
OpenAI 的模型主要可在 ChatGPT 中使用。各订阅方案可使用的模型和用量不同,请在价格与免费额度页面查看。
分数和排名均原样转载自公开资料,并非本站自行测评的结果。由于各资料中的模型名称略有差异,本站采用自动匹配,因此偶尔可能混入其他版本的数据。
来源: Epoch AI (CC BY 4.0) · 核实日期 2026-10-04 · LMArena (CC BY 4.0) · 核实日期 2026-10-04