Valumigo

GPT-5.6 Luna

OpenAI · 2026-07-09

基本情報

開発元
OOpenAI
リリース日
2026-07-09
総合能力指数(ECI)
156.5

ベンチマークスコア(Epoch AI)

各ベンチマークで評価されたモデルの中での順位も表示します。

O博士レベルの科学問題(GPQA Diamond) · 30モデル中26位
91.6%
O最高難度の数学(FrontierMath) · 30モデル中14位
82.1%
O初見のパズル推論(ARC-AGI-2) · 30モデル中27位
59.5%

棒は正答率(%)を示し、0%から描画しています。

ユーザー投票ランキング(LMArena)

ユーザーが2つのモデルの回答を比較し、投票した結果に基づく順位です。投票数がまだ不足しているランキングには掲載されません。

  • 総合413モデル中75位 · 1453
  • 日本語274モデル中54位 · 1430
  • 文書理解44モデル中23位 · 1457
  • ドイツ語307モデル中32位 · 1476
  • エージェント総合50モデル中35位 · -0.012
  • エージェントのタスク成功50モデル中35位 · -0.033
  • 数学396モデル中39位 · 1477
  • 画像理解(ビジョン)50モデル中44位 · 1260
  • スペイン語295モデル中46位 · 1463
  • Web開発50モデル中47位 · 1518
  • フランス語290モデル中50位 · 1482
  • 韓国語278モデル中63位 · 1414
  • 英語413モデル中66位 · 1467
  • コーディング408モデル中74位 · 1501
  • 創作411モデル中93位 · 1409
  • 中国語389モデル中100位 · 1476

利用できるサービス

OpenAIのモデルは主にChatGPTで利用できます。料金プランによって利用できるモデルと使用量が異なるため、料金・無料利用範囲のページでご確認ください。

ChatGPTの料金・無料利用範囲を見る →

スコアと順位は公開資料からそのまま転載したものであり、当サイトが独自に測定した値ではありません。資料によってモデル名が多少異なるため、自動照合した結果には、まれに別のバージョンのデータが混在する場合があります。

出典: Epoch AI (CC BY 4.0) · 確認日 2026-10-04 · LMArena (CC BY 4.0) · 確認日 2026-10-04