Valumigo

Grok 4.6

xAI · 2026-08-12

基本情報

開発元
xxAI
リリース日
2026-08-12
総合能力指数(ECI)
156.6

ベンチマークスコア(Epoch AI)

各ベンチマークで評価されたモデルの中での順位も表示します。

x博士レベルの科学問題(GPQA Diamond) · 30モデル中10位
94.0%
x最高難度の数学(FrontierMath) · 30モデル中27位
66.0%
x初見のパズル推論(ARC-AGI-2) · 30モデル中20位
67.1%
x事実に関する質問の正答率(SimpleQA Verified) · 30モデル中27位
49.3%

棒は正答率(%)を示し、0%から描画しています。

ユーザー投票ランキング(LMArena)

ユーザーが2つのモデルの回答を比較し、投票した結果に基づく順位です。投票数がまだ不足しているランキングには掲載されません。

  • 総合413モデル中73位 · 1454
  • 日本語274モデル中82位 · 1402
  • Web開発50モデル中23位 · 1620
  • 文書理解44モデル中25位 · 1452
  • エージェント総合50モデル中25位 · 0.013
  • エージェントのタスク成功50モデル中31位 · -0.006
  • フランス語290モデル中36位 · 1491
  • 韓国語278モデル中41位 · 1431
  • 画像理解(ビジョン)50モデル中41位 · 1263
  • 創作411モデル中52位 · 1445
  • 中国語389モデル中53位 · 1503
  • ドイツ語307モデル中59位 · 1457
  • コーディング408モデル中64位 · 1507
  • 数学396モデル中78位 · 1448
  • 英語413モデル中82位 · 1458
  • スペイン語295モデル中102位 · 1429

利用できるサービス

このモデルを利用できるサービスと料金プランは、まだ当サイトでまとめていません。開発元の公式案内をご確認ください。

スコアと順位は公開資料からそのまま転載したものであり、当サイトが独自に測定した値ではありません。資料によってモデル名が多少異なるため、自動照合した結果には、まれに別のバージョンのデータが混在する場合があります。

出典: Epoch AI (CC BY 4.0) · 確認日 2026-10-04 · LMArena (CC BY 4.0) · 確認日 2026-10-04