Grok 4.6
xAI · 2026-08-12
基本情報
- 開発元
- xxAI
- リリース日
- 2026-08-12
- 総合能力指数(ECI)
- 156.6
ベンチマークスコア(Epoch AI)
各ベンチマークで評価されたモデルの中での順位も表示します。
x博士レベルの科学問題(GPQA Diamond) · 30モデル中10位
94.0%
x最高難度の数学(FrontierMath) · 30モデル中27位
66.0%
x初見のパズル推論(ARC-AGI-2) · 30モデル中20位
67.1%
x事実に関する質問の正答率(SimpleQA Verified) · 30モデル中27位
49.3%
棒は正答率(%)を示し、0%から描画しています。
ユーザー投票ランキング(LMArena)
ユーザーが2つのモデルの回答を比較し、投票した結果に基づく順位です。投票数がまだ不足しているランキングには掲載されません。
- 総合413モデル中73位 · 1454
- 日本語274モデル中82位 · 1402
- Web開発50モデル中23位 · 1620
- 文書理解44モデル中25位 · 1452
- エージェント総合50モデル中25位 · 0.013
- エージェントのタスク成功50モデル中31位 · -0.006
- フランス語290モデル中36位 · 1491
- 韓国語278モデル中41位 · 1431
- 画像理解(ビジョン)50モデル中41位 · 1263
- 創作411モデル中52位 · 1445
- 中国語389モデル中53位 · 1503
- ドイツ語307モデル中59位 · 1457
- コーディング408モデル中64位 · 1507
- 数学396モデル中78位 · 1448
- 英語413モデル中82位 · 1458
- スペイン語295モデル中102位 · 1429
利用できるサービス
このモデルを利用できるサービスと料金プランは、まだ当サイトでまとめていません。開発元の公式案内をご確認ください。
スコアと順位は公開資料からそのまま転載したものであり、当サイトが独自に測定した値ではありません。資料によってモデル名が多少異なるため、自動照合した結果には、まれに別のバージョンのデータが混在する場合があります。
出典: Epoch AI (CC BY 4.0) · 確認日 2026-10-04 · LMArena (CC BY 4.0) · 確認日 2026-10-04