IMAGE: AI生成ビジュアル
MODELS / MODEL WATCH
xAI、「Grok 4.6」を公開 — 500Kコンテキストで長期エージェント向けに強化、Cursor/Grok Buildに即日搭載
Grok 4.5の後継としてエージェント系ベンチマークを刷新。API料金は入力$2/出力$6(100万トークンあたり)から。500Kトークンのコンテキスト窓を持ち、高速版(fast variant)は2倍の料金設定。
xAI(SpaceXAI)は2026年8月12日、フロンティアモデル「Grok 4.6」を公開した。Grok 4.5の後継として、長期間にわたって複雑なタスクを継続するエージェント用途と、より高度なインタラクティブ・ビジュアル作業に焦点を当てた設計だ。同日からAPI、Cursor、Grok Buildで利用できる。
API仕様と料金
公式リリースノートによると、Grok 4.6はコーディング、エージェントタスク、ナレッジワーク向けのフロンティアモデルとしてAPI提供される。500Kトークンのコンテキスト窓を持ち、テキストと画像を入力できる一方、出力はテキストのみで出力トークン数の上限は設けていない。
- コンテキスト窓: 500Kトークン
- 入力: テキスト+画像、出力: テキストのみ(出力上限なし)
- 料金(200Kプロンプトトークン未満): 入力$2/キャッシュ済み入力$0.50/出力$6(100万トークンあたり)
- 料金(200Kプロンプトトークン以上): 入力$4/キャッシュ済み入力$1/出力$12(同)
- 推論努力(reasoning effort): low/medium/high(既定)/xhighの4段階
- 高速版(fast variant)は2倍の料金設定
エージェント系ベンチマークでの公称値
xAIの発表によると、Grok 4.6はArtificial Analysis Intelligence Index(9ベンチマークの合成スコア)で61を記録し、GPT-5.6 Sol Max(61)に並んだとされる。主要なエージェント系・コーディング系ベンチマークの公称値は以下の通り。比較相手の数値は各社のシステムカードや公開リーダーボードに基づくもので、独立した再現評価は今後を待つ必要がある。
- AA Intelligence Index: 61(Grok 4.5 Highは56、Fable 5 Maxは62)
- GDPVal-AA v2: 1753(Grok 4.5 Highは1526)
- CursorBench v3.2: 69.9%(Grok 4.5 Highは66.7%)
- DeepSWE v1.1: 65.9%(Grok 4.5 Highは54%)
- FrontierCode v1.1(Extended): 61.3%(Grok 4.5 Highは56.6%)
- Terminal-Bench v3.0: 26%(Grok 4.5 Highは15.7%)
トレーニングと提供状況
xAIは、Grok 4.6がGrok 4.5より長い追加トレーニングを経ており、推論や高度な技術概念向けのキュレーションされたモデル生成データ、高品質なエンジニアリングデータ、改善されたオプティマイザとトレーニングレシピを用いたと説明している。エージェント向けRLタスクは、ナレッジワーク、汎用コーディングに加え、カーネル最適化、Web開発、CADなどのドメイン固有環境をカバーする。
- CursorとGrok Buildで即日利用可能(初週は2倍の利用枠を提供)
- APIのほかOpenRouter、Vercel、Cloudflareなどのパートナー経由でも提供
- 安全性は能力の拡大に合わせてガードを調整し、事前デプロイテストは自社史上最大規模としている(xAI説明)
出典: xAI公式アナウンス「Introducing Grok 4.6」、xAI APIドキュメント「Release Notes」(いずれも2026-08-14確認)。