
【2026年】Grok 4.6完全解説!フロンティア性能を同価格で実現した最新モデルを公式ベンチマークで比較
「Grok 4.6ってどんなモデル?」 「フロンティア級の性能を、前作と同じ価格で使えるって本当?」
2026年8月12日、xAI がGrok 4.6を発表しました。Grok 4.5 からの大幅な性能向上を、価格を変えずに実現した最新モデルです。
特に長時間かかるエージェントタスクと複雑な対話・ビジュアル作業に強みを持ち、人工知能分析の複合指標AA Intelligence Index で GPT-5.6 Sol と並ぶ 61 点を記録しました。
この記事では、公式発表・公式ベンチマークを基に Grok 4.6 を徹底解説します。
この記事でわかること
- Grok 4.6 とは何か
- 何が強化されたのか(訓練・性能)
- 公式ベンチマーク完全比較表
- 料金(API価格)
- 使い方(Grok Build・Cursor・API)
Grok 4.6 とは?
Grok 4.6 は、xAI が 2026年8月12日にリリースしたフロンティア級の性能を持つ最新AIモデルです。
公式の説明: 「Grok 4.6 は Grok 4.5 を土台に、長時間実行するエージェントと、より野心的な対話・ビジュアル作業に特に焦点を当てて構築されています」
- リサーチ・情報分析・コードベース横断・アイデアの実装など、多数のステップを要する複雑なタスクを継続して処理
- フロンティア級の知能を、Grok 4.5 と同じ価格で提供
何が強化されたのか?
1. より長い補助訓練
Grok 4.5 よりも長い補助訓練を実施。推論・高度な技術概念のためのモデル生成データと高品質なエンジニアリングデータ、改善されたオプティマイザーで訓練。
2. 高性能な土台
Grok 4.5 を使って SFT(教師あり微調整)のトラジェクトリを再生成し、問題のある痕跡をフィルタリング。性能と挙動が改善されたチェックポイントを実現。
3. エージェント特化の強化学習
知識仕事・一般コーディング・カーネル最適化・Web開発・CADなど、幅広いエージェント向け強化学習タスクで訓練。
4. 長い作業での自己検証
長いトラジェクトリでは、自分自身の作業をチェックしてから次に進む自己テスト・検証を実施。
5. ビジュアル・対話プロジェクトの強化
ビジュアル・対話プロジェクトでの最初の一発目の品質が向上。1回でアプリの構造と視覚言語を確立できる。
公式ベンチマーク完全比較
xAI が公開した公式ベンチマークです(Grok 4.6 High がハイライト)。
| ベンチマーク | Grok 4.6 | Grok 4.5 | GPT-5.6 Sol Max | Fable 5 Max |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54% | 73% | 70% |
| FrontierCode v1.1 (Extended) | 61.3% | 56.6% | 60.6% | 64.9% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26% | 15.7% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | 53.6% | — | 58.8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15.8% | 12.9% | 2.5% | 11.3% |
比較ポイント
- AA Intelligence Index: Grok 4.6 は 61 でGPT-5.6 Sol と同点、Grok 4.5 の 56 から大幅向上
- GDPVal-AA v2・AA-Briefcase・Harvey LAB:Grok 4.6 が全モデル中トップ
- CursorBench・FrontierCode: GPT-5.6 Sol・Fable 5 とほぼ互角
※競合モデルのスコアは各社の自己報告・公開データの最良値
料金(API価格)
Grok 4.6 の API 価格は、フロンティア級モデルとしては半額です。
| 項目 | 価格 |
|---|---|
| 入力(Input) | $2 / 100万トークン |
| 出力(Output) | $6 / 100万トークン |
| Fast バリアント | 2倍の価格(入力$4 / 出力$12) |
Grok 4.5 と同じ価格でフロンティア性能が使えるのが最大の特徴です。
使い方
Grok 4.6 は以下の場所で利用できます。
- Grok Build: 今日から利用可能(初週は利用量2倍)
- Cursor: 今日から利用可能(初週は利用量2倍)
- API: xAI Console からキーを発行
- その他: OpenRouter・Vercel・Cloudflare などのパートナーからも利用可能
APIキーの作成
- xAI Console にアクセス
- APIキーを作成
- ドキュメントに従って統合
Grok Build を無料で試す
curl -fsSL https://x.ai/cli/install.sh | bash
メリット・デメリット
メリット
- フロンティア級の性能(AA Intelligence Index 61 = GPT-5.6 Sol と同点)
- Grok 4.5 と同じ価格で大幅性能向上
- 長時間エージェント・ビジュアル作業に強い
- Cursor ・Grok Build ・API ・パートナーで即利用可能
- 初週は Grok Build・Cursor で利用量2倍
デメリット・注意点
- Terminal-Bench など一部のベンチで GPT-5.6 Sol・Fable 5 に劣る
- Fast バリアントは通常の2倍の価格
- ベンチマークは公式発表値(実利用での体感は要検証)
まとめ
Grok 4.6 は、フロンティア級の性能を前作と同じ価格で実現した、xAI の最新主力モデルです。
- AA Intelligence Index 61 = GPT-5.6 Sol と同点
- GDPVal-AA・AA-Briefcase・Harvey LAB では全モデル中トップ
- エージェント・ビジュアル作業に強化
- API価格 $2/$6(100万トークンあたり) = フロンティア級の半額
「フロンティア級の性能を手頃な価格で使いたい」という人にとって、Grok 4.6 は有力な選択肢です。
参考: Grok 4.6 発表記事 ・ Grok 公式サイト ・ xAI API
関連記事
-
【速報・2026年】Googleが「WeatherNext 3」発表。リアルタイム衛星データで毎時更新する世界最高精度のAI天気予報モデルを解説
- 【2026年】Grok 4.5完全解説!Opus級の性能でコストは1/4、xAIの新モデルをDeepSeek V4と徹底比較
- 【速報・2026年7月31日】DeepSeek V4 Flash 公式APIがパブリックベータ公開!エージェント性能がV4 Pro Previewを超え、Claude Code・Codex・OpenCode・Hermes等6ツールにネイティブ対応
- 【2026年】DeepSeek V4-Flash-Vision-Exp発表!マルチモーダル対応でOpus-4.8に迫る実験的モデルを解説
この記事のまとめ
2026年8月12日、xAI がGrok 4.6を発表しました。Grok 4.5 からの大幅な性能向上を、価格を変えずに実現した最新モデルです。
この記事をシェアする
関連記事

2026年9月7日
【2026年9月】Meta「Muse Spark 1.3 max」が一般公開!ベンチマークでOpus 5と同率1位のコーディング性能

2026年10月1日
【2026年10月】Gemini 4 Argon徹底解説|100万トークン出力とベンチマーク19項目を出典付きで読み解く

2026年7月21日
【2026年】Laguna S 2.1 徹底解説!118B MoEで1Mトークン・最大25倍のモデルを超えるオープンウェイトAIコーディングモデルの実力(ベンチマーク完全比較)

2026年8月16日
【2026年8月16日時点】Cheaper InferenceでAIモデルが最大60%オフ!最新価格比較と仕組みを完全解説

2026年9月22日
【2026年】Xiaomi MiMo-V2.6 Pro/Flash の料金と性能を比較|オープンソース最高記録を出した2モデル

2026年10月2日
【2026年】Cloudflare Clef完全解説|文章を生成しない判断専門モデルとRLファインチューニング、Jevとの比較