GROK 4.6
AUG_7_
1.5T_
TARGET.

Grok 4.6 xAI フロンティアモデル 発売予定タイムライン

2026年7月28日、イーロン・マスク氏はVercel CEO Guillermo Rauch氏へのX返信で、xAIが8月7日前後1.5兆(1.5T)パラメータのGrok 4.6を、数週間後に2.1兆(2.1T)のGrok 4.7を投入する旨を示しました。これはxAI公式ブログではなく、個人のSNS投稿です。課題:開発者は「Musk time」のスケジュール揺らぎ、ベンチマーク未公開の予告スペック、Kimi K3オープンウェイトショックによる選定ウィンドウの短縮に直面しています。結論:xAIがモデルカードを公開するまでは、パラメータ数ではなくToken効率と実タスクコストを判断基準にすべきです。構成:タイムライン → スペック表 → SFT/RL解説 → 競合比較 → 注意点 → 8月リリース集中月の洞察 → 5段階ガイド → FAQ。

30秒で把握 · エグゼクティブサマリー

情報源マスク氏7月28日のX返信(xAI公式ではない
Grok 4.6~8月7日 · 1.5Tパラメータ · SFT/RL強化が焦点
Grok 4.78月末〜9月初旬 · 2.1T · 4.6を上回るが推論はやや遅い
競合背景Kimi K3オープンウェイト約10日後 · Fable 5.1噂も同月
料金/ベンチマークすべて未公開 — モデルカード・第三者スコアなし

1. 課題整理:なぜ今回の予告は読む価値があり、かつ全信はできないのか

  1. 「Musk time」には前例があります。xAI、Tesla、SpaceXの公開スケジュールは、歴史的に数日〜2週間の遅延が発生することがあります。「8月7日前後」は目標であり、約束ではありません。
  2. 唯一の情報源は1件の投稿です。Grok 4.5の15ベンチマーク付きローンチやモデルカードとは異なり、4.6/4.7は独立検証データがゼロです。
  3. Kimi K3が競争圧力を高めています。7月26日のK3オープンウェイト(2.8T、Frontend Code Arena 1,679点)に対し、マスク氏自身も「印象的」とコメント。xAIのリリース加速は業界の現実的な反応と見られます。

2. タイムライン:Grok 4.5 → 4.6 → 4.7

日付イベント
2026-07-08xAIがGrok 4.5を正式発表:コーディング/エージェント旗艦、Cursor共同トレーニング、50万tokenコンテキスト、入力$2/出力$6(100万tokenあたり)
2026-07-16月之暗面(Moonshot AI)Kimi K3ホステッドプレビュー開始
2026-07-26Kimi K3完全オープンウェイト公開(2.8T、100万tokenコンテキスト)
2026-07-28マスク氏がGrok 4.6/4.7ロードマップを投稿;同日1,200名超の従業員が「Pacing the Frontier」公開書簡を発表
~2026-08-07Grok 4.6目標リリース:1.5Tパラメータ、SFT/RL強化が焦点
~2026-08末-9月初Grok 4.7目標リリース:2.1Tパラメータ、4.6を全面で上回るが推論速度はやや遅く、Token効率は向上

3. コアスペック一覧

モデル発売/目標日パラメータ重点領域ステータス
Grok 4.3 Beta2026-04-17非公開前世代ベースラインリリース済み
Grok 4.52026-07-08非公開コーディング/エージェント、Cursor共同訓練リリース済み
Grok 4.6~2026-08-071.5TSFT/RL大幅強化予告のみ、未リリース
Grok 4.7~8月末-9月初2.1T4.6を上回る総合力、Token効率向上予告のみ、未リリース

注:パラメータ規模、料金、ベンチマークスコアはすべてベンダー/マスク氏の発言に基づき、Grok 4.6・4.7とも第三者独立評価はありません。

4. 深掘り:今回のアップグレードの核心は「より大きい」ではなく「より賢く学ぶ」

4.1 SFTとRLが解決する問題

教師あり微調整(SFT)は高品質なアノテーションサンプルで出力習慣を修正します。強化学習(RL)は報酬信号を通じて、モデルが実タスクチェーンで多段階エージェント行動を学習するのを支援します。マスク氏がGrok 4.6の重点を「SFT & RL」とした点は、Grok 4.5の延長線上にあります。4.5はCursorの実開発者セッションデータにより、Terminal-Bench 2.1で83.3%、SWE-Bench Pro 64.7%を記録。同種タスクの出力tokenは約15,954で、Claude Opus 4.8の67,020(約4.2倍の効率差)を大きく下回りました。

4.2 xAIが「パラメータ拡大+ポストトレーニング精修」の両輪を選ぶ理由

Grok 4.6の1.5Tは明確な規模ジャンプですが、マスク氏はGrok 4.7を2.1Tとしながら「推論はやや遅い」と補足しています。これはxAI内部で「より強い」と「より速い」の2SKUを分け、単一モデルですべてをカバーしない戦略を示唆しています。AnthropicのSonnet/Opus分割やOpenAIのmini/full階層と同型の考え方です。

4.3 Kimi K3との同時期競争がもたらす現実的圧力

Grok 4.6の目標日は、Kimi K3完全オープンウェイトから約10日後です。K3はFrontend Code Arenaで1,679点を獲得し、同ボードで初のオープンウェイト全閉源モデル超えを達成。Artificial Analysis Intelligence Indexでは世界3位です。業界は、xAIの4.6/4.7加速が米中競争の激化と直結していると見ています。

5. 横断比較:Grokシリーズ vs 同期競合

モデルベンダーパラメータコンテキスト料金(入/出、100万token)データ源
Grok 4.5xAI非公開50万token$2 / $6xAI公式
Grok 4.6(予告)xAI1.5T非公開非公開マスクX投稿(未検証)
Kimi K3Moonshot AI2.8T(MoE、~16/896アクティブ)100万token$0.30(キャッシュヒット)/$3(ミス)入力、$15出力Moonshot公式
Claude Fable 5.1(噂)Anthropic非公開非公開噂:Fable 5維持($10/$50)36kr、WinCentralリーク
GPT-5.6 SolOpenAI非公開非公開非公開OpenAI公式

6. 論点と注意すべき詳細

  • スケジュールは第三者未検証:現時点の唯一の情報源はマスク氏のX返信で、xAI公式ブログは未同期です。
  • ベンチマークと料金はすべて空白:「1.5Tパラメータ」「SFT/RL大幅強化」は現状ベンダー単独の主張です。
  • xAIのコンテンツ安全論争:2026年7月、xAIはGrokの安全制限回避によるCSAM生成を巡りユーザーを提訴。2026年1月、Common Sense MediaはGrokを未成年保護で最悪クラスのAI製品の一つと評価しました。
  • 業界の「減速」呼びかけとのズレ:7月28日のロードマップ公開と同日、OpenAI・Anthropic等1,200名超が「Pacing the Frontier」に署名。xAIは署名者リストに含まれていません。

7. 業界洞察:2026年8月は「集中リリース月」になりうる

マスク氏のタイムラインが成立すれば、Grok 4.6・4.7は噂のClaude Fable 5.1(複数ソースが8月、AnthropicはGPT-6前の投入を意図)と同月に登場し、7月のKimi K3オープンウェイトショックも重なります。2026年8月は、フロンティアモデルリリース密度が記録的に高い月の一つになる可能性があります。開発チームにとって、単一旗艦の有効期間は四半期ではなく数週間に圧縮されるかもしれません。

より深い変化は、選定軸が「リーダーボード順位」から「タスクあたり総コスト」へ移行している点です。Grok 4.5は出力token効率がインテリジェンス指数の差を相殺できることを示しました。Kimi K3はセルフホスティングを現実的選択肢にしました。Fable 5.1が8月に登場すれば、閉源プレミアムはさらに圧迫されます。閉源API・オープン自前ホスト・ハイブリッドルーティングの3経路が、8月に集中ストレステストを受けます。

エンジニアリング現場では、ルーティングテーブルのドリフトが最大の運用リスクです。モデルエイリアス、フォールバックチェーン、コスト上限のメンテナンスが四半期単位から週次インシデントに変わる可能性があります。30日間に3つの兆パラメータ級モデルが出荷されれば、Cursor/OpenRouter上のデフォルトルート更新は「待てば安くなる」戦略と「今すぐ契約ロック」戦略の両方にリスクをもたらします。

8. 5段階選定ガイド:モデルカード公開前に何をすべきか

  1. 情報源を固定する:xAI公式ブログ(x.ai/news)、Grok Buildコンソール、マスク氏Xアカウントを監視。モデルカード公開前に予告スペックをSLAに書き込まない。
  2. 3層ルートを構築する:主力(現行Grok 4.5またはKimi K3 API)→ 高精度レビュー(Claude/GPT)→ オフライン兜底(ローカルMLX量子化オープンウェイト)。
  3. Token効率のベースラインを取る:SWE-Bench同種タスクで「出力token/タスク」を記録。新モデルは本番相当20タスクを回してからデフォルト切替。
  4. 8月リリースウィンドウのプレイブック:Grok 4.6、Fable 5.1、K3微調整版それぞれに48時間評価ウィンドウを確保。初日の本番全量切替は禁止。
  5. コンプライアンス・安全監査:未成年・センシティブ領域の企業利用では、xAIの最近の安全関連訴訟を技術ベンチマークと並列で評価する。

9. FAQ

Q1:Grok 4.6は具体的にいつリリースされますか?
マスク氏はXで「2026年8月7日前後」と述べましたが、xAIは公式日付を確認していません。前倒し・延期の可能性があります。

Q2:Grok 4.6とGrok 4.7の違いは何ですか?
4.6は1.5TでSFT/RL後トレーニングが重点。4.7は2.1Tで4.6を上回る総合力を持つ一方、推論速度はやや遅く、Token効率は向上するとされています。

Q3:Grok 4.6はKimi K3やClaude Fable 5.1より強いですか?
現時点では判断できません。Grok 4.6に公開ベンチマークはなく、K3は検証済みスコアあり、Fable 5.1はAnthropic未確認です。

Q4:Grok 4.6の料金はいくらになりそうですか?
不明です。参考としてGrok 4.5は入力$2/出力$6(100万token)でしたが、次世代は調整される可能性があります。

Q5:一般ユーザーはどこでGrok 4.6を使えるようになりますか?
Grok 4.5の展開経路から推測すると、Grok Build、xAI API、コンソールが先行し、その後Cursor等の第三者プラットフォームに接続される見込みです。

10. まとめ:フロンティアAPI追従 + Macローカルオープンウェイトのヘッジ

Windows/LinuxクラウドだけでもGrok 4.6の動向を追いAPIを呼べますが、ローカルオープンウェイト基準線、Cursor/OpenClawエージェント常駐、MLX量子化Kimi K3兜底、ユニファイドメモリによる長コンテキスト分流ではApple Silicon Macの方が運用が滑らかです。8月の集中リリース月において希少なのは「どのモデルが最高スコアか」ではなく、48時間で実タスク対照ができ、ベンダーロックインを避けられる監査可能な計算環境です。ローカルMLXでK3量子化対照、リモートノード7×24でOpenClaw多モデルルーティング評価、ユニファイドメモリでエージェント長セッション分流が必要なら、3層構成を推奨します:ローカルMLXで日常とオフライン兜底、フロンティア閉源APIでGrok/Claude高難度推論、MACGPUリモートMacノードでエージェント常駐と隔離評価——「Musk time」と「リリース月」の二重不確実性に対する最良のヘッジです。