8月7日目標の前に押さえる五つの摩擦

Musk 氏の返信はロードマップの手がかりですが、本番切り替えには別レイヤーの判断が重なります。

  • スケジュールの未検証性:Musk 氏はベンダー側の未検証リリース主張に対して時間軸に慎重であると過去に述べています。8月7日は目標であり、コミットではありません。
  • 4.5 からの差分が限定的:Grok 4.6 の主眼は SFT/RL アップグレードと 1.5T 規模です。coding パイプラインは7月8日の 4.5 で既に強化済みで、4.6 は品質の微調整か serving コストの再配分になる可能性があります。
  • 4.7 の serving トレードオフ:2.1T の Grok 4.7 は「より良いが serving が遅い」との発言があり、latency 敏感なエージェントは 4.6 を長く使う選択肢もあります。
  • 競合の同時進行:Kimi K3 の 1M コンテキスト open weight と、8月噂の Claude Fable 5.1(未確認)が同ウィンドウに重なり、単一ベンダーへの固定はリスクです。
  • 規制と訴訟ノイズ:7月の xAI CSAM 関連訴訟と、7月28日の「Pacing the Frontier」公開書簡(1100名超署名)が、フロンティアモデル採用の社内審査を複雑化しています。

Grok 4.5・4.6・Kimi K3 — 仕様と価格の比較

7月8日の Grok 4.5 は実運用の基準点です。4.6 はその上に積まれる層として読むと、評価計画が明確になります。

項目 Grok 4.5(7月8日) Grok 4.6(Musk 7月28日) Kimi K3(7月16〜26日)
パラメータ規模公表値は限定的約 1.5T2.8T MoE open weight
主な強化点coding/agentic、Cursor 共学SFT/RL アップグレード1M コンテキスト、MoonEP 等 Infra
コンテキスト500,000 tokens未公表(4.5 継承か要確認)1,000,000 tokens
API 価格(per M tokens)$2 入力 / $6 出力未公表API ティア別(別記事参照)
Frontend Code Arena1679
重みダウンロード不可不可(想定)可(7月27日)
想定リリース2026年7月8日(済)約 2026年8月7日API 7月16日、重み 7月27日

Grok 4.6 と 4.7 — ロードマップ上の位置づけ

Musk 氏は単発の 4.6 ではなく、短期に二段の投入を示唆しています。

バージョン 時期(Musk 発言) 規模 トレードオフ
Grok 4.6約 8月7日約 1.5TSFT/RL 強化、比較的 serving 現実的
Grok 4.74.6 の数週間後約 2.1T性能向上、serving 遅延
Claude Fable 5.18月噂(未確認)非公表Anthropic 公式未発表

latency と品質の二軸でモデル ID を分け、OpenRouter のフォールバックチェーンに両方を登録する設計が現実的です。

Grok 4.6 投入前の開発者向け6ステップ

スケジュール投稿はデプロイ計画ではありません。隔離環境で同じチェックリストを回してください。

  1. 現行 4.5 ベースラインを固定:本番相当の coding/agentic タスクを Grok 4.5 で実行し、トークン数・latency・合格率をログに残します。4.6 比較の基準がないと差分は測れません。
  2. モデル ID と価格ティアを監視:xAI コンソールと docs.x.ai の changelog を購読し、4.6 切り替え時の入出力単価が 4.5 の $2/$6 per M tokens から変わるか確認します。
grok_smoke.py
from openai import OpenAI
client = OpenAI(
    api_key="...",
    base_url="https://api.x.ai/v1",
)
resp = client.chat.completions.create(
    model="grok-4-5",
    messages=[{"role": "user", "content": "Refactor this handler for testability."}],
)
print(resp.usage)
  1. コンテキスト上限を再検証:4.5 の 500K コンテキストで長文リポジトリを通したうえで、4.6 公開後に同じプロンプトを再実行し、truncation やコスト跳ねを比較します。
  2. Kimi K3 と side-by-side:同一タスクを Kimi K3(Frontend Code Arena 1679 文脈の UI/coding 系)で走らせ、open weight フォールバックの価値を数値化します。
  3. 規制・訴訟リスクを法務と同期:xAI CSAM 訴訟と Pacing the Frontier 書簡を踏まえ、顧客データが xAI 経由で渡るワークフローに追加審査が必要か判断します。
  4. 4.7 用の latency 予算を先に決める:2.1T・serving 遅延が許容できないパスは 4.6 に固定し、バッチ評価のみ 4.7 に回す二層構成を設計します。

Musk 氏の時間軸は過去に前倒し・後ろ倒しがあり、ベンダー未検証の主張には慎重です。8月7日をハードデッドラインにせず、API でモデルが実際に切り替わった時点で本番を更新してください。

引用に値する数値と出来事

  • Grok 4.6:約 8月7日、約 1.5T、SFT/RL アップグレード(Musk、2026年7月28日、@rauchg への X 返信)。
  • Grok 4.7:4.6 の数週間後、約 2.1T、性能向上、serving 遅延(同上)。
  • Grok 4.5:2026年7月8日、coding/agentic、Cursor 共学、500K コンテキスト、$2/$6 per M tokens。
  • Kimi K3:7月16〜26日、2.8T MoE open weight、1M コンテキスト、Frontend Code Arena 1679。
  • 規制:7月28日 Pacing the Frontier 公開書簡(1100名超署名);2026年7月 xAI CSAM 関連訴訟。
  • 競合噂:Claude Fable 5.1 は8月噂、未確認。

リリース日・価格・訴訟状況は公開後に変わる可能性があります。以下の一次情報を優先してください。

xAI 公式 API ドキュメント:

xAI — Models and API reference

Elon Musk の @rauchg への返信に関する第三者報道:

Tron Weekly — Elon Musk Targets August 7 For Grok 4.6

Guillermo Rauch(@rauchg)のスレッド起点:

X — Guillermo Rauch profile

FAQ

Grok 4.6 はいつリリースされますか?

2026年7月28日、Musk 氏は @rauchg に対しおおよそ8月7日と回答しました。未検証のベンダー主張への慎重姿勢も述べられているため、公式ロールアウトの確認後に切り替えるべきです。

Grok 4.6 と 4.5 の違いは?

4.5 は7月8日に coding/agentic・Cursor 共学・500K・$2/$6 で登場。4.6 は約1.5T と SFT/RL 強化が中心とされています。

4.7 は待つべきですか?

4.7 は約2.1T で性能は上がるが serving が遅いとの発言があります。リアルタイムエージェントは 4.6、バッチ評価は 4.7 と役割分担が現実的です。

Kimi K3 とどちらを選ぶべきですか?

K3 は 2.8T open weight・1M コンテキスト・Frontend Code Arena 1679。Grok は閉源 API で Cursor 共学実績があります。同一タスクでの side-by-side が必要です。

規制ニュースは採用に影響しますか?

CSAM 訴訟と Pacing the Frontier 書簡はコンプライアンス審査を強化する文脈です。データ経路とフォールバックを文書化してください。

実務上の限界は Grok でも同じです。8月7日を信じて本番を先に切り替えるより、4.5 ベースライン・K3 との比較ログ・OpenRouter フォールバックを揃えたうえで 4.6 を試す方が安全です。その評価は共有サンドボックスより、root 付きの専用マシン向きです。KVMFLUX の Mac mini M4 は SSH 数分で立ち上がり、API キーやモデル ID が夜間に変わっても wipe してやり直せます。

Grok 4.6 をクリーンな Mac で試す

xAI API と Cursor 連携を一台の Apple Silicon から — VM オーバーヘッドなし。

Mac Mini M4 · 16GB / 256GB
日額$19.3 /日
週額$52.2 /週
月額$96.7 /月
四半期$263 /四半期