8月7日目標の前に押さえる五つの摩擦
Musk 氏の返信はロードマップの手がかりですが、本番切り替えには別レイヤーの判断が重なります。
- スケジュールの未検証性:Musk 氏はベンダー側の未検証リリース主張に対して時間軸に慎重であると過去に述べています。8月7日は目標であり、コミットではありません。
- 4.5 からの差分が限定的:Grok 4.6 の主眼は SFT/RL アップグレードと 1.5T 規模です。coding パイプラインは7月8日の 4.5 で既に強化済みで、4.6 は品質の微調整か serving コストの再配分になる可能性があります。
- 4.7 の serving トレードオフ:2.1T の Grok 4.7 は「より良いが serving が遅い」との発言があり、latency 敏感なエージェントは 4.6 を長く使う選択肢もあります。
- 競合の同時進行:Kimi K3 の 1M コンテキスト open weight と、8月噂の Claude Fable 5.1(未確認)が同ウィンドウに重なり、単一ベンダーへの固定はリスクです。
- 規制と訴訟ノイズ:7月の xAI CSAM 関連訴訟と、7月28日の「Pacing the Frontier」公開書簡(1100名超署名)が、フロンティアモデル採用の社内審査を複雑化しています。
Grok 4.5・4.6・Kimi K3 — 仕様と価格の比較
7月8日の Grok 4.5 は実運用の基準点です。4.6 はその上に積まれる層として読むと、評価計画が明確になります。
| 項目 | Grok 4.5(7月8日) | Grok 4.6(Musk 7月28日) | Kimi K3(7月16〜26日) |
|---|---|---|---|
| パラメータ規模 | 公表値は限定的 | 約 1.5T | 2.8T MoE open weight |
| 主な強化点 | coding/agentic、Cursor 共学 | SFT/RL アップグレード | 1M コンテキスト、MoonEP 等 Infra |
| コンテキスト | 500,000 tokens | 未公表(4.5 継承か要確認) | 1,000,000 tokens |
| API 価格(per M tokens) | $2 入力 / $6 出力 | 未公表 | API ティア別(別記事参照) |
| Frontend Code Arena | — | — | 1679 |
| 重みダウンロード | 不可 | 不可(想定) | 可(7月27日) |
| 想定リリース | 2026年7月8日(済) | 約 2026年8月7日 | API 7月16日、重み 7月27日 |
Grok 4.6 と 4.7 — ロードマップ上の位置づけ
Musk 氏は単発の 4.6 ではなく、短期に二段の投入を示唆しています。
| バージョン | 時期(Musk 発言) | 規模 | トレードオフ |
|---|---|---|---|
| Grok 4.6 | 約 8月7日 | 約 1.5T | SFT/RL 強化、比較的 serving 現実的 |
| Grok 4.7 | 4.6 の数週間後 | 約 2.1T | 性能向上、serving 遅延 |
| Claude Fable 5.1 | 8月噂(未確認) | 非公表 | Anthropic 公式未発表 |
latency と品質の二軸でモデル ID を分け、OpenRouter のフォールバックチェーンに両方を登録する設計が現実的です。
Grok 4.6 投入前の開発者向け6ステップ
スケジュール投稿はデプロイ計画ではありません。隔離環境で同じチェックリストを回してください。
- 現行 4.5 ベースラインを固定:本番相当の coding/agentic タスクを Grok 4.5 で実行し、トークン数・latency・合格率をログに残します。4.6 比較の基準がないと差分は測れません。
- モデル ID と価格ティアを監視:xAI コンソールと
docs.x.aiの changelog を購読し、4.6 切り替え時の入出力単価が 4.5 の $2/$6 per M tokens から変わるか確認します。
from openai import OpenAI
client = OpenAI(
api_key="...",
base_url="https://api.x.ai/v1",
)
resp = client.chat.completions.create(
model="grok-4-5",
messages=[{"role": "user", "content": "Refactor this handler for testability."}],
)
print(resp.usage)
- コンテキスト上限を再検証:4.5 の 500K コンテキストで長文リポジトリを通したうえで、4.6 公開後に同じプロンプトを再実行し、truncation やコスト跳ねを比較します。
- Kimi K3 と side-by-side:同一タスクを Kimi K3(Frontend Code Arena 1679 文脈の UI/coding 系)で走らせ、open weight フォールバックの価値を数値化します。
- 規制・訴訟リスクを法務と同期:xAI CSAM 訴訟と Pacing the Frontier 書簡を踏まえ、顧客データが xAI 経由で渡るワークフローに追加審査が必要か判断します。
- 4.7 用の latency 予算を先に決める:2.1T・serving 遅延が許容できないパスは 4.6 に固定し、バッチ評価のみ 4.7 に回す二層構成を設計します。
Musk 氏の時間軸は過去に前倒し・後ろ倒しがあり、ベンダー未検証の主張には慎重です。8月7日をハードデッドラインにせず、API でモデルが実際に切り替わった時点で本番を更新してください。
引用に値する数値と出来事
- Grok 4.6:約 8月7日、約 1.5T、SFT/RL アップグレード(Musk、2026年7月28日、@rauchg への X 返信)。
- Grok 4.7:4.6 の数週間後、約 2.1T、性能向上、serving 遅延(同上)。
- Grok 4.5:2026年7月8日、coding/agentic、Cursor 共学、500K コンテキスト、$2/$6 per M tokens。
- Kimi K3:7月16〜26日、2.8T MoE open weight、1M コンテキスト、Frontend Code Arena 1679。
- 規制:7月28日 Pacing the Frontier 公開書簡(1100名超署名);2026年7月 xAI CSAM 関連訴訟。
- 競合噂:Claude Fable 5.1 は8月噂、未確認。
リリース日・価格・訴訟状況は公開後に変わる可能性があります。以下の一次情報を優先してください。
xAI 公式 API ドキュメント:
xAI — Models and API reference
Elon Musk の @rauchg への返信に関する第三者報道:
Tron Weekly — Elon Musk Targets August 7 For Grok 4.6
Guillermo Rauch(@rauchg)のスレッド起点:
FAQ
Grok 4.6 はいつリリースされますか?
2026年7月28日、Musk 氏は @rauchg に対しおおよそ8月7日と回答しました。未検証のベンダー主張への慎重姿勢も述べられているため、公式ロールアウトの確認後に切り替えるべきです。
Grok 4.6 と 4.5 の違いは?
4.5 は7月8日に coding/agentic・Cursor 共学・500K・$2/$6 で登場。4.6 は約1.5T と SFT/RL 強化が中心とされています。
4.7 は待つべきですか?
4.7 は約2.1T で性能は上がるが serving が遅いとの発言があります。リアルタイムエージェントは 4.6、バッチ評価は 4.7 と役割分担が現実的です。
Kimi K3 とどちらを選ぶべきですか?
K3 は 2.8T open weight・1M コンテキスト・Frontend Code Arena 1679。Grok は閉源 API で Cursor 共学実績があります。同一タスクでの side-by-side が必要です。
規制ニュースは採用に影響しますか?
CSAM 訴訟と Pacing the Frontier 書簡はコンプライアンス審査を強化する文脈です。データ経路とフォールバックを文書化してください。
実務上の限界は Grok でも同じです。8月7日を信じて本番を先に切り替えるより、4.5 ベースライン・K3 との比較ログ・OpenRouter フォールバックを揃えたうえで 4.6 を試す方が安全です。その評価は共有サンドボックスより、root 付きの専用マシン向きです。KVMFLUX の Mac mini M4 は SSH 数分で立ち上がり、API キーやモデル ID が夜間に変わっても wipe してやり直せます。
Grok 4.6 をクリーンな Mac で試す
xAI API と Cursor 連携を一台の Apple Silicon から — VM オーバーヘッドなし。