2026 年夏末のフロンティアモデル API 選定を検討しているなら、Grok 4.6 のスケジュールは単独で注視する価値があります。マスクは 7 月 28 日、X で Vercel CEO のギレルモ・ラウチに返信する形で、xAI が 8 月 7 日前後に 1.5 兆パラメータの Grok 4.6 を公開し、その数週間後に 2.1 兆パラメータの Grok 4.7 も投入する旨を示しました——ただし xAI 公式はベンチマークスコアと価格をまだ公表していません。本記事では、タイムライン、コアデータ、SFT/RL 強化の論理、競合比較、論点の五軸で整理し、「マスクの一言」レベルの未確認情報を明示します。

開発者が今 Grok 4.6 スケジュールを気にすべき理由

一見は大手の PR に見えますが、現場のエンジニアリングチームには三つの直接的な含意があります。

  • 選定ウィンドウの圧縮:Grok 4.5 は 7 月 8 日に公開されたばかりです。8 月 7 日に Grok 4.6 が続けば、フラッグシップモデルの「有効な棚卸期間」はわずか一か月程度になる可能性があります。7 月の Hugging Face 侵害と GPT-6 規制競争が重なると、マルチモデルオーケストレーションのコストモデルは月次で組み直す必要が出ます。
  • 情報源が極端に単一:現時点で Grok 4.6/4.7 のパラメータ規模や SFT/RL の強化幅は、マスクの X 返信一つに依存しています。付随するモデルカードはありません——Grok 4.5 公開時に 15 項目のベンチマークを同時公開したやり方とは対照的です。統合前には「日程のずれ+仕様変更」のバッファを確保すべきです。
  • オープンソースの衝撃は既に着地:Kimi K3 は 7 月 26 日に 2.8 兆の重みを完全オープンソース化し、Frontend Code Arena プログラミングランキングで 1679 点のトップに立ちました。xAI が Musk time のペースで三つのフロンティアモデルを連続投入すれば、競争の焦点は「パラメータ規模」からトークン効率とエージェント向け後学習品質へ移ります。

先に境界を示します。以下の Grok 4.6/4.7 の日程とパラメータは、マスク 7 月 28 日の X 投稿に由来し、xAI 公式ブログと製品ページはまだ同期していません。業界でいう「Musk time」は、実際の公開が予告より数日から二週間遅れることを意味します——公開前は xAI 公式チャネルを基準にしてください。

タイムライン:Grok 4.5 から 4.6、4.7 まで、どれほど速いか

日付出来事
2026年7月8日xAI が Grok 4.5 を正式公開。コーディングとエージェントタスク向けフラッグシップとして位置づけ、Cursor と協業し実開発者セッションデータで学習。50 万トークンコンテキスト、価格は百万トークンあたり入力 2 ドル/出力 6 ドル
2026年7月16日Moonshot AI の Kimi K3 がホスト型サービスとしてローンチ
2026年7月26日Kimi K3 が予定より一日早く完全オープンウェイトを公開。2.8 兆パラメータ、100 万トークンコンテキスト
2026年7月28日マスクがラウチへの返信で Grok 4.6 と 4.7 のロードマップとおおよその日程を初公開。同日、OpenAI・Anthropic など 1,200 名超の従業員が「Pacing the Frontier」公開書簡に連署
約2026年8月7日(目標)Grok 4.6 公開予定。1.5 兆パラメータ、SFT と RL レイヤーの強化が重点
約2026年8月末〜9月初旬(推定)Grok 4.7 が続く予定。2.1 兆パラメータ。マスクは推論速度はやや遅いものの 4.6 を全面的に上回り、トークン効率も高いと述べています

コアデータ一覧と競合横断比較

下表は Grok シリーズと同期競合の既知仕様をまとめたものです。Grok 4.6 と Claude Fable 5.1 の行は予告または噂に基づき、正式なベンチマーク比較ではありません。

モデル公開/目標時期パラメータ規模コンテキスト価格(入力/出力、百万トークンあたり)状態
Grok 4.52026年7月8日未公開50 万トークン$2 / $6公開済み
Grok 4.6(予告)約8月7日1.5 兆未公開未公開公式予告、未公開
Grok 4.7(予告)約8月末〜9月初旬2.1 兆未公開未公開公式予告、未公開
Kimi K32026年7月26日オープンソース2.8 兆(MoE)100 万トークン$0.30(キャッシュヒット)/$3(非ヒット)入力、$15 出力公開済み
Claude Fable 5.1(噂)噂では8月未公開未公開噂では Fable 5 維持($10/$50)Anthropic 未確認
GPT-5.6 Sol公開済み未公開未公開未公開公開済み

深掘り:アップグレードの焦点は「より大きい」ではなく「より学ぶ」

教師あり微調整(SFT)は、人手ラベルや厳選された高品質サンプルでモデルの出力習慣を矯正します。強化学習(RL)は報酬信号を使い、多段階エージェントタスクで正しいアクション列を学ばせます。マスクは Grok 4.6 の強化重点を単なるパラメータ積み上げではなく「SFT & RL」にあると強調しています——これは Grok 4.5 の方針の延長です。Grok 4.5 は Cursor との協業による実開発者セッション後学習により、Terminal-Bench 2.1 で 83.3%、SWE-Bench Pro で 64.7% を記録し、同種タスクの出力トークンは約 1.9 万と、Claude Opus 4.8 の約 6.7 万を大きく下回りました。

Grok 4.6 の 1.5 兆パラメータは明確な規模の飛躍ですが、マスクが Grok 4.7 について述べた「より大きい(2.1 兆)が推論はやや遅い」という表現は、xAI が「より強い」と「より速い」で異なる SKU を分け、一つのモデルですべてを賄わない意図を示唆します。Grok 4.6 の目標日は Kimi K3 の完全オープンソースから約 10 日後です。マスクは Kimi K3 の評価投稿に「印象的」とコメントしており、業界では xAI のペース加速が OpenAI・Anthropic・中国勢との競争激化と直結していると広く解釈されています。

公開前に開発者が実行できる五つの確認チェックリスト

Grok 4.6 の正式なモデルカードが出る前に、以下の手順で統合リスクを管理し、「予告パラメータ」を本番依存に書き込まないようにしてください。

  1. 情報源の階層を固定する:マスクの X 投稿は「方向性の予告」、Grok 4.5 公式モデルカードと xAI プレスリリースは「検証済みベースライン」として分け、SLA やコスト試算に混在させない。
  2. 日程バッファを設定する:Musk time の慣例どおり 8 月 7 日目標に 7〜14 日のずれを上乗せし、重要なリリース経路には Grok 4.5 または Kimi K3 のフォールバックを用意する。
  3. ベンチマークだけでなくトークン効率を再計算する:Grok 4.5 の強みはエージェントタスクでの出力トークン削減です。4.6 が同経路を踏めば、「知能指数は高いが出力が長い」モデルより API 請求が安くなる可能性があります——タスクあたりのトークンは公式開示を待ってから判断する。
  4. 評価環境を隔離する:新モデルプレビュー期は共有サンドボックスやローカルベンチマークが多く、状態汚染と認証情報残留のリスクが上がります。機密エージェントチェーンはリセット可能な隔離ハードウェアで検証する。
  5. 8 月の集中公開を追跡する:噂では Claude Fable 5.1 も 8 月を指しており、Grok 4.6/4.7 と同月に並ぶ場合、比較評価は同一プロンプトセットと同一ハードウェア環境で固定し、週をまたいだ結果の非比較を避ける。

論点と注意すべき細部

  • スケジュールは第三者未検証:唯一の情報源はマスクの X 返信であり、xAI 公式はまだ同期していません。日程は前倒し・後ろ倒しのいずれもあり得ます。
  • ベンチマークと価格はすべて空白:Grok 4.5 公開時の詳細モデルカードとは対照的に、Grok 4.6 には独立した評価や公式モデルカードがありません。
  • xAI のコンテンツ安全に関する論争:7 月、xAI はユーザーが Grok の安全制限を迂回して CSAM を生成した疑いで訴訟を起こしました——AI 生成ディープフェイクに関する同社初のユーザー訴訟です。Common Sense Media の 1 月報告は Grok を未成年保護で最も劣る AI 製品の一つと評価しています——技術能力の評価とは別軸ですが、企業のセキュリティ・コンプライアンス投資には触れます。
  • 業界の「減速」呼びかけとのずれ:7 月 28 日にマスクがロードマップを出した同日、OpenAI と Anthropic は会社名義で「Pacing the Frontier」公開書簡を後押ししました。xAI は署名者に含まれておらず、「減速を訴えつつ加速する」業界分裂は引き続き観察に値します。

引用可能なコアデータと出典

  • Grok 4.6 目標日:約 2026 年 8 月 7 日——マスク 7 月 28 日の X 返信 @rauchg。xAI 公式公告ではありません。
  • Grok 4.6 パラメータ規模:1.5 兆——同上の単一 SNS 投稿。第三者未検証。
  • Grok 4.5 価格:百万トークンあたり入力 $2、出力 $6。コンテキスト 50 万トークン——xAI 公式「Introducing Grok 4.5」とモデルカード。
  • Grok 4.5 エージェントベンチマーク:Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%。出力トークン効率は Opus 4.8 を上回る——xAI モデルカードと第三者整理(eesel.ai、felloai.com など)。

パラメータ、価格、ベンチマークは正式公開で変わる可能性があります。公式ページを基準にしてください。検証可能な出典は以下です。

xAI 公式ブログ「Introducing Grok 4.5」

xAI Grok 4.5 公式モデルカード(media.x.ai)

Moonshot AI Kimi K3 オープンソースリポジトリ(GitHub)

The Verge(Pacing the Frontier 公開書簡の報道)

よくある質問

Grok 4.6 は具体的にいつリリースされますか?

マスクは「おおよそ 8 月 7 日」と述べていますが、これは非公式な発言であり xAI 公式が確認した公開日ではありません。実際の時期は前後する可能性があります。

Grok 4.6 と Grok 4.7 の違いは何ですか?

Grok 4.6 は 1.5 兆パラメータで、SFT と RL の後学習強化が重点です。Grok 4.7 は 2.1 兆パラメータで、4.6 公開の数週間後に続く見込みです。マスクは能力は 4.6 を全面的に上回るが推論速度はやや遅く、トークン効率は高いと述べています。

Grok 4.6 は Kimi K3 や Claude Fable 5.1 より強くなりますか?

現時点では判断できません。Grok 4.6 には公開ベンチマークがなく、Kimi K3 は実測データがあり一部プログラミングランキングで突出しています。Claude Fable 5.1 は Anthropic が公式確認していません。三者の直接比較はまだ不可能です。

Grok 4.6 の価格はどのくらいになりそうですか?

公式は未発表です。Grok 4.5 の価格(入力 $2/出力 $6、百万トークンあたり)をおおよその目安にできますが、新世代では調整される可能性があります。正式発表を必ず基準にしてください。

一般ユーザーはどこで Grok 4.6 を使えるようになりますか?

Grok 4.5 の配布経路から推測すると、まず Grok Build、xAI 公式 API とコンソールに載り、その後サードパーティへ段階的に広がる可能性が高いです。具体的な入口は正式公告を待つ必要があります。

フロンティアモデルの公開密度が上がるほど、ローカルや共有環境でマルチモデルエージェント評価を回す際の状態汚染、認証情報残留、意図しない横方向移動のリスクも増します。モデルを変えるたびに環境を組み直すのは時間がかかり再現も難しくなります。Grok とオープンソースモデルの比較テストを隔離するため、いつでもリセット可能でマシン専有、SSH と VNC の二経路アクセスが使える Apple Silicon 物理ホストが必要なら、VMSPIN の日額クラウド Mac miniがより堅実な選択肢です。長期のコンピューティングコストは購入 vs レンタルの損益分岐点試算も参照してください。Grok 4.6 が 8 月 7 日に着地するかは未確定ですが、実験環境までスケジュールに賭ける必要はありません。