Grok 4.6のリリース日はいつ?マスク氏が8月7日を予告、1.5兆パラメータへ

1.5Tパラメータ · SFT/RLポストトレーニング · Grok 4.7ロードマップ · Kimi K3競争圧力 · Musk timeのゆとり

Grok 4.6リリース予告とxAIロードマップ解説

イーロン・マスク氏は7月28日、X上でVercel CEO Guillermo Rauchへの返信の中で、xAIが8月7日前後に1.5兆パラメータのGrok 4.6をリリースし、数週間以内に2.1兆パラメータのGrok 4.7も続くと明かしました。Grok 4.5の公開からわずか1か月というペースは、xAIがこの夏に3つのフロンティアモデルを連続投入する計画を示しています。Agentプログラミングスタックの評価や次世代API料金の見極めを検討中の方に向け、本稿では完全なタイムライン、Grokシリーズの核心データ表、競合横断比較、SFT/RLアップグレードの解説、論点の整理、公開前6ステップRunbookをお届けします。公式ベンチマークと料金はまだ未発表のため、以下の情報にはすべて出所のレベルを付記しています。データ基準日:2026-07-30

01

Grok 4.5から4.6・4.7へ:リリースペースはどれほど速いのか

Grok 4.6の予告は単独イベントではなく、2026年7月の大規模モデル公開ラッシュの中に位置づけられています。マスク氏のロードマップを理解するうえで、以下のタイムラインが重要な文脈となります。

日付イベント
2026年7月8日xAIがGrok 4.5を正式リリース。「プログラミングとAgenticタスク向け」に位置づけ、Cursorと共同訓練し実開発者セッションデータを使用。50万トークンのコンテキスト、100万トークンあたり入力$2/出力$6
2026年7月16日競合Moonshot AI(月之暗面)のKimi K3がホスト型サービスとして提供開始
2026年7月26日Kimi K3が1日早く完全オープンウェイトを公開。2.8兆パラメータ、100万トークンコンテキストで、オープンウェイトモデルの規模と能力を新たな高みへ押し上げた
2026年7月28日マスク氏がRauch氏への返信でGrok 4.6と4.7のロードマップとおおよそのスケジュールを初公開——本稿の主要情報源
約2026年8月7日(目標)Grok 4.6リリース予定。1.5兆パラメータ、単純なパラメータ増加ではなくSFTとRLの強化が重点
約2026年8月末〜9月初旬(推定)Grok 4.7が続く見込み。2.1兆パラメータ。マスク氏は「推論速度はやや遅いが、それ以外は4.6を上回り、トークン効率もさらに高い」と述べている

注意が必要なのは、マスク氏のスケジュールには歴史的にゆとりがある点です。業界では「Musk time」と呼ばれ、実際の公開が予告より数日から2週間遅れることも珍しくありません。リリース前はxAI公式アカウントまたは公式サイトの発表を基準にしてください。

Grok 4.6予告をめぐる、よくある5つの認識の盲点は以下のとおりです。

  1. 01

    X投稿を公式リリースと同一視する:現時点の唯一の情報源はマスク氏のX上の返信投稿であり、xAI公式ブログや製品ページには未掲載です。仕様と日付は変更される可能性があります。

  2. 02

    「Musk time」のゆとりを軽視する:xAI、Tesla、SpaceXの過去のスケジュールは数日から数週間の延期が常態化しています。「8月7日前後」は目標値であり、確約ではありません。

  3. 03

    パラメータ規模を能力向上と直結させる:マスク氏は4.6の強化点がSFTとRLのポストトレーニングにあると強調しており、単純な規模拡大ではないと述べています。4.7はより大きい一方「推論はやや遅い」とされています。

  4. 04

    Kimi K3がもたらす競争背景を見落とす:Grok 4.6の目標日はK3完全オープンから約10日後に設定されており、xAIのリリース加速は業界競争の激化と直結しています。

  5. 05

    業界の「減速」呼びかけとxAIの加速を混同する:7月28日同日、OpenAI、Anthropicなど1,200名超の従業員が「Pacing the Frontier」公開書簡に署名しましたが、xAIは署名者リストに含まれていません。

02

核心データ一覧:Grokシリーズと同期競合の横断比較

Grokシリーズロードマップ

モデル公開/目標時期パラメータ規模位置づけステータス
Grok 4.3 Beta2026年4月17日未公開前世代ベースラインリリース済み
Grok 4.52026年7月8日未公開(非MoE単一SKU)プログラミングとAgenticタスク、Cursor共同訓練リリース済み
Grok 4.6約2026年8月7日1.5兆SFT/RL大幅アップグレード公式予告、未リリース
Grok 4.7約2026年8月末〜9月初旬2.1兆4.6を全面上回る、トークン効率向上公式予告、未リリース

注:パラメータ規模、料金、ベンチマークスコアはいずれもベンダー/マスク氏の自己申告です。Grok 4.6と4.7には第三者による独立評価データがなく、表中の「公式予告」情報は正式リリースを必ずご確認ください。

横断比較:Grokシリーズ vs 同期競合

モデルベンダーパラメータ規模コンテキスト料金(入力/出力、100万トークン)主要データ出所
Grok 4.5xAI未公開50万トークン$2 / $6xAI公式発表
Grok 4.6(予告)xAI1.5兆未公開未公開マスク氏X投稿(第三者未検証)
Kimi K3Moonshot AI2.8兆(MoE、約16/896エキスパート活性化)100万トークン入力$0.30(キャッシュヒット)/$3(ミス)、出力$15Moonshot公式 + Hugging Face
Claude Fable 5.1(噂)Anthropic未公開未公開Fable 5据え置きの噂(入力$10/出力$50)36kr、WinCentralリーク、Anthropic未確認
GPT-5.6 SolOpenAI未公開未公開未公開OpenAI公式発表

Grok 4.6とClaude Fable 5.1のデータは予告または噂に基づくものであり、正式なベンチマーク比較にはなりません。リリースペースとおおよその位置づけの参考としてご利用ください。詳細はGrok 4.5徹底レビューKimi K3オープンウェイト解説をご参照ください。

マスク氏はGrok 4.6の強化点が「SFT & RL」、すなわちパラメータ規模そのものではないと強調しています。これはGrok 4.5がCursorとの共同訓練で実開発者セッションデータを取得し、出力トークン消費を抑えながらTerminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%を達成したアプローチの延長線上にあります。

03

6ステップRunbook:Grok 4.6公開前にどう見極め・準備するか

AI開発者、技術意思決定者、Agentエンジニアのいずれであっても、Grok 4.6が正式に登場する前に以下の6ステップで独自の判断枠組みを構築し、煽りタイトルに左右されないようにできます。

  1. 01

    情報源のレベルを切り分ける:「マスク氏のX投稿」と「xAI公式ブログ/モデルカード」を区別してください。現時点で4.6に存在するのは前者のみです。公式発表前の仕様はすべて「予告/未検証」とラベル付けするのが適切です。

  2. 02

    Musk timeのゆとりを見込む:「8月7日前後」は目標区間であり、ハードデッドラインではありません。選定と予算計画では1〜2週間の延期バッファを確保してください。

  3. 03

    Grok 4.5を能力の基準錨にする:4.5には完全なモデルカードと15項目のベンチマーク(Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%、料金$2/$6)があります。4.6への切り替え判断はパラメータ数字だけでなく、4.5との比較で行ってください。

  4. 04

    Kimi K3とFable 5.1噂を横断比較する:K3はFrontend Code Arenaで1679点トップ、Artificial Analysisインテリジェンス指数で世界3位です。Fable 5.1は8月リリースの噂があります。三者の位置づけは異なり、現時点では直接対決比較はできません。

  5. 05

    SFT/RLアップグレードの実務的意味を理解する:教師あり微調整(SFT)は高品質サンプルで出力習慣を矯正し、強化学習(RL)は報酬信号で多段階Agentタスクの正しい手順を学ばせます。公開後も4.5のトークン効率優位(SWE-Bench Proで出力約1.9万トークン vs Opus 4.8約6.7万トークン)が継続するかを注視してください。

  6. 06

    公開ウィンドウ内のハイブリッドルーティング戦略を設計する:Grok 4.5の展開経路から推測すると、4.6はGrok Build、xAI API、Cursorが先行する可能性が高いです。正式料金が出るまでは「日常サブタスクはGrok、高精度アーキテクチャ判断はClaude」という混合戦略を維持し、未検証モデルへの全面移行は避けてください。

04

深掘り:SFT/RL強化、競争圧力、論点の整理

SFTとRLは何を解決するのか

教師あり微調整(SFT)は、人手アノテーションまたは厳選された高品質サンプルでモデルの出力習慣を矯正します。強化学習(RL)は報酬信号を用い、実タスクのチェーンの中で「正しい手順」を学ばせます。特に多段階のAgenticタスクで効果を発揮します。マスク氏がGrok 4.6の強化点を「SFT & RL」、パラメータ規模そのものではないと強調したのは、Grok 4.5の延長線上にあります。Grok 4.5はCursorとの共同訓練で実開発者セッションデータを取得し、出力トークン消費を抑えながらTerminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%を達成しました。同種タスクの出力トークン数はClaude Opus 4.8(約1.9万トークン対6.7万トークン)を大きく下回っています。

xAIが「パラメータ増量+ポストトレーニング精修」の二刀流を選ぶ理由

Grok 4.6の1.5兆パラメータはGrok 4.5に比べ明確な規模の飛躍ですが、マスク氏は「パラメータが唯一の変数ではない」とも述べています。Grok 4.7は2.1兆とより大きい一方「推論はやや遅い」とされ、xAI内部では規模と推論速度のトレードオフを認識していることが示唆されます。将来は「より強い」と「より速い」の2 SKUで異なるニーズに応える方針と見られ、1モデルですべてをカバーする設計ではない可能性があります。

Kimi K3との同期競争がもたらす現実的な圧力

Grok 4.6のリリース目標は、Kimi K3の完全オープンウェイト公開が業界に衝撃を与えてから約10日後に設定されています。Kimi K3はFrontend Code Arenaプログラミングランキングで1679点トップとなり、すべてのクローズドモデルを上回った初のオープンウェイトモデルです。Artificial Analysisインテリジェンス指数でも世界3位にランクインしました。マスク氏自身もKimi K3関連のベンチマーク投稿に「印象的」とコメントしています。業界では、xAIがGrok 4.6/4.7のリリースペースを加速させている背景に、OpenAI、Anthropic、中国ベンダーとの競争激化があると広く解釈されています。

!

論点一:スケジュールは第三者未検証。現時点の唯一の情報源はマスク氏のX上の返信投稿であり、xAI公式ブログと製品ページには未掲載です。実際の日付は前倒しまたは延期される可能性があります。

!

論点二:ベンチマークと料金がすべて空白。Grok 4.5公開時には詳細なモデルカードとベンチマーク表がありましたが、Grok 4.6には独立評価も公式モデルカードもありません。「1.5兆パラメータ」「SFT/RL大幅アップグレード」は現時点ではベンダー側の一方的な主張です。

背景:xAIのコンテンツ安全に関する論争。Grok 4.6予告の直前、xAIは7月に1名のユーザーに対し、Grokの安全制限を迂回して児童性的虐待素材(CSAM)を生成したとして訴訟を提起しました。AI生成ディープフェイクに関する同社初のユーザー訴訟です。今年1月、Common Sense Mediaの報告書はGrokを「未成年保護が最も不十分なAI製品の一つ」と評価しています。これらはモデル自体の技術能力評価には直接影響しませんが、急速なイテレーション下での安全・コンプライアンス投資という観点では注目に値します。

背景:業界の「減速」と「加速」の分裂。7月28日——マスク氏がGrok 4.6/4.7ロードマップを公開した同日——OpenAI、Anthropicなど1,200名超の従業員が「Pacing the Frontier」公開書簡に署名し、米国政府にフロンティアAI開発の意図的な減速を促すガバナンスツールの整備を求めました。OpenAIとAnthropicは会社として正式に支持しています。xAIは署名者リストに含まれていません。

05

引用可能な核心データと2026年8月「集中リリース月」の見立て

  • Grok 4.6パラメータ規模:マスク氏予告は1.5兆パラメータ。Grok 4.5(参数量未公開)に比べ明確な規模の飛躍ですが、独立ベンチマークによる裏付けはまだありません。
  • Grok 4.7フォローアップ:2.1兆パラメータ、4.6リリースから「数週間」以内の見込み。マスク氏は「4.6を全面上回るが推論速度はやや遅く、トークン効率はさらに高い」と述べています。
  • Grok 4.5トークン効率の基準:SWE-Bench Proタスクの平均出力は約15,954トークン(Grok 4.5)対67,020トークン(Opus 4.8)で、約4.2倍の差——4.6がこの効率優位を継続するかの重要指標です。
  • Kimi K3競争座標:2.8T MoE(約16/896エキスパート活性化)、100万トークンコンテキスト、Frontend Code Arena 1679点トップ、Artificial Analysisインテリジェンス指数世界3位。
  • Claude Fable 5.1噂のウィンドウ:36kr、WinCentralなど複数メディアが8月を指摘。AnthropicがOpenAI GPT-6より先に投入する意向との分析もありますが、公式確認はありません。
  • 3連続リリースのペース:スケジュール通りなら、xAIは約2か月でGrok 4.5、4.6、4.7の3フロンティアモデルを連続投入し、前世代フラッグシップの有効期間を圧縮します。

マスク氏のスケジュールが成立すれば、Grok 4.6とGrok 4.7は噂のClaude Fable 5.1と同月に相次いで登場し、7月にオープンソース化されたKimi K3の衝撃も加わり、2026年8月は大規模モデル公開密度が最も高い月の一つになる可能性があります。開発者と企業ユーザーにとっては選定ウィンドウが極めて短く、前世代フラッグシップが公開1か月後には次世代競合と対峙する状況も想定されます。コストパフォーマンスとトークン効率(単純なパラメータ規模やスコアだけでなく)が、より実務的な判断基準となるでしょう。

ローカルでマルチモデルAPI切り替え、Agentオーケストレーションパイプライン、Grok/Cursor共同開発ワークフローを追跡する場合、ノートPCではプロセス不安定、24時間常駐不可、コンパイル負荷のボトルネックに直面しがちです。自前VPSではApple Siliconエコシステムの欠如とMetalコンパイルチェーンの非対応も課題です。安定した分離環境、iOS CI/CDとAI Agent自動化に適した本番シーンでは、VpsMeshのMac Mini M4クラウドレンタルが通常はより適した選択です。統一メモリは大コンテキストAgentオーケストレーションに適し、リモートノードが24時間マルチモデルルーティングテストを担い、本機環境を汚染しません。詳細はMac Mini M4レンタル料金をご確認ください。

FAQ

Grok 4.6リリースに関するよくある質問

マスク氏は「8月7日前後」と述べていますが、これは非公式の発言であり、xAIが公式に確認した日付ではありません。実際の時期は前倒しまたは延期される可能性があります。xAI公式Xアカウントとx.aiの発表をご確認ください。

Grok 4.6は1.5兆パラメータで、SFTとRLのポストトレーニング強化が重点です。Grok 4.7は2.1兆パラメータで、4.6リリースから数週間以内に続く見込みです。マスク氏は4.6を上回る能力を持つ一方、推論速度はやや遅く、トークン効率はさらに高いと述べています。xAIは「より速い」と「より強い」の2 SKU二層戦略を構築していると見られます。

現時点では判断できません。Grok 4.6には公開ベンチマークがなく、Kimi K3は実測データがあり一部のコーディングランキングで好成績を示しています。Claude Fable 5.1はAnthropicによる公式発表もありません。三者を直接比較することはできません。競合の現状はKimi K3オープンウェイト解説をご参照ください。

公式には未発表です。Grok 4.5の料金(入力$2/出力$6、100万トークンあたり)をおおよその目安にできますが、新世代モデルでは調整される可能性があります。正式発表を必ずご確認ください。Agentテスト環境のコスト評価にはヘルプセンターもご参照ください。

Grok 4.5の展開経路から推測すると、Grok Build、xAI公式API、コンソールが先行し、その後Cursorなどサードパーティプラットフォームへ段階的に展開される可能性が高いです。具体的な入口は正式発表を待つ必要があります。