1.5Tパラメータ · SFT/RLポストトレーニング · Grok 4.7ロードマップ · Kimi K3競争圧力 · Musk timeのゆとり
イーロン・マスク氏は7月28日、X上でVercel CEO Guillermo Rauchへの返信の中で、xAIが8月7日前後に1.5兆パラメータのGrok 4.6をリリースし、数週間以内に2.1兆パラメータのGrok 4.7も続くと明かしました。Grok 4.5の公開からわずか1か月というペースは、xAIがこの夏に3つのフロンティアモデルを連続投入する計画を示しています。Agentプログラミングスタックの評価や次世代API料金の見極めを検討中の方に向け、本稿では完全なタイムライン、Grokシリーズの核心データ表、競合横断比較、SFT/RLアップグレードの解説、論点の整理、公開前6ステップRunbookをお届けします。公式ベンチマークと料金はまだ未発表のため、以下の情報にはすべて出所のレベルを付記しています。データ基準日:2026-07-30
Grok 4.6の予告は単独イベントではなく、2026年7月の大規模モデル公開ラッシュの中に位置づけられています。マスク氏のロードマップを理解するうえで、以下のタイムラインが重要な文脈となります。
| 日付 | イベント |
|---|---|
| 2026年7月8日 | xAIがGrok 4.5を正式リリース。「プログラミングとAgenticタスク向け」に位置づけ、Cursorと共同訓練し実開発者セッションデータを使用。50万トークンのコンテキスト、100万トークンあたり入力$2/出力$6 |
| 2026年7月16日 | 競合Moonshot AI(月之暗面)のKimi K3がホスト型サービスとして提供開始 |
| 2026年7月26日 | Kimi K3が1日早く完全オープンウェイトを公開。2.8兆パラメータ、100万トークンコンテキストで、オープンウェイトモデルの規模と能力を新たな高みへ押し上げた |
| 2026年7月28日 | マスク氏がRauch氏への返信でGrok 4.6と4.7のロードマップとおおよそのスケジュールを初公開——本稿の主要情報源 |
| 約2026年8月7日(目標) | Grok 4.6リリース予定。1.5兆パラメータ、単純なパラメータ増加ではなくSFTとRLの強化が重点 |
| 約2026年8月末〜9月初旬(推定) | Grok 4.7が続く見込み。2.1兆パラメータ。マスク氏は「推論速度はやや遅いが、それ以外は4.6を上回り、トークン効率もさらに高い」と述べている |
注意が必要なのは、マスク氏のスケジュールには歴史的にゆとりがある点です。業界では「Musk time」と呼ばれ、実際の公開が予告より数日から2週間遅れることも珍しくありません。リリース前はxAI公式アカウントまたは公式サイトの発表を基準にしてください。
Grok 4.6予告をめぐる、よくある5つの認識の盲点は以下のとおりです。
X投稿を公式リリースと同一視する:現時点の唯一の情報源はマスク氏のX上の返信投稿であり、xAI公式ブログや製品ページには未掲載です。仕様と日付は変更される可能性があります。
「Musk time」のゆとりを軽視する:xAI、Tesla、SpaceXの過去のスケジュールは数日から数週間の延期が常態化しています。「8月7日前後」は目標値であり、確約ではありません。
パラメータ規模を能力向上と直結させる:マスク氏は4.6の強化点がSFTとRLのポストトレーニングにあると強調しており、単純な規模拡大ではないと述べています。4.7はより大きい一方「推論はやや遅い」とされています。
Kimi K3がもたらす競争背景を見落とす:Grok 4.6の目標日はK3完全オープンから約10日後に設定されており、xAIのリリース加速は業界競争の激化と直結しています。
業界の「減速」呼びかけとxAIの加速を混同する:7月28日同日、OpenAI、Anthropicなど1,200名超の従業員が「Pacing the Frontier」公開書簡に署名しましたが、xAIは署名者リストに含まれていません。
| モデル | 公開/目標時期 | パラメータ規模 | 位置づけ | ステータス |
|---|---|---|---|---|
| Grok 4.3 Beta | 2026年4月17日 | 未公開 | 前世代ベースライン | リリース済み |
| Grok 4.5 | 2026年7月8日 | 未公開(非MoE単一SKU) | プログラミングとAgenticタスク、Cursor共同訓練 | リリース済み |
| Grok 4.6 | 約2026年8月7日 | 1.5兆 | SFT/RL大幅アップグレード | 公式予告、未リリース |
| Grok 4.7 | 約2026年8月末〜9月初旬 | 2.1兆 | 4.6を全面上回る、トークン効率向上 | 公式予告、未リリース |
注:パラメータ規模、料金、ベンチマークスコアはいずれもベンダー/マスク氏の自己申告です。Grok 4.6と4.7には第三者による独立評価データがなく、表中の「公式予告」情報は正式リリースを必ずご確認ください。
| モデル | ベンダー | パラメータ規模 | コンテキスト | 料金(入力/出力、100万トークン) | 主要データ出所 |
|---|---|---|---|---|---|
| Grok 4.5 | xAI | 未公開 | 50万トークン | $2 / $6 | xAI公式発表 |
| Grok 4.6(予告) | xAI | 1.5兆 | 未公開 | 未公開 | マスク氏X投稿(第三者未検証) |
| Kimi K3 | Moonshot AI | 2.8兆(MoE、約16/896エキスパート活性化) | 100万トークン | 入力$0.30(キャッシュヒット)/$3(ミス)、出力$15 | Moonshot公式 + Hugging Face |
| Claude Fable 5.1(噂) | Anthropic | 未公開 | 未公開 | Fable 5据え置きの噂(入力$10/出力$50) | 36kr、WinCentralリーク、Anthropic未確認 |
| GPT-5.6 Sol | OpenAI | 未公開 | 未公開 | 未公開 | OpenAI公式発表 |
Grok 4.6とClaude Fable 5.1のデータは予告または噂に基づくものであり、正式なベンチマーク比較にはなりません。リリースペースとおおよその位置づけの参考としてご利用ください。詳細はGrok 4.5徹底レビューとKimi K3オープンウェイト解説をご参照ください。
マスク氏はGrok 4.6の強化点が「SFT & RL」、すなわちパラメータ規模そのものではないと強調しています。これはGrok 4.5がCursorとの共同訓練で実開発者セッションデータを取得し、出力トークン消費を抑えながらTerminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%を達成したアプローチの延長線上にあります。
AI開発者、技術意思決定者、Agentエンジニアのいずれであっても、Grok 4.6が正式に登場する前に以下の6ステップで独自の判断枠組みを構築し、煽りタイトルに左右されないようにできます。
情報源のレベルを切り分ける:「マスク氏のX投稿」と「xAI公式ブログ/モデルカード」を区別してください。現時点で4.6に存在するのは前者のみです。公式発表前の仕様はすべて「予告/未検証」とラベル付けするのが適切です。
Musk timeのゆとりを見込む:「8月7日前後」は目標区間であり、ハードデッドラインではありません。選定と予算計画では1〜2週間の延期バッファを確保してください。
Grok 4.5を能力の基準錨にする:4.5には完全なモデルカードと15項目のベンチマーク(Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%、料金$2/$6)があります。4.6への切り替え判断はパラメータ数字だけでなく、4.5との比較で行ってください。
Kimi K3とFable 5.1噂を横断比較する:K3はFrontend Code Arenaで1679点トップ、Artificial Analysisインテリジェンス指数で世界3位です。Fable 5.1は8月リリースの噂があります。三者の位置づけは異なり、現時点では直接対決比較はできません。
SFT/RLアップグレードの実務的意味を理解する:教師あり微調整(SFT)は高品質サンプルで出力習慣を矯正し、強化学習(RL)は報酬信号で多段階Agentタスクの正しい手順を学ばせます。公開後も4.5のトークン効率優位(SWE-Bench Proで出力約1.9万トークン vs Opus 4.8約6.7万トークン)が継続するかを注視してください。
公開ウィンドウ内のハイブリッドルーティング戦略を設計する:Grok 4.5の展開経路から推測すると、4.6はGrok Build、xAI API、Cursorが先行する可能性が高いです。正式料金が出るまでは「日常サブタスクはGrok、高精度アーキテクチャ判断はClaude」という混合戦略を維持し、未検証モデルへの全面移行は避けてください。
教師あり微調整(SFT)は、人手アノテーションまたは厳選された高品質サンプルでモデルの出力習慣を矯正します。強化学習(RL)は報酬信号を用い、実タスクのチェーンの中で「正しい手順」を学ばせます。特に多段階のAgenticタスクで効果を発揮します。マスク氏がGrok 4.6の強化点を「SFT & RL」、パラメータ規模そのものではないと強調したのは、Grok 4.5の延長線上にあります。Grok 4.5はCursorとの共同訓練で実開発者セッションデータを取得し、出力トークン消費を抑えながらTerminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%を達成しました。同種タスクの出力トークン数はClaude Opus 4.8(約1.9万トークン対6.7万トークン)を大きく下回っています。
Grok 4.6の1.5兆パラメータはGrok 4.5に比べ明確な規模の飛躍ですが、マスク氏は「パラメータが唯一の変数ではない」とも述べています。Grok 4.7は2.1兆とより大きい一方「推論はやや遅い」とされ、xAI内部では規模と推論速度のトレードオフを認識していることが示唆されます。将来は「より強い」と「より速い」の2 SKUで異なるニーズに応える方針と見られ、1モデルですべてをカバーする設計ではない可能性があります。
Grok 4.6のリリース目標は、Kimi K3の完全オープンウェイト公開が業界に衝撃を与えてから約10日後に設定されています。Kimi K3はFrontend Code Arenaプログラミングランキングで1679点トップとなり、すべてのクローズドモデルを上回った初のオープンウェイトモデルです。Artificial Analysisインテリジェンス指数でも世界3位にランクインしました。マスク氏自身もKimi K3関連のベンチマーク投稿に「印象的」とコメントしています。業界では、xAIがGrok 4.6/4.7のリリースペースを加速させている背景に、OpenAI、Anthropic、中国ベンダーとの競争激化があると広く解釈されています。
論点一:スケジュールは第三者未検証。現時点の唯一の情報源はマスク氏のX上の返信投稿であり、xAI公式ブログと製品ページには未掲載です。実際の日付は前倒しまたは延期される可能性があります。
論点二:ベンチマークと料金がすべて空白。Grok 4.5公開時には詳細なモデルカードとベンチマーク表がありましたが、Grok 4.6には独立評価も公式モデルカードもありません。「1.5兆パラメータ」「SFT/RL大幅アップグレード」は現時点ではベンダー側の一方的な主張です。
背景:xAIのコンテンツ安全に関する論争。Grok 4.6予告の直前、xAIは7月に1名のユーザーに対し、Grokの安全制限を迂回して児童性的虐待素材(CSAM)を生成したとして訴訟を提起しました。AI生成ディープフェイクに関する同社初のユーザー訴訟です。今年1月、Common Sense Mediaの報告書はGrokを「未成年保護が最も不十分なAI製品の一つ」と評価しています。これらはモデル自体の技術能力評価には直接影響しませんが、急速なイテレーション下での安全・コンプライアンス投資という観点では注目に値します。
背景:業界の「減速」と「加速」の分裂。7月28日——マスク氏がGrok 4.6/4.7ロードマップを公開した同日——OpenAI、Anthropicなど1,200名超の従業員が「Pacing the Frontier」公開書簡に署名し、米国政府にフロンティアAI開発の意図的な減速を促すガバナンスツールの整備を求めました。OpenAIとAnthropicは会社として正式に支持しています。xAIは署名者リストに含まれていません。
マスク氏のスケジュールが成立すれば、Grok 4.6とGrok 4.7は噂のClaude Fable 5.1と同月に相次いで登場し、7月にオープンソース化されたKimi K3の衝撃も加わり、2026年8月は大規模モデル公開密度が最も高い月の一つになる可能性があります。開発者と企業ユーザーにとっては選定ウィンドウが極めて短く、前世代フラッグシップが公開1か月後には次世代競合と対峙する状況も想定されます。コストパフォーマンスとトークン効率(単純なパラメータ規模やスコアだけでなく)が、より実務的な判断基準となるでしょう。
ローカルでマルチモデルAPI切り替え、Agentオーケストレーションパイプライン、Grok/Cursor共同開発ワークフローを追跡する場合、ノートPCではプロセス不安定、24時間常駐不可、コンパイル負荷のボトルネックに直面しがちです。自前VPSではApple Siliconエコシステムの欠如とMetalコンパイルチェーンの非対応も課題です。安定した分離環境、iOS CI/CDとAI Agent自動化に適した本番シーンでは、VpsMeshのMac Mini M4クラウドレンタルが通常はより適した選択です。統一メモリは大コンテキストAgentオーケストレーションに適し、リモートノードが24時間マルチモデルルーティングテストを担い、本機環境を汚染しません。詳細はMac Mini M4レンタル料金をご確認ください。
マスク氏は「8月7日前後」と述べていますが、これは非公式の発言であり、xAIが公式に確認した日付ではありません。実際の時期は前倒しまたは延期される可能性があります。xAI公式Xアカウントとx.aiの発表をご確認ください。
Grok 4.6は1.5兆パラメータで、SFTとRLのポストトレーニング強化が重点です。Grok 4.7は2.1兆パラメータで、4.6リリースから数週間以内に続く見込みです。マスク氏は4.6を上回る能力を持つ一方、推論速度はやや遅く、トークン効率はさらに高いと述べています。xAIは「より速い」と「より強い」の2 SKU二層戦略を構築していると見られます。
現時点では判断できません。Grok 4.6には公開ベンチマークがなく、Kimi K3は実測データがあり一部のコーディングランキングで好成績を示しています。Claude Fable 5.1はAnthropicによる公式発表もありません。三者を直接比較することはできません。競合の現状はKimi K3オープンウェイト解説をご参照ください。
公式には未発表です。Grok 4.5の料金(入力$2/出力$6、100万トークンあたり)をおおよその目安にできますが、新世代モデルでは調整される可能性があります。正式発表を必ずご確認ください。Agentテスト環境のコスト評価にはヘルプセンターもご参照ください。
Grok 4.5の展開経路から推測すると、Grok Build、xAI公式API、コンソールが先行し、その後Cursorなどサードパーティプラットフォームへ段階的に展開される可能性が高いです。具体的な入口は正式発表を待つ必要があります。