Grok 4.6 発売時期:マスク氏が8月7日前後・1.5兆パラメータを予告、Grok 4.7は2.1T
誰が何に困っているか?Grok 4.6の発売時期とスペックを追うMac開発者・AIエンジニアは、マスク氏のX投稿とxAI公式の差、ベンチマーク空白、Kimi K3衝撃後の選定窓の短さに直面しています。本記事で得られること:4.5→4.7のタイムライン、1.5T/2.1Tパラメータ表、SFT/RLアップグレードの意味、競合横並び比較、未確認情報の明示、8月2026の業界文脈、5段階隔離試験、FAQ×5です。
📋 目次
関連記事:Kimi K3 徹底評価(7/17)、Claude Sonnet 5 / GPT-5.6 発表まとめ、OpenRouter 7月ランキング分析。
Featured Snippet 直答
2026年7月28日、イーロン・マスク氏はVercel CEOのGuillermo Rauch氏へのX返信で、8月7日前後に1.5兆パラメータのGrok 4.6を、続く数週間で2.1兆パラメータのGrok 4.7をリリースする方針を初めて公言しました。4.6の主眼はパラメータ規模ではなくSFT(教師あり微調整)とRL(強化学習)の大幅強化です。xAI公式ブログ・モデルカード・ベンチマーク・料金は未公開であり、情報源は現時点でマスク氏のX投稿1件が中心です。正式発表までは「Musk time」(数日〜2週間の遅延が珍しくない)を前提に、xAI公式チャネルで再確認してください。
2026年7月28日、イーロン・マスク氏はX(旧Twitter)上でVercel CEOのGuillermo Rauch氏(@rauchg)への返信の中で、xAIが8月7日前後にパラメータ規模1.5兆のGrok 4.6を、さらに数週間後に2.1兆パラメータのGrok 4.7を投入する計画を明かしました。前モデルGrok 4.5の正式リリース(7月8日)からわずか約3週間のタイムラインであり、xAIは2026年夏だけで3つのフロンティアモデルを連続投入するペースを示しています。現時点でxAIはベンチマークスコアや料金を公表しておらず、以下の整理はマスク氏の公開発言と業界報道に基づくものです。未確認の数値にはその旨を明記します。
01 · 三大選定の痛み
- 「公式」と「ツイート」の境界:Grok 4.6の発売日・1.5T・SFT/RL強化という核心情報は、いずれもマスク氏のX返信1件が起点です。Grok 4.5のときのようにモデルカード15項目・公式ブログ・料金表が揃っていないため、社内選定資料に「確定事実」として書き込むと、数日後の公式発表と矛盾するリスクがあります。
- ベンチマーク空白と「パラメータ先行」:1.5兆・2.1兆という数字は印象的ですが、第三者独立検証はゼロです。一方Kimi K3はFrontend Code Arena 1679点・Artificial Analysis総合3位など実測データが揃っており、「数値だけでGrok 4.6が勝つ」と決め打ちできません。パラメータ規模と実タスクコスト($/task)は別物です。
- 発売窓の圧縮とMusk time:Grok 4.5から1か月弱で4.6・4.7が続く予告は、選定サイクルを極端に短くします。加えてマスク氏の過去のスケジュールは数日〜2週間遅れる「Musk time」で知られ、8月7日は目標日であり保証ではありません。主力MacにAPIキーを固定する前に、隔離環境での段階検証が現実的です。
02 · 発売タイムライン:Grok 4.5 → 4.6 → 4.7
| 日付 | 出来事 |
|---|---|
| 2026-04-17 | Grok 4.3 Beta 公開(パラメータ未公表、前世代ベースライン) |
| 2026-07-08 | Grok 4.5 正式リリース。コーディング・エージェント特化、Cursorと共同訓練(実開発者セッションデータ)、50万トークンコンテキスト、料金入力$2/出力$6(100万トークンあたり)。Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7% |
| 2026-07-16 | 競合 Moonshot AI の Kimi K3 がホスト型サービスとして公開(2.8兆パラメータ・100万トークン) |
| 2026-07-26–27 | Kimi K3 完全オープンウェイト公開。HFトレンド1位、マスク氏もベンチマーク投稿に「印象的」とコメント |
| 2026-07-28 | マスク氏がGrok 4.6/4.7ロードマップをXで初公開(@rauchgへの返信)。同日、OpenAI・Anthropic等1,200名超が「Pacing the Frontier」公開書簡に署名 |
| 〜2026-08-07(目標) | Grok 4.6:1.5兆パラメータ、SFT/RL大幅強化が主眼(未発売・公式予告のみ) |
| 2026-08下旬〜9月初旬(見込み) | Grok 4.7:2.1兆パラメータ。マスク氏は「4.6を全面的に上回るが推論はやや遅い、トークン効率はさらに高い」と述べています(未発売) |
スケジュールはマスク氏の非公式発言に依存しており、xAI公式ブログ・製品ページは7月30日時点で未同期です。実際の発売は数日から2週間程度前後する可能性があるため、Musk timeを前提にxAI公式アカウントまたはx.aiで再確認してください。
03 · Grok シリーズ コアスペック一覧
| モデル | 発売/目標 | パラメータ | 定位 | 状態 |
|---|---|---|---|---|
| Grok 4.3 Beta | 2026-04-17 | 未公表 | 前世代ベースライン | 発売済み |
| Grok 4.5 | 2026-07-08 | 未公表(MoE単一SKUではない) | コーディング・エージェント、Cursor共同訓練 | 発売済み・ベンチマーク公開 |
| Grok 4.6 | 〜2026-08-07 | 1.5兆(1.5T) | SFT/RL大幅アップグレード | 公式予告・未発売 |
| Grok 4.7 | 2026-08下旬〜9月初旬 | 2.1兆(2.1T) | 4.6全面上回り・トークン効率向上(推論やや遅い) | 公式予告・未発売 |
注:Grok 4.6/4.7のパラメータ規模・発売日はマスク氏のX投稿に基づくベンダー側の予告であり、第三者独立検証はありません。料金・コンテキスト窓・ベンチマークは未公表です。正式発表まで数値は暫定として扱ってください。
確定データ:Grok 4.5は50万トークンコンテキスト、入力$2/出力$6(100万トークン)、SWE-Bench Proタスクあたり出力トークン約15,954(Claude Opus 4.8の約67,020に対し約4.2倍の効率差)——後学習と実セッションデータが4.5の強みです。4.6はこの路線の延長線上にあります。
04 · 深度解説:今回の主役は「より大きい」ではなく「より上手に学ぶ」
マスク氏はGrok 4.6のアップグレード重点をパラメータ規模そのものではなく「SFT & RL の大幅改善」と明示しました。これはGrok 4.5がコーディング・エージェント領域で健闘した戦略の継続です。
4.1 SFTとRLは何を解決するのか
教師あり微調整(SFT)は、人手で選別・标注した高品質サンプルでモデルの出力習慣を矯正する工程です。強化学習(RL)は報酬信号を通じて、多段階のエージェントタスクで「正しい行動列」を学ばせます。Grok 4.5はCursorとの共同訓練により実開発者セッションデータを後学習に活用し、Terminal-Bench 2.1で83.3%、SWE-Bench Proで64.7%を記録しました。同タスクでClaude Opus 4.8が約6.7万出力トークンを要するのに対し、4.5は約1.9万トークンで済むケースが報告されており、生の知能スコアより後学習とトークン効率が差を生んでいます。
4.2 「パラメータ積み上げ」と「後学習精緻化」の二刀流
Grok 4.6の1.5兆は4.5に比べ明確な規模ジャンプですが、マスク氏は4.7(2.1兆)について「推論はやや遅いが全面的に優れ、トークン効率もさらに高い」と補足しています。これはxAIが「より強い」と「より速い」を別SKUで分ける意図を示唆しており、AnthropicのSonnet/Opus分離やOpenAIのmini/full階層と同型の戦略です。1モデルですべてを通吃する設計ではないと読めます。
4.3 Kimi K3との同時期競争が与える現実的圧力
Grok 4.6の目標発売は、Kimi K3の完全オープンウェイト公開から約10日後に位置します。K3はFrontend Code Arenaで1679点を記録し、同ボードで初のオープンウェイトモデルとして全クローズドモデルを上回り、Artificial Analysisインテリジェンス指数で世界3位です。マスク氏自身もK3関連のベンチマーク投稿に「印象的(impressive)」とコメントしています。業界では、xAIが4.6/4.7の投入ペースを加速している背景に、OpenAI・Anthropic・中国勢との競争激化があると広く解釈されています。
05 · 横並び比較:Grok シリーズ vs 同期競合
| モデル | ベンダー | パラメータ | コンテキスト | 料金(入力/出力・100万トークン) | 出典 |
|---|---|---|---|---|---|
| Grok 4.5 | xAI | 未公表 | 50万トークン | $2 / $6 | xAI公式 |
| Grok 4.6(予告) | xAI | 1.5T | 未公表 | 未公表 | マスク氏X投稿(未検証) |
| Kimi K3 | Moonshot AI | 2.8T(MoE、896中16エキスパート活性) | 100万トークン | $0.30(キャッシュヒット)/$3(ミス)入力、$15出力 | Moonshot公式+HF |
| Claude Fable 5.1(噂) | Anthropic | 未公表 | 未公表 | Fable 5据え置きの噂($10/$50) | 36kr・WinCentral(Anthropic未確認) |
| GPT-5.6 Sol | OpenAI | 未公表 | 未公表 | 未公表 | OpenAI公式 |
Grok 4.6とClaude Fable 5.1の行は発売前の予告・噂であり、正式ベンチマーク比較にはなりません。発売タイミングとおおよそのポジショニングの把握に留め、性能判断はモデルカード公開後に行うべきです。
06 · 論点と注意すべき細部
- タイムラインは第三者未検証:現時点の唯一の一次情報源はマスク氏のX返信1件です。xAI公式ブログ・製品ページは未同期であり、実際の日付は前後する可能性があります。
- ベンチマークと料金がすべて空白:Grok 4.5発売時には詳細なモデルカードと15項目のベンチマークが揃いましたが、4.6には独立評価も公式モデルカードもありません。「1.5兆パラメータ」「SFT/RL大幅強化」は現時点でベンダー単独の主張です。
- xAIのコンテンツ安全論争:4.6予告の直前、xAIは7月にユーザー1名を提訴し、Grokの安全制限を迂回して児童性的虐待素材(CSAM)を生成したと主張しました。AI生成ディープフェイクに関する同社初の訴訟です。2026年1月のCommon Sense Media報告書は、Grokを「未成年保護が最も不十分なAI製品の一つ」と評価しています。技術能力評価とは別軸ですが、高速イテレーション下のコンプライアンス投資は企業選定で無視できません。
- 業界の「減速」呼びかけとの時間的ズレ:7月28日——マスク氏が4.6/4.7を予告した同日——OpenAI・Anthropic・Google DeepMind・Metaの従業員1,200名超が「Pacing the Frontier」公開書簡に署名し、米政府にフロンティアAI開発の意図的減速ツール構築を求めました。OpenAIとAnthropicは会社名義で背書していますが、xAIは署名者に含まれていません。「減速を公言する陣営」と「2か月で3フロンティアモデルを投入する陣営」の分裂は、2026年後半の観察ポイントです。
07 · 影響と背景:2026年8月は「集中リリース月」になりうる
マスク氏のタイムラインが成立すれば、Grok 4.6とGrok 4.7は、36kr・WinCentralなど複数メディアが8月を指すClaude Fable 5.1(OpenAIのGPT-6前倒しを狙うとの噂)と同月に登場する見込みです。7月にKimi K3のオープンウェイト衝撃が加われば、2026年8月は大規模言語モデル発売密度が最も高い月の一つになり得ます。
開発者・企業ユーザーにとっては、選定ウィンドウが極端に短くなります。前世代フラッグシップが発売から1か月で次世代競合に直面する状況では、リーダーボード順位やパラメータ規模より、実タスクあたりのトークン効率と総コスト($/task)が持続可能な判断基準になります。中国系金融メディア(Futu News、21世紀経済など)はK3公開日にOpenAI/Anthropicの評価期待とNvidia時価総額に大きな影響があったと報じていますが、これらは企業未確認のアナリスト推計であり、硬い事実として扱うべきではありません。
08 · 五段階実践手順(Mac開発者向け)
- Grok 4.5で現行ベースラインを固定:xAI APIまたはCursor経由で、長文要約・バグ修正・マルチファイルリファクタ各1タスクを実行し、出力トークン数と$/taskを記録します。4.6発売後の差分測定の基準線になります。
- 公式チャネルのアラート設定:xAI公式ブログ(x.ai/news)、@xai、@elonmuskをウォッチし、モデルカード・料金・コンテキスト窓の初出を逃さないようにします。X投稿と公式の差異が出た場合は公式を優先します。
- Kimi K3との対照実験を先行:K3評価記事の手順に沿い、同一リポジトリ・同一プロンプトでGrok 4.5とK3 APIを横並び比較します。4.6のベンチマーク空白期間の現実的な代替です。
- 隔離MacでAPIキーとエージェント試験:主力MacBookのKeychainを汚さず、レンタルmacOSノードにxAIキーを書き込み、Grok Build / Cursorルーティングを検証します。長コンテキスト実験のロールバックも容易です。
- 選定ドキュメントに「未確認」ラベルを付与:社内WikiやNotionに4.6の1.5T・8月7日・SFT/RL強化を書く際は情報源(マスク氏7/28 X投稿)と検証ステータスを明記し、正式発表後24時間以内に更新するフローを決めます。
09 · よくある質問 FAQ
Q: Grok 4.6 はいつ発売されますか?
A: マスク氏は「おおよそ8月7日」と述べていますが、これは非公式なX上の発言であり、xAI公式の確定日ではありません。実際の時期は数日から2週間程度前後する可能性があります。
Q: Grok 4.6 と Grok 4.7 の違いは何ですか?
A: Grok 4.6は1.5兆パラメータで、SFTとRLの後学習強化が主眼です。Grok 4.7は2.1兆パラメータで、4.6の数週間後に続く予定です。マスク氏によれば、推論速度を除き4.6を全面的に上回り、トークン効率もより高いとされています。
Q: Grok 4.6 は Kimi K3 や Claude Fable 5.1 より強いですか?
A: 現時点では判断できません。Grok 4.6には公開ベンチマークがなく、Kimi K3はFrontend Code ArenaやArtificial Analysisで実測済みです。Claude Fable 5.1はAnthropic未確認の噂段階であり、三者の直接比較は4.6の正式リリースとモデルカード公開まで待つ必要があります。
Q: Grok 4.6 の料金はいくらになりますか?
A: 公式には未発表です。Grok 4.5の参考値は入力$2・出力$6(100万トークンあたり)ですが、新世代では変更される可能性があるため、正式発表を待ってください。
Q: 一般ユーザーはどこで Grok 4.6 を使えますか?
A: Grok 4.5の展開経路から推測すると、Grok Build、xAI公式API、コンソールが先行し、その後Cursorなど第三者プラットフォームへ拡大する可能性が高いです。ただし4.6向けの公式確認はまだなく、入口は正式発表を以て確認してください。
10 · Macレンタル隔離試験:主力機の外でGrok APIを検収する
Grok 4.6は1.5兆パラメータ規模であり、MacBook上でのローカル推論は現実的ではありません。実務的なパスはxAI APIまたはCursor等のルーティングですが、主力MacにAPIキーを書き込み、長コンテキスト実験とGrok 4.5→4.6の切替テストを重ねると、Keychain汚染・シェル履歴漏洩・誤課金のリスクが高まります。
より堅実な方法は、隔離されたApple SiliconレンタルMacでGrok 4.5の現行ワークフローを先に固め、4.6正式公開後に同一ノードでA/B比較を行い、検証完了後にインスタンスを破棄することです。Windows/Linuxユーザーはgrok.comで体験できますが、macOSネイティブのXcode・Cursor・Keychain連携を含むエージェントパイプラインは隔離macOSでの検証が有効です。料金はMシリーズMac算力レンタル料金をご確認ください。
11 · 参考資料
- 公式:xAI「Introducing Grok 4.5」(x.ai/news/grok-4-5)、Grok 4.5モデルカード(media.x.ai)
- 一次情報:マスク氏2026年7月28日X投稿(@rauchgへの返信)
- 報道:Chain Tech Daily、Tron Weekly、American Bazaar、Qazinform
- ベンチマーク整理:eesel.ai、felloai.com、aireleasetracker.com(Grok 4.5)
- Kimi K3:Moonshot AI公式、GitHub moonshotai/Kimi-K3、Futu News、21世紀経済、Unwire.pro
- Fable 5.1噂:Emergent.sh、WinCentral、36kr
- 業界動向:The Verge、TechTimes(「Pacing the Frontier」公開書簡)
- 安全論争:Ars Technica、TechCrunch、The Guardian(xAI CSAM提訴)、Common Sense Media(2026年1月)
データ整理日:2026年7月30日。Grok 4.6/4.7の詳細は公式予告または業界噂に基づきます。発売前は必ずxAI公式チャネルで最新情報をご確認ください。