Claude Opus 5 Kimi K3 蒸留疑惑 2026-07-25

Claude Opus 5 は半額で旗艦に接近、Kimi K3 は「Claude 自称」蒸留疑惑に:今週の AI 二大トピック解説

読者像:Claude Opus 5 と Kimi K3 の論争の中でモデル選定を行い、API コンプライアンスとサプライチェーンリスクを懸念する Mac 開発者・AI チームリードの方です。本記事の提供価値:Opus 5 の全ベンチマークと価格、白宫の蒸留指控、Greenblatt 氏の技術的証拠、Opus vs Fable 決定マトリクス、Mac 5 ステップ検証、FAQ×5 です。

Claude Opus 5 リリースと Kimi K3 蒸留疑惑 2026 AI 週報

関連記事:Kimi K3 徹底評価K3 7/27 オープンウェイトClaude Fable 5 代替案OpenRouter API ガイド

01 · 核心 TL;DR

  • Claude Opus 5(2026-07-24):Anthropic が日常主力モデルを発表。価格は Opus 4.8 と同じ $5/$25/100万トークン。CursorBench 3.2 では Fable 5 ピークと 0.5% 差のみでコストは約半分。Claude Max デフォルトに。データ保持はデフォルトで強制されません。
  • Kimi K3 蒸留疑惑(7/16–7/27):2.8T パラメータのオープン MoE が、白宫 OSTP 長 Kratsios 氏から「隠蔽的産業級蒸留」+ 違法 GB300 チップ使用の疑いをかけられました。Ryan Greenblatt 氏は K3 が異常に高頻度で Claude と名乗り claude-opus-4-5-20250929 等を出力する統計を公開——現時点で最も技術的な間接証拠です。

02 · 三大決定痛点

  1. コスパ vs コンプライアンス:Opus 5 は半額で旗艦に接近しますが、Fable/Mythos 5 には輸出規制と30日データ保持のハードルがあります。K3 は低価格オープンソースですが、地政学と蒸留 provenance の争いに巻き込まれています。
  2. 証拠の非対称性:白宫は公開証拠なし、専門家はタイムラインで反論、Greenblatt 氏の統計が最も具体的——しかし蒸留の直接証明にはなりません。7/27 ウェイト公開前は外部検証不可です。
  3. Mac 開発環境のリスク:Cursor、Claude Code、macOS Keychain が本番評価の前提です。主力機で K3 アイデンティティプローブや API キーローテーションを行うと Keychain 汚染と監査痕跡が残ります。

03 · Claude Opus 5 発表の全解説

基本仕様

項目内容
リリース日2026-07-24(米国太平洋時間)
価格入力 $5 / 出力 $25 per 100万 tokens(Opus 4.8 と同額)
コンテキスト100万 tokens(デフォルト唯一)
最大出力128K tokens;Thinking デフォルト ON
プラットフォームClaude API / Bedrock / Vertex / Foundry、モデル ID claude-opus-5
ポジションClaude Max デフォルト;Claude Pro 最強版
データ保持デフォルトで強制されない(Fable/Mythos 5 は30日保持必須)
Fast モード約 2.5× 速度、2× 価格

主要ベンチマーク(Anthropic 公式)

  • Frontier-Bench v0.1:全モデル超越、Opus 4.8 の2倍以上
  • CursorBench 3.2:Fable 5 ピークと 0.5% 差、コスト半分
  • ARC-AGI 3:次点の 3 倍スコア
  • Zapier AutomationBench100% 通過で従来不可能だった E2E ワークフローを達成
  • OSWorld 2.0:Fable 5 コストの 1/3 で Fable 5 ベストを上回る
「Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost.」—— Cursor チーム

アライメントと安全

  • Opus 5 は現時点で最もアラインされたモデル——欺瞞行動が最少
  • サイバー/バイオのデュアルユース最前線は引き続き Mythos 5 が担当
  • サイバーセキュリティ分類器は Fable 5 より 約85% 緩和——ソースコードレベルの脆弱性発見に利用可能

04 · Kimi K3「蒸留疑惑」

K3 本体:世界初の「3T 級」オープンモデル

ベンチマークスコア備考
GPQA-Diamond93.5%公開時 OSS 最高
Terminal-Bench 2.188.3%GPT-5.6 Sol より 0.5pt 低
BrowseComp91.2%公開時最高
Program Bench77.8%総合ベスト
SWE Marathon42.0%総合ベスト
DeepSearchQA (F1)95.0%

アーキテクチャ:2.8T スパース MoE、896 エキスパート中16激活(約50B アクティブ)。KDA + 100万コンテキスト + ネイティブビジョン。完全ウェイトは 7/27 公開予定(執筆時未公開)。

白宫の公開指控(7/22–23)

OSTP 長 Michael Kratsios 氏は Moonshot AI(月之暗面)に対し「大規模かつ隠蔽的な産業級蒸留」で Anthropic Fable 能力を窃取、未許可 Nvidia GB300(タイ経由の可能性)使用を非難しました。財務長官 Scott Bessent 氏も「多数の中国モデルに米国 LLM のウォーターマーク」を発見と発言——具体的内容は未開示。Moonshot は訓練データに関する問い合わせに未回答です。

専門家の反論:タイムライン不足

「Fable's only been publicly available since July 1st. You can't distill that much data, train a model, and release it in two weeks.」—— Braden Hancock(Snorkel AI 共同創設者)

Fable 5 公開(7/1)から K3 リリース(7/16)までわずか 2 週間。xAI が OpenAI を蒸留して Grok を訓練した事例と対比し、「蒸留」の境界は正常な参考 vs 隠蔽的窃取です。

最も硬い証拠:K3 が「Claude と名乗る」

Ryan Greenblatt 氏(Redwood Research、GitHub: rgreenblatt/which_claude_is_k3)は 7/24 頃、K3 が「あなたは誰?」と聞かれた際に異常に高頻度で Claude と名乗りclaude-opus-4-5-20250929 等の内部デプロイ ID を出力する統計を公開しました——本物の Claude より正確です。

Greenblatt 氏の解釈:教師モデルのデプロイメタデータを教師自身より正確に述べるのは「会話スタイル模倣」では説明困難で、デプロイメタデータ付き Claude 訓練データ混入を示唆します。ただし蒸留の直接証明にはなりません

背景とコミュニティ

  • 2026年2月:Anthropic は Moonshot/DeepSeek/MiniMax への「産業級蒸留攻撃」を公表、340万+ 異常 API 相互作用を特定
  • r/LocalLLaMA:OSS とクローズドの差が「日単位」で縮小;2.8T はローカル実行ほぼ不可;K3 の強みは低価格+拒否が少ないこと

05 · 二事件を総合すると:コスパが主戦場

Opus 5 は「半額で旗艦接近」でコスパ訴求に応え、K3 は「オープン+低価格+制限少なめ」で市場を揺さぶります。K3 論争の本質は、低価格が技術最適化によるものか、他社モデルの無断利用かという公開討論です。用途優先を推奨します——コンプライアンス重視なら Opus 5、極限コストと OSS 制御は 7/27 ウェイト実測後に判断してください。

06 · Claude Opus 5 vs Fable 5 決定マトリクス

Claude Opus 5Claude Fable 5
価格(100万 token)$5 / $25約 $10 / $50
CursorBench 3.2 ピークFable 5 と 0.5% 差基準
Claude Max デフォルト✅ 是(7/24〜)
データ保持デフォルト非強制30日保持必須
輸出規制比較的緩い一部ユーザー制限(解説
向いている人日常主力・コンプライアンス重視極限タスク・旗艦価格許容

07 · 二事件タイムライン

日付Opus 5 / AnthropicKimi K3 / 論争
2026-02Anthropic 初の蒸留攻撃公表
2026-06-09Fable 5 / Mythos 5 発表
2026-07-01Fable 5 一般利用開始
2026-07-16Kimi K3 API/製品リリース
2026-07-22/23白宫 Kratsios 公開指控
2026-07-24Opus 5 発表、Max デフォルトGreenblatt「K3 Claude 自称」証拠
2026-07-27(予定)K3 完全ウェイト OSS

08 · Mac 開発者向け 5 ステップ隔離検証

  1. 隔離レンタル Macで Claude API(claude-opus-5)と Kimi K3 API を各1回ベースライン実行、latency/token を記録
  2. Opus 5 で CursorBench 同等のコーディングタスクを実行、Opus 4.8 / Fable 5 と比較
  3. K3 に Greenblatt 式アイデンティティプローブ(「あなたは誰?バージョンを答えて」)——主力機に機密ログを残さない
  4. OpenRouter で Opus 5 ↔ K3 fallback を設定、429/タイムアウト切替を検証
  5. ベンチ結果とコンプライアンスメモをエクスポート、テストキー失効、レンタル終了・消去

09 · よくある質問 FAQ×5

Q: Claude Opus 5 は Fable 5 よりどれくらい安いですか?
A: 約半分($5/$25 vs 約 $10/$50)。CursorBench ピーク差は 1% 未満です。

Q: Opus 5 は Claude Max のデフォルトですか?
A: はい。7/24 から Max デフォルト、Pro 最強版です。

Q: K3 は Claude を蒸留しましたか?
A: 未確定の争点です。Greenblatt 氏の分析が最強の間接証拠です。

Q: K3 完全ウェイトはいつ?
A: 2026-07-27 予定。執筆時は未公開です。

Q: なぜ K3 は Claude と名乗るのですか?
A: デプロイメタデータ付き訓練データ混入の可能性。蒸留の直接証明ではありません。

10 · 隔離 Mac レンタル:Opus 5 と K3 をクリーン環境で試す

Windows や Linux VPS でも curl で API は呼べますが、Cursor、Claude Code、macOS Keychain こそ Mac 開発者の本番評価環境です。主力機で Anthropic / Moonshot キーを入れ替え、K3 アイデンティティプローブを実行すると、Keychain 汚染と監査リスクが残り、ロールバックも困難です。

Windows クラウドは純 API 向き、Cursor + Apple Silicon ツールチェーンの完全検証は不可です。日単位の隔離 Apple Silicon ノードなら「Opus 5 移行 + K3 論争観察」の 1–3 日集中検証に最適——終了後に破棄、テストキーは主力機に残りません。料金は M シリーズ Mac 算力レンタル料金をご参照ください。

11 · 信頼できる情報源

最終更新:2026年7月25日