Claude Opus 5 が半額で旗艦に迫る一方、
Kimi K3 は「Claude 自称」蒸留論争に

今週の AI 業界では、一見無関係に見える二つの出来事が同じ論点——コストパフォーマンスモデル能力の出所——を浮き彫りにしました。2026-07-24、Anthropic は日常主力モデル Claude Opus 5 を公開し、同日 Claude Max のデフォルトに設定されました。一方、7 月 16 日に登場した Kimi K3 は、ホワイトハウスから「産業規模の蒸留」を公然と非難され、独立研究者 Ryan Greenblatt は K3 がClaude と名乗り内部デプロイ ID を出力する統計を公開しました。

本記事はClaude / Kimi API の選定、大規模モデル論争、コンプライアンスリスクを検討する開発者と技術意思決定者向けです。Anthropic 公式発表、Moonshot 技術ブログ、TechCrunch の専門家取材、Greenblatt の分析に基づき、Opus 5 への移行判断、K3 蒸留疑惑の検証可能な部分、Agent ワークフローの実務対応を整理します。

01 Claude Opus 5 リリース:料金据え置き、性能跳躍、Claude Max デフォルト

選定前の実務課題:

  • Fable 5 の高コスト:旗艦性能は高いものの、入力 $10 / 出力 $50(100 万 tokens あたり)では日常 Agent の運用コストが重い。
  • Opus 4.8 の限界:CursorBench や Frontier-Bench などの難タスクで、現行旗艦に明確な差がある。
  • データ保持ポリシー:Fable 5 / Mythos 5 は 30 日間のデータ保持に同意する必要があり、コンプライアンス重視のチームは利用を見送っている。
  • モデル ID の混乱:API、Bedrock、Vertex、Foundry など複数プラットフォームで、統一 ID claude-opus-5 を確認する必要がある。

2026-07-24(米国太平洋時間)、Anthropic は Claude Opus 5 を正式公開しました。日常主力モデルとして位置づけられ、Fable 5 に近い知能を Fable 5 の半額で提供するとしています。料金は Opus 4.8 と同一——入力 $5 / 100 万 tokens、出力 $25 / 100 万 tokens。コンテキストは 100 万 tokens(デフォルトかつ唯一の設定)。最大出力 128K tokens。Thinking はデフォルト有効で、Effort パラメータで思考量を制御します。

Claude Opus 5 主要スペック(出典:Anthropic 公式)
項目 Claude Opus 5 比較メモ
料金(入力/出力) $5 / $25 per 100万 tokens Opus 4.8 と同額、Fable 5 の約半分
コンテキスト 100 万 tokens デフォルトかつ唯一
利用可能プラットフォーム Claude API / Platform / AWS Bedrock / Google Vertex AI / Microsoft Foundry モデル ID:claude-opus-5
製品上の位置づけ Claude Max デフォルト、Claude Pro 最上位 旗艦だけでなく日常主力を押すシグナル
データ保持 デフォルト利用で強制保持なし Fable 5 / Mythos 5 は 30 日保持に同意が必要
Fast モード 約 2.5 倍速、料金 2 倍 Opus 4.8 と同方針

公式ベンチマークの要点(リリース後は Anthropic ニュースページで再確認してください):

  • Frontier-Bench v0.1:ソフトウェアエンジニアリングで全モデル超え、Opus 4.8 の2 倍以上、タスクあたりコストは低い。
  • CursorBench 3.2:max effort で Fable 5 ピークとの差は 0.5% 未満、コストは半分。high / xhigh / max 各段階でコスパ最優。
  • ARC-AGI 3:新規問題解決で次点の 3 倍
  • OSWorld 2.0:任意コスト帯で他モデル上回り、Fable 5 最高スコアを Fable 5 コストの 1/3 未満で上回る。
  • Zapier AutomationBench:エンドツーエンド自動化で次点の約 1.5 倍

アラインメントと安全:自動監査では Opus 5 はこれまでで最も整列した Claude モデルと評価されています。サイバー攻撃やバイオセキュリティなど高リスク二用途能力については、Anthropic は Opus 5 でフロンティア更新を意図的に避け、制限付き Mythos 5 がその位置を占めています。

公式発表は以下のリンクを参照し、更新後に再確認してください。

https://www.anthropic.com/news/claude-opus-5

02 Kimi K3 蒸留論争:ホワイトハウスが非難、専門家はタイムラインに疑問

Opus 5 が「通常の新製品発表」なら、Kimi K3 の展開ははるかに複雑です。月之暗面は 2026-07-16 に Kimi K3 を公開しました。総パラメータ 2.8 兆(2.8T)、世界初の 3T 級オープンソースモデル。スパース MoE で 896 エキスパート中 16 を token ごとに活性化(約 500 億相当)。100 万 token コンテキストとネイティブ視覚理解。Kimi Delta Attention(KDA)+ Attention Residuals + Stable LatentMoE を採用。完全ウェイトは 2026-07-27 公開予定——論争発生時点では外部検証不可でした。

K3 のアーキテクチャとベンチマークの詳細は、当サイトのレビューを参照してください:Kimi K3 徹底レビュー

Kimi K3 蒸留論争タイムライン
日付 出来事
2026-02 Anthropic が月之暗面 / DeepSeek / MiniMax への「産業規模蒸留攻撃」を初公開。月之暗面で 340 万回超の異常 API 相互作用を検出と主張
2026-07-01 Claude Fable 5 が一般公開
2026-07-16 Kimi K3 API/製品正式リリース
2026-07-22/23 ホワイトハウス OSTP 長 Michael Kratsios が X で月之暗面の「大規模かつ隠蔽的な産業規模蒸留」と、輸出許可のない Nvidia GB300 チップ使用の疑いを非難
2026-07-23 TechCrunch が独立研究者の蒸留説への疑問を報道
2026-07-24 前後 Ryan Greenblatt が「K3 が Claude 自称」の統計を公開(GitHub: rgreenblatt/which_claude_is_k3)
2026-07-27(予定) Kimi K3 完全ウェイト公開、外部独立検証可能に

2026-07-22/23、ホワイトハウス科学技術政策室(OSTP)長 Michael Kratsios は、月之暗面が「大規模かつ隠蔽的な産業規模蒸留」で Anthropic Fable 能力を窃取したと公開非難しました。輸出許可のない Nvidia GB300(Grace Blackwell 300)をタイ経由サーバー等で取得した疑いにも言及。Kratsios は具体的証拠を公開していません。月之暗面は訓練プロセスへの質問に応答していません。

TechCrunch(7 月 23 日)は独立研究者複数を取材し、「蒸留説」への懐疑が広がっていると報じました。Snorkel AI 共同創業者 Braden Hancock は、Fable 5 が 7 月 1 日から一般利用可能で、K3 リリース(7 月 16 日)まで2 週間しかなく、十分なデータ蒸留・訓練・公開は不可能だと指摘しました。Allen Institute for AI の Nathan Lambert は、中国モデルがフロンティアに近づくほど単純な SFT 型蒸留の限界が見え、差を広げるのは強化学習だと述べています。

「Large-scale, covert industrial distillation aimed at stealing proprietary U.S. technology and undermining American research is unacceptable.」—— Michael Kratsios、ホワイトハウス OSTP 長

背景として、Elon Musk は xAI が Grok 訓練で OpenAI モデルを蒸留したことを認め、業界では珍しくないと述べたことがあります。蒸留自体が違法とは限らず、「技術的参考」と「隠蔽的な産業規模窃取」の境界が論点の中心です。

03 Kimi K3 が Claude 自称?Ryan Greenblatt の技術的証拠

本件で最も技術的に説得力がある角度は、Redwood Research 首席科学者 Ryan Greenblatt が 2026-07-24 前後に公開した統計分析です。複数モデルに「あなたは誰ですか」と尋ねた際の自己認識応答をクロスエントロピーで比較しました。

  • 異常に高い Claude 自称率:Kimi K3 は身份質問に対し Claude と名乗る頻度が突出し、claude-opus-4-5-20250929claude-sonnet-4-5-20250929 など Claude 内部デプロイ ID 文字列まで出力する。
  • 本物 Claude より正確:実際の Claude Sonnet 4.5 は「Claude Sonnet 4.5 です」程度。Opus 4.5 は内部バージョン ID を自発的に報告しない——教師モデル自身より K3 の方が正確
  • 世代追従のパターン:K3 の自称は「Claude 4.5 時代」(2025 年末)に固定され、現行 Fable/Mythos ではない。前世代 K2 はより古い Claude Sonnet 4(2025 年中)を指す——「世代ごとに追従」する傾向。
  • Greenblatt の解釈:教師のデプロイメタデータを教師より正確に述べるのは「会話スタイル模倣」だけでは説明しにくく、デプロイメタデータ付き Claude データ(API ログや合成データ等)が訓練に混入した可能性を示唆。
  • 重要な但し書き:Greenblatt はこれらの発見が蒸留を直接証明しないと強調。データ汚染、システムプロンプト漏洩、公開データセット合成も説明候補です。

分析コードと writeup は Greenblatt の GitHub を参照し、更新後に再確認してください。

https://github.com/rgreenblatt/which_claude_is_k3

7 月 27 日のウェイト公開前は、アーキテクチャとベンチマークを外部が完全独立検証できず、論争が続いています。

04 Claude Opus 5 vs Fable 5 vs Kimi K3:選定マトリクス

三モデル主要次元比較(2026-07-25 執筆時点)
次元 Claude Opus 5 Claude Fable 5 Kimi K3
入力/出力料金(100万 tokens) $5 / $25 約 $10 / $50 約 $3 / $15(API、K3 レビュー参照)
Fable 5 比コーディング CursorBench ピーク差 0.5% 基準 公式は Fable 5 と GPT-5.6 Sol に次ぐ総合性能
コンテキスト 100 万 tokens 100 万 tokens 100 万 tokens + ネイティブ視覚
データ保持 デフォルト強制なし 30 日保持に同意必要 Moonshot ポリシーに依存
オープンウェイト クローズド クローズド 2026-07-27 公開予定
コンプライアンス/地政学 低(Anthropic 米系クローズド) 低、保持要件高 高(蒸留非難 + チップ輸出規制論争)
向く用途 日常 Agent、コーディング、企業コンプライアンス 極限知能、保持と高コスト許容 極限コスト、OSS 制御、論争許容

二つの出来事を並べると:Opus 5 は「半額で旗艦に迫る」でコスパ訴求に応え、Kimi K3 は「OSS + 低価格」で市場を揺さぶる。K3 を巡る論争の本質は、低価格がエンジニアリング最適化か、他社モデルの不正利用かを公然と問うことです。

05 開発者向け六ステップ:Opus 5 移行と K3 論争下の API 戦略

  1. Claude コンソールのデフォルト確認:Claude Max / Pro でデフォルトが Opus 5 に切り替わっているか確認。API 呼び出しのモデル ID を claude-opus-5 に更新し、Bedrock / Vertex / Foundry のエイリアスも同期。
  2. CursorBench 相当の回帰テスト:本番代表の Agent タスク 10–20 件(コードレビュー、マルチファイルリファクタ、CI スクリプト生成)で Opus 4.8 / Opus 5 / Fable 5 の合格率と token コストを比較。effort 段階の影響を記録。
  3. データ保持条項の再評価:Fable 5 の 30 日保持で見送っていた場合、Opus 5 のデフォルト非強制保持は企業利用の鍵になり得ます。法務と Anthropic DPA・利用規約を確認。
  4. K3 を唯一の本番バックエンドにしない:7 月 27 日のウェイト公開と第三者ベンチ再現まで、K3 は実験ブランチに限定。コンプライアンス重視顧客には「蒸留非難未解決」のリスク文書化。
  5. Greenblatt 式アイデンティティテスト(任意):K3 と各 Claude モデルに標準化「あなたは誰」プロンプトを送り、claude-opus-4-5-* 型内部 ID 出力を記録——社内リスク管理とベンダーデューデリジェンス材料に。
  6. Gateway と Agent を 24/7 ホストへ:Opus 5、Fable 5、OpenRouter 経由のマルチモデルいずれでも、Cursor / OpenClaw / 自社 Agent の Gateway はスリープしない macOS ベアメタル上で稼働させ、ノート PC 閉蓋による webhook 中断を避ける。

06 引用可能な技術データ、FAQ、本番環境への示唆

  • Opus 5 スペクトル逆分子構造:Opus 4.8 比内部評価 10.2 ポイント向上(Anthropic 生命科学評価)。
  • タンパク質配列変異機能予測:Opus 5 は Opus 4.8 比 7.7 ポイント高い。
  • Kimi K3 GPQA-Diamond:93.5%、リリース時 OSS 最高(Moonshot 公式)。
  • Anthropic 2 月蒸留非難:月之暗面で 340 万回超異常 API 相互作用を特定、一部は経営層に追跡可能と主張(Anthropic 公開声明、月之暗面は未回答)。

Opus 5 は入力 $5/100万 tokens、出力 $25/100万 tokens で、Fable 5($10/$50)の約半分です。CursorBench 3.2 ピークは Fable 5 と 0.5% 未満の差です。

はい。2026-07-24 リリース当日から Opus 5 が Claude Max デフォルト、Claude Pro 最上位モデルです。

執筆時点では未証明の論争です。ホワイトハウス非難に公開証拠なし。独立研究者は 2 週間タイムラインに懐疑。Greenblatt の Claude 自称・内部 ID 統計が現時点で最も技術的な間接証拠ですが、蒸留の直接証明にはなりません。

Moonshot は 2026-07-27 公開を約束。執筆時点では外部研究者はアーキテクチャとベンチを完全独立検証できません。

一般開発者と企業ユーザーへ:用途を先に、立場を後に。コンプライアンス・データ保持・サプライチェーンリスク重視なら Opus 5 の「料金据え置き・能力跳躍」は高コスパ。極限コストと OSS 制御、論争許容なら 7 月 27 日 K3 ウェイト後に実測を。

Opus 5 でもマルチモデル Gateway でも、ノート PC で 24/7 Agent を回すとスリープ断線、DerivedData とログのディスク圧迫、共同作業の権限混乱など隠れコストが出ます。iOS CI/CD と AI Agent 自動化により安定した本番環境には、CALMVPS の Mac Mini ベアメタルレンタルが通常より適しています:Apple Silicon 専有、120 秒デプロイ、月次柔軟契約で Gateway と CI Runner を常時オンラインに保てます。

関連記事:Claude Fable 5 輸出規制と代替案 · Kimi K3 アーキテクチャとベンチマーク