OPUS 5
半額旗艦
K3 蒸留問題.
リード:今週の AI 業界では、一見無関係に見える2つの出来事が、実は同じテーマ——コストパフォーマンスとモデル能力の真の出所——を指し示しています。課題:開発者は「Anthropic の新主力 Opus 5」と「Moonshot AI の低価格オープンソース K3」のどちらを選ぶべきか判断しなければなりませんが、ホワイトハウスの蒸留指控と K3 の「Claude 自称」という技術的証拠に混乱しています。結論:Opus 5 は Fable 5 の半額で性能を迫る、コンプライアンス重視ユーザーにとっての現実的なアップグレードです。K3 論争は未決着ですが、Greenblatt のデプロイ ID 漏洩は現時点で最も技術的な間接証拠です。構成:Opus 5 解説 → Opus vs Fable 比較表 → K3 蒸留問題タイムライン → 「Claude 自称」技術分析 → Mac 開発者向け5ステップ → 業界インサイト → FAQ。
30秒で把握 · TL;DR
| Opus 5 | 7/24 公開 · Max デフォルト · $5/$25 /100万トークン · CursorBench は Fable 5 との差 0.5% |
| K3 | 7/16 公開 · 2.8T パラメータ · 7/27 ウェイト OSS · ホワイトハウス 7/22 蒸留指控 |
| 技術的証拠 | K3 が Claude 自称 · claude-opus-4-5-20250929 等の内部 ID を出力 |
| 専門家の反論 | Fable 5 公開は 7/1 から · K3 公開まで 2週間 · 深度蒸留には時間不足 |
1. 課題の整理:なぜこの2つが同時に話題になったのか
- 旗艦は高すぎ、日常モデルは弱すぎる。 Fable 5 は能力は最高峰ですが $10/$50 の料金と30日間データ保持の要件があり、Pro/Max ユーザーは「半額旗艦」を待ち望んでいました——Opus 5 が Anthropic の答えです。
- オープンソースがクローズドに追いつくが、出所が疑わしい。 K3 のスコアは Fable 5 / GPT-5.6 Sol に次ぐ水準ながら、価格は桁違いに安い。ホワイトハウスが「産業規模の蒸留」を公に非難した以上、開発者はコンプライアンスとサプライチェーンリスクを無視できません。
- 政治的声明 vs 技術的証拠。 Kratsios 氏の X 投稿には公開された証拠鎖がありません。コミュニティを本気にさせたのは、Greenblatt が K3 が本物の Claude より正確に内部デプロイバージョンを報告するという発見です——これは再現可能な技術シグナルであり、外交辞令ではありません。
- Mac 開発者のルーティング問題。 Cursor / OpenClaw のマルチモデル構成で、「コンプライアンス準拠の Claude API + 低価格 OSS フォールバック」をどう組むべきか。OpenRouter マルチモデル接続ガイド と K3 オープンウェイト公開カウントダウン を参照すると、今週の出来事がルーティング表に直接影響します。
2. Claude Opus 5 公開:旗艦ではないが、最も使い勝手の良い Claude かもしれない
2026年7月24日、Anthropic は Claude Opus 5(モデル ID:claude-opus-5)を正式公開し、Claude Max のデフォルトモデルに設定しました。Claude Pro ユーザーも現時点で最強バージョンを利用できます。料金は Opus 4.8 と同一:入力 $5 / 100万トークン、出力 $25 / 100万トークン。コンテキストウィンドウ 100万トークン(デフォルトかつ唯一のティア)。最大出力 128K トークン。Thinking はデフォルトで有効です。
2.1 主要ベンチマーク:性能は飛躍、コストは据え置き
| ベンチマーク | Opus 5 の結果 | 比較メモ |
|---|---|---|
| Frontier-Bench v0.1 | 全モデルを上回る | Opus 4.8 の 2倍以上、タスクあたりコストは低い |
| CursorBench 3.2(max effort) | Fable 5 ピークとの差 0.5% | コストは Fable 5 の 半分 |
| ARC-AGI 3 | 次点モデルの 3倍 | 新規問題解決能力が大幅向上 |
| OSWorld 2.0 | Fable 5 最高スコアを上回る | コストは Fable 5 の 1/3未満 |
| Zapier AutomationBench | 100% 合格率 | 従来モデルはエンドツーエンドのアカウント健全性ワークフローを未達成 |
Cursor チームの評価:「Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost. On CursorBench it's just under Fable 5.」Box のエンタープライズ顧客テストでは、データ分析ワークフロー +11%、デューデリジェンス +17%、全体精度 +8% の改善が報告されています。
2.2 安全性とデータ保持:最も整列した世代だが、Mythos 5 の領域は侵さない
Opus 5 は Anthropic 史上最も整列(aligned)の高いモデルです——欺瞞行動の発生率が最低で、悪用への誘導に最も抵抗します。ただしサイバー攻撃や生物安全など高リスクなデュアルユース能力については、Anthropic は Opus 5 を意図的に frontier の最前線に置いていません——その位置は限定配布の Mythos 5 が占めています。Opus 5 のサイバーセキュリティ分類器のトリガー頻度は Fable 5 より約 85% 低く、ソースコードレベルの脆弱性発見に利用可能ですが、バイナリスキャン・ペンテスト・exploit 生成はブロックされます。
見落とされがちな点:Opus 5 はデフォルトでデータ保持を強制しません。Fable 5 / Mythos 5 は30日間データ保持ポリシーの同意が必要です——コンプライアンス重視のエンタープライズシーンでは、Opus 5 の方が Fable 5 より実用的な選択肢となる場合があります。
3. Opus 5 vs Fable 5:意思決定比較表
| 観点 | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| 入力 / 出力料金 | $5 / $25 /100万トークン | 約 $10 / $50 |
| CursorBench 3.2 ピーク | Fable 5 との差 0.5% | 現行コーディングベンチマークの天井 |
| Claude Max デフォルト | はい(7/24〜) | いいえ |
| データ保持 | デフォルト不要 | 30日保持への同意が必要 |
| デュアルユース能力 | 意図的に frontier 未達 | より強力(Mythos 5 は限定配布) |
| 適用シーン | 日常コーディング、Agent、エンタープライズコンプライアンス | 極限ベンチマーク、最強 frontier が必要なタスク |
4. Kimi K3「蒸留問題」:ホワイトハウスが介入、専門家はタイムラインに疑問
Moonshot AI は2026年7月16日に Kimi K3 を公開しました:総パラメータ 2.8兆、スパース MoE(896 エキスパート中16を活性化、約500億相当の活性パラメータ)、100万トークンコンテキスト + ネイティブ視覚理解、GPQA-Diamond 93.5%、BrowseComp 91.2%。完全ウェイトは 7月27日 公開予定——論争が起きた時点では外部から独立検証できませんでした。
4.1 ホワイトハウス指控と Anthropic の前例
2026年7月22〜23日、ホワイトハウス OSTP 長官 Michael Kratsios 氏が X で Moonshot AI の「大規模かつ隠蔽的な産業規模の蒸留」による Anthropic Fable モデル能力の窃取を非難し、輸出許可のない Nvidia GB300 チップの使用疑惑にも言及しました。財務長官 Scott Bessent 氏も複数の中国モデルで米国大規模モデルの「ウォーターマーク」を発見したと付言しましたが、具体的定義は公開されていません。
これは憑空の話ではありません:2026年2月、Anthropic は Moonshot AI、DeepSeek、MiniMax に対し、340万回超の異常 API インタラクションを検出したと公表し、「正常使用パターンから明らかに逸脱し、意図的な能力抽出を反映している」と述べています。
4.2 独立専門家:2週間での深度蒸留は非現実的
"Fable's only been publicly available since July 1st. You can't distill that much data, train a model, and release it in two weeks." — Braden Hancock、Snorkel AI 共同創業者
Allen Institute の Nathan Lambert 氏は補足します:中国モデルが frontier に接近するにつれ、単純な教師あり微調整型蒸留の限界効用は縮小しており、真の差は強化学習トレーニングにあります——蒸留がそれほど有効なら、追従者全員がとっくに蒸留で追いついているはずです。
5. 最も過激な証拠:K3 が「Claude だと自称」し内部デプロイ ID を出力する
Redwood Research 首席科学者 Ryan Greenblatt(GitHub:rgreenblatt/which_claude_is_k3)は7月24日前後に統計分析を公開しました:Kimi K3 に「あなたは誰ですか」と尋ねると、異常に高頻度で Claude だと自称し、Claude 公式の内部デプロイ ID 文字列まで出力します:
そして本物の Claude モデル自身でさえ、この内部バージョン番号をこれほど正確には報告しません——Sonnet 4.5 は単に「Claude Sonnet 4.5 です」と答え、Opus 4.5 はエラーを返したりバージョンを報告しなかったりします。
Greenblatt の解釈:モデルが「教師モデル」のデプロイメタデータを、教師モデル自身より正確に述べることは、「会話スタイルの模倣」では説明しにくく、学習データにデプロイメタデータ付き Claude データ(API ログやラベル付き合成データなど)が混入した可能性を示唆します。K3 の自称アイデンティティは「Claude 4.5 時代」(2025年末)に固定され、K2 はより古い Sonnet 4 を指します——「世代を追う」パターンが見られます。
重要な注記:Greenblatt はこれが蒸留の直接証明にはならないと強調しています——アイデンティティ混同はデータ汚染やシステムプロンプト漏洩からも生じ得ます。ただし Anthropic の2月指控と合わせると、これは政治声明ではなく最も実務的な技術的証拠です。
6. 5ステップ実装:Mac 開発者がモデルルーティングを調整する方法
- コンプライアンス優先度を評価する。 エンタープライズデータや輸出規制に敏感なシーンでは、Opus 5 の非強制データ保持 + 公式 API 経路を、出所が未完全に明らかな K3 等の OSS モデルより優先してください。
- Cursor / OpenClaw の主モデルを更新する。 Claude Max ユーザーはデフォルトが Opus 5 に切り替わります。Cursor では
claude-opus-5を明示指定し、実プロジェクトでの Fable 5 との cost-per-task を比較してください。 - OpenRouter フォールバックチェーンを構成する。 主力 Opus 5 → レート制限時に DeepSeek V4 Flash または Kimi K3 API(出所リスクを許容する場合)→ デバッグ用無料層は OpenRouter 無料モデル。
- 7月27日 K3 ウェイト公開をマークする。 完全ウェイト公開後、隔離環境(非本番 Mac ノード)で独立ベンチマークとアイデンティティ自称テストを実行し、Greenblatt の統計を再現してください。
- 負荷テストと日常開発を分離する。 長コンテキスト Agent 負荷テストやマルチモデル A/B は主力 MacBook の統一メモリを占有しないでください——リモート Mac ノードで隔離検証に回します(後述のまとめ参照)。
7. タイムライン一覧
| 日付 | 出来事 |
|---|---|
| 2026-02 | Anthropic が Moonshot AI / DeepSeek / MiniMax に「産業規模蒸留攻撃」を初めて非難 |
| 2026-07-01 | Claude Fable 5 が一般公開で利用可能に |
| 2026-07-16 | Kimi K3 API / 製品正式リリース |
| 2026-07-22/23 | ホワイトハウス Kratsios 氏が蒸留 + 違法チップを公に非難 |
| 2026-07-24 | Claude Opus 5 公開;Greenblatt が K3 アイデンティティ自称分析を公開 |
| 2026-07-27(予定) | Kimi K3 完全ウェイト OSS 公開 |
8. 深掘り:コスパ戦争と「能力の出所」の公開対決
Opus 5 と K3 論争を合わせて見ると、2026年後半の LLM 競争は新段階に入っています:Frontier 能力の商品化。Anthropic は「半額で旗艦に迫る」ことで市場のコスパ要求に応えています——これは在庫処分ではなく、意図的な製品ライン再編です:Fable 5 が極限 frontier を守り、Opus 5 が日常主力を引き継ぎ、Mythos 5 がデュアルユースリスク能力をロックします。
Moonshot AI は「OSS + 低価格 + 少ない拒否応答」で同じ市場を攻めています。K3 論争の本質は、業界が初めて公然と問う点です:ベンチマークで frontier に接近し、価格が10分の1のとき、「本当のエンジニアリングの勝利」と「静かに他人のモデルに乗っている」のをどう区別するか?
Mac 開発者にとって、これは単なるニュースではありません。Cursor のデフォルトモデル切替、OpenClaw のフォールバックチェーン、OpenRouter のルーティング表——Opus 5 のデフォルト化と K3 ウェイト OSS により、今後30日以内に書き換えられます。Greenblatt の「デプロイ ID 漏洩」アプローチが価値ある理由は、再現可能で定量化可能な検出手法を提供するからです:政府調査を待たず、開発者自身が identity probe テストを実行できます。
r/LocalLLaMA コミュニティの3派も聞く価値があります:「OSS とクローズドの差が months から days に縮まった」と歓喜する派;「2.8T パラメータは誰もローカルで動かせない」と茶化す派;K3 の真の売りは価格と検閲の少なさであり「Fable 5 を倒すこと」ではないと考える実務派。7月27日のウェイト公開前、すべてのアーキテクチャ声明は「公式自己評価 + 外部推測」に過ぎません。
9. よくある質問 FAQ
Q:Claude Opus 5 は Claude Fable 5 よりどれくらい安いですか?
A:トークン単価は Fable 5 の約半分($5/$25 vs 約 $10/$50)で、CursorBench ピークスコア差は1%未満です。
Q:Claude Opus 5 は現在 Claude Max のデフォルトモデルですか?
A:はい。7月24日リリース当日から Claude Max デフォルトとなり、Claude Pro 最強利用可能バージョンです。
Q:Kimi K3 は本当に Claude を蒸留したのでしょうか?
A:本文執筆時点では未確認の論争です。ホワイトハウスは公開証拠なし。専門家は2週間タイムラインに疑問。Greenblatt の「Claude 自称 + 内部 ID」が現最強の技術的間接証拠です。
Q:Kimi K3 完全ウェイトはいつダウンロードできますか?
A:公式は2026年7月27日を約束。執筆時点では未公開です。
Q:なぜ Kimi K3 は Claude だと自称するのですか?
A:統計的に K3 のアイデンティティ自称が Claude に偏り、内部デプロイ ID を出力します——メタデータ付き Claude サンプルの学習データ混入を示唆しますが、「蒸留確定」とは言えません。
10. まとめ:コンプライアンス API は Opus 5、負荷テストと OSS 検証は Mac ノードへ隔離
Windows/Linux クラウドサーバーで Claude API や Kimi K3 に接続すれば、日常コーディングは問題なく動きます。しかし Mac 上で Cursor + Opus 5 長セッション Agent、OpenClaw マルチモデルフォールバック負荷テスト、K3 アイデンティティ自称テストの隔離再現を行うなら、Apple Silicon 統一メモリ + Metal ツールチェーン + 24/7 安定稼働が最も friction の少ない選択肢です。
実務的な分担:主力開発機は Opus 5 / OpenRouter コンプライアンスルート;Agent 負荷テスト、K3 ウェイトローカルベンチマーク、長コンテキスト batch は MACGPU リモート Mac mini M4 ノードへ——必要に応じてレンタル、SSH 隔離で、主力機を2.8T パラメータ実験で圧迫しません。「半額旗艦 vs 出所不明の OSS frontier」が共存する今週、隔離検証は単一方案への all-in より制御可能です。