Anthropicが中国AI企業によるClaude大規模蒸留攻撃を公表|DeepSeek・Moonshot・MiniMaxが2.4万の不正アカウントで1,600万回以上のやり取り
2026年02月24日※本ページはプロモーションが含まれています
Anthropicが中国AI企業によるClaude大規模蒸留攻撃を公表|DeepSeek・Moonshot・MiniMaxが2.4万の不正アカウントで1,600万回以上のやり取り
Anthropicが中国のAI企業3社によるClaudeモデルの不正蒸留を告発。偽アカウント2.4万件・1,600万回超のやり取りで能力を抽出し、自社モデルの訓練に流用していた実態が明らかに。
概要
2026年2月24日、Anthropicは衝撃的な発表を行いました。中国のAI企業3社DeepSeek、Moonshot AI、MiniMaxが、Claudeモデルに対して「産業規模の蒸留攻撃(distillation attack)」を行っていたことを公表したのです。
これらの企業は合計で約24,000の不正アカウントを作成し、Claudeとの間で1,600万回を超えるやり取りを生成。Claudeの中核的な能力を抽出し、自社モデルの訓練・改善に利用していました。
そもそも「蒸留(Distillation)」とは?
蒸留とは、優れたAIモデルの出力を使って、別のモデルを訓練する技術です。
例えるなら「優秀な先輩の答案をひたすらコピーして勉強する」ようなもの。通常、AI企業は自社のモデルを小型化・効率化するために蒸留を使います。これ自体は合法的な技術です。
しかし今回の問題は、競合他社が他社のモデルに対して大規模に蒸留を行い、本来なら莫大な時間とコストがかかる能力開発を、不正に「ショートカット」していた点にあります。
3社それぞれの手口と規模
Anthropicが公開した調査結果によると、各社の攻撃規模と狙いは大きく異なっていました。
DeepSeek:15万回以上のやり取り
DeepSeekの攻撃は3社の中では最小規模でしたが、狙いは非常に戦略的でした。
- 基礎的な論理・推論能力の抽出
- Claudeを「報酬モデル」として利用した強化学習タスク
- 政治的に敏感なクエリに対する「検閲回避版」の回答を生成させ、訓練データとして蓄積
特に3つ目は注目すべきポイントです。Claudeが安全対策として設けているガードレールを、逆手に取って「制限を外したバージョン」の訓練データを作っていたことになります。
Moonshot AI:340万回以上のやり取り
Moonshot AIはより広範な能力の抽出を狙っていました。
- エージェント推論・ツール使用能力
- コーディング・データ分析能力
- コンピュータ操作エージェントの開発
- コンピュータビジョン
さらに、複数のアクセス経路を使い分けることで検出を回避しようとしていたことも判明しています。
MiniMax:1,300万回以上のやり取り
3社の中で最大規模の攻撃を行ったのがMiniMaxです。1,300万回以上のやり取りは全体の約80%を占めます。
- エージェント型コーディング能力の抽出
- ツール連携・オーケストレーション機能の習得
MiniMaxはClaudeの最も差別化された能力エージェントとしてツールを組み合わせて複雑なタスクをこなす力を集中的に狙っていました。
なぜこれが「ただのコピー」では済まないのか
Anthropicがこの問題を深刻に捉えている理由は、単なる知的財産の侵害にとどまらないからです。
安全対策の喪失
Anthropicをはじめとする米国のAI企業は、モデルが生物兵器の開発やサイバー攻撃に悪用されないよう、多層的な安全対策を組み込んでいます。
しかし、不正な蒸留で作られたモデルにはこれらの安全対策が引き継がれない可能性が高い。つまり、危険な能力だけが「安全装置なし」で拡散するリスクがあります。
軍事・監視システムへの転用
Anthropicは公式ブログで、不正に蒸留された能力が「軍事、諜報、監視システム」に組み込まれるリスクを明確に指摘しています。高度な推論能力やコンピュータ操作能力が、権威主義的な政権の手に渡る可能性は、単なるビジネスの問題ではありません。
輸出規制の裏付け
蒸留攻撃を大規模に行うには、高性能な計算チップが必要です。Anthropicは「蒸留攻撃の存在自体が、半導体輸出規制の正当性を裏付けている」と主張しています。
Anthropicの対策
Anthropicはこの問題に対して、複数の防御策を講じています。
- 検知システム:APIトラフィックのパターン分析により、蒸留目的のアクセスを自動検出
- 業界連携:他のAI企業やクラウドプロバイダーと技術的な指標を共有し、業界全体で対策
- アクセス制御の強化:アカウント認証の厳格化、地域制限の強化
- モデルレベルの保護:蒸留の効率を低下させる技術的な防御措置の導入
AI業界への影響
今回の公表は、AI業界全体に大きな波紋を広げています。
Anthropicは「単一企業での解決は不可能」と明言し、AI企業・クラウドプロバイダー・政策立案者が協調して対処する必要があると訴えています。
実際に、このニュースはSNS上で爆発的な反響を呼んでおり、Anthropicの公式ポストは投稿から数時間で1,400万回以上表示され、4万以上のいいねを獲得しています。
今後、米国のAI輸出規制の議論がさらに加速することは間違いありません。同時に、AI企業がモデルの保護にどこまでリソースを投じるか、そしてオープンなAPI提供と知的財産保護のバランスをどう取るかという難しい課題が浮き彫りになりました。
まとめ
| 項目 | 内容 |
|---|---|
| 発表日 | 2026年2月24日 |
| 発表者 | Anthropic |
| 対象企業 | DeepSeek、Moonshot AI、MiniMax |
| 不正アカウント数 | 約24,000件 |
| 総やり取り回数 | 1,600万回以上 |
| 主な抽出対象 | エージェント推論、ツール使用、コーディング能力 |
| 最大の懸念 | 安全対策を欠いたモデルの軍事・監視転用 |
AIの能力が向上するほど、その「能力の窃取」がもたらすリスクも大きくなります。今回のAnthropicの公表は、AI開発競争がもはや技術だけの戦いではなく、安全保障の問題でもあることを改めて示しました。











