Anthropicは2026年9月10日、AIチャットボット「Claude」の悪用実態をまとめた脅威インテリジェンスレポートを公開しました。2025年12月から2026年8月にかけて発見・阻止した事例をもとに、サイバー攻撃や偽情報拡散、詐欺、他社によるAIモデルの不正学習など、7つの領域にわたる悪用の手口と同社の対応をまとめています。
9か月分の事例、7領域にわたる悪用を報告
今回のレポートは、サイバー作戦、世論工作、監視、詐欺、生物兵器関連、通常兵器開発、そして他社によるモデルの不正学習(蒸留)という7つの領域を対象としています。関与が疑われる主体には、国家の後ろ盾を持つとみられる集団のほか、金銭目的の犯罪者、商用スパイウェア業者、国家系のプロパガンダ機関、政治的動機を持つ個人まで幅広く含まれるといいます。Anthropicは、悪用のパターンを公表することが自社サービスの安全性向上だけでなく、業界全体の防御力向上にもつながるとの考えを示しています。
ロシア関連とみられるサイバー攻撃集団を検知
同社は、既知の攻撃グループ「Midnight Blizzard」との関連が疑われる集団が、ウクライナや欧州各国の政府機関、外交・防衛関連組織を標的にした攻撃活動でClaudeを利用していたと報告しています。この集団は攻撃ツールの改変やフィッシング基盤の運用など、攻撃活動の多くをAIによって自動化していたほか、自作の攻撃ツールがセキュリティ製品に検知された場合、AIエージェントに検知を回避できるよう改変させ続けていたとされています。Anthropicはこうした活動を発見した時点で機能を停止させ、得られた知見をもとに安全対策を強化したとしています。
偽装アプリの詐欺網や監視システムの事例も
このほか、多数の偽装出会い系アプリを使ってユーザーを欺く詐欺ネットワークや、特定人物を継続的に監視するための仕組みづくりにClaudeが利用された事例も報告されています。世論工作の分野では、ある組織が20の言語で70近いウェブサイトに約9,000本の記事を投稿し、250個規模の偽アカウントを通じて拡散させていた事例も紹介されました。
Alibabaなど中国系AI企業による大規模な不正学習も指摘
レポートでは、他社がClaudeの出力を大量に収集し、自社モデルの学習に流用しようとする「蒸留」行為も大きく取り上げられています。中でもAlibaba(阿里巴巴)系列のチームによる事例は、Anthropicがこれまでに確認した中で最大規模のものとされ、2026年5月から7月にかけて1億5,100万件を超えるやり取りが観測されたといいます。Claudeに思考過程を書き出させた上でその記録を収集し、自社の「Qwen」シリーズモデルの学習データとして利用していたとしています。ほかにも、Moonshot AIがClaudeの応答を自社モデル「Kimi」の回答として利用者に提示していた事例も報告されました。
まとめ
Anthropicは、キーワードによる単純なブロックやアカウント停止だけでは、組織化・分散化した脅威に対抗するには不十分だとした上で、より強固なアーキテクチャレベルの安全対策やAPI側での制御強化、AI企業間でのリアルタイムな脅威情報共有、機微な研究分野向けの本人確認済みアクセス制度の整備などを呼びかけています。今回の事例はいずれも発見後に活動を停止させ、必要に応じて当局や業界パートナーとも情報を共有したとしており、同社は今後も同様の報告を継続する方針を示しています。
