2026年9月10日,Anthropic公布了一份威脅情報報告,詳細說明其AI聊天機器人Claude遭濫用的情況。報告以2025年12月至2026年8月間發現並阻止的案例為基礎,涵蓋網路攻擊、假訊息散布、詐騙,以及其他公司未經授權利用Claude輸出內容訓練自家AI模型等七大領域的濫用手法,並整理了公司針對各項情況採取的因應措施。
九個月內七大領域的濫用案例
本次報告涉及網路行動、輿論操縱、監控、詐騙、生物武器相關活動、傳統武器開發,以及其他公司對Claude輸出內容的未授權蒸餾,共七大領域。報告指出,涉入其中的行為者範圍相當廣泛,包括疑似具有國家背景的組織、以牟利為目的的犯罪者、商業間諜軟體業者、國家宣傳機構,以及出於政治動機的個人。Anthropic表示,公開這些濫用模式不僅有助於強化自身的安全防護,也有助於整體產業提升應對類似威脅的能力。
疑似俄羅斯背景的網路攻擊集團
Anthropic指出,一個行為特徵與已知攻擊集團「Midnight Blizzard」相符的組織,在針對烏克蘭與歐洲多國政府、外交及國防相關機構的攻擊行動中使用了Claude。據稱,該集團利用AI將攻擊流程的大部分環節自動化,包括改造攻擊工具與釣魚基礎設施;每當其惡意程式遭安全產品偵測到時,還會指示AI代理持續對其進行改造,以規避偵測。Anthropic表示,一經發現該活動便立即將其終止,並依此強化了自身的安全防護措施。
假交友軟體詐騙網絡與監控工具
報告中也提到一個利用多款假交友軟體誘騙使用者的詐騙網絡,以及專門用於持續監控特定人士的工具。在輿論操縱方面,報告指出某組織以20種語言在近70個網站上發布了約9,000篇文章,並透過約250個假社群帳號加以擴散。
以阿里巴巴為代表的中國AI企業大規模未授權訓練
報告也特別點名「蒸餾」行為,也就是其他公司大量蒐集Claude的輸出內容,用於訓練自家模型。報告指出,與阿里巴巴相關的一起行動是Anthropic至今監測到規模最大的同類案例,在2026年5月至7月間觀測到超過1億5,100萬次互動。報告表示,該團隊誘使Claude完整寫出其推理過程,再蒐集這些紀錄作為訓練資料,用於阿里巴巴Qwen系列模型的訓練。此外,報告也提到月之暗面(Moonshot AI)曾在未告知使用者的情況下,將部分客戶請求轉發給Claude處理,再將Claude生成的回覆以自家Kimi模型的名義呈現給使用者。
總結
Anthropic表示,僅靠簡單的關鍵字封鎖與帳號停權,不足以應對有組織、分散式的威脅,並呼籲業界建立更強的架構層級安全防護、加強API層級的控管、在AI企業之間建立即時威脅情報共享機制,並為敏感研究領域設立經身分核實的存取制度。該公司表示,報告中提到的每起案例都在發現後第一時間終止,並在適當情況下與執法機關及產業夥伴共享相關情報,未來也將持續發布類似報告。
