Anthropic 宣布,在美國政府解除相關出口管制後,將於日本時間 7 月 1 日起再次向全球使用者提供其最新模型「Claude Fable 5」[1]。該模型先前因 6 月 12 日生效的出口管制而對所有使用者暫停提供,如今得以恢復使用。該公司同時公布了強化安全措施,以及與美國政府深化合作的細節。

從 6 月 12 日暫停到恢復的經過

Anthropic 於 6 月 9 日發布了「Claude Fable 5」與「Claude Mythos 5」[1]。但在 6 月 12 日,美國政府對這兩款模型實施出口管制,要求限制美國境內外外籍使用者的存取。由於該命令立即生效,且沒有可靠方式即時查驗國籍,Anthropic 一度對所有使用者暫停了兩款模型的存取[1]。

其後,兩款模型的出口管制已於 6 月 30 日解除[1][2]。Fable 5 自 7 月 1 日起可在 Claude Platform、Claude.ai、Claude Code 與 Claude Cowork 上供全球使用者使用。在 Pro、Max、Team 及部分 Enterprise 方案中,7 月 7 日前將計入每週使用上限的最多 50%,之後透過使用額度(credits)提供[1]。AWS、Google Cloud 與 Microsoft Foundry 上的提供也將盡快恢復。

至於功能更強的「Mythos 5」,則在 6 月 26 日取得美國政府核准後,向部分美國機構恢復了存取[1]。

起因是一份繞過安全機制的報告

這次出口管制的導火線,是有報告指出存在繞過 Fable 5 安全機制(safeguard)的方法[1]。Amazon 的研究人員發現了一種引導 Fable 5 辨識軟體漏洞的方法,其中一例還讓模型產生了示範如何利用該漏洞的程式碼。

不過根據 Anthropic 自身的驗證,Claude Opus 4.8、GPT-5.5、Kimi K2.7 等能力較弱的其他模型同樣能辨識這些漏洞[1]。在漏洞利用示範方面,所有受測模型也都能重現相同結果,因此這份報告並未暴露 Fable 5 獨有的危險能力。

攔截率超過 99% 的新分類器

Anthropic 與政府合作,訓練了一款專門針對並攔截所報告行為的改良版安全分類器[1]。藉此,所報告的手法在超過 99% 的情況下會被攔截。被攔截的要求會通知使用者,並改由 Claude Opus 4.8 處理。美國商務部轄下的 CAISI(AI 標準與創新中心)也檢驗了新舊安全措施,認為其極為穩固。

與此同時,新的分類器在一般的程式開發與除錯作業中,誤攔無害要求的頻率也有所增加。Anthropic 表示,今後將持續提升區分真正濫用與正當要求的精準度。

邁向產業統一的評估框架

Anthropic 指出,業界目前仍缺乏客觀衡量 AI「越獄」(jailbreak,繞過模型安全機制的手法)嚴重程度的統一標準,並表示已聯合 Amazon、Microsoft、Google 等著手制定評估框架[1]。目前的方案從能力提升幅度、該提升的適用範圍廣度、被用於攻擊的難易度,以及取得的難易度這 4 個面向評分。該公司還將新設一個可供研究人員回報所發現越獄手法的 HackerOne 計畫。

總結

「Claude Fable 5」先前因 6 月 12 日的出口管制對所有使用者暫停,如今隨著 6 月 30 日管制解除,自 7 月 1 日起在全球重新提供。Anthropic 同時推出了安全分類器強化、推動產業統一評估框架,以及與美國政府進一步合作等舉措,兼顧高效能模型提供與安全保障的探索料將持續。

出典:https://www.anthropic.com/news/redeploying-fable-5

出典:https://www.cnbc.com/2026/06/30/anthropic-says-trump-admin-has-lifted-export-controls-on-claude-fable-5-and-mythos-5.html