Anthropic 宣布,為遵守美國政府週五下午發布的出口管制指令,已停用本週稍早推出的兩款 AI 模型 Claude Fable 5 和 Mythos 5。該指令引用了國家安全考量。
這起前所未有的事件,標誌著 Anthropic 與美國政府之間最新的衝突點。儘管 Anthropic 表示該命令要求其暫停「任何外國國民,無論在美國境內或境外,包括外國籍 Anthropic 員工」的存取權限,但為確保合規,公司已對所有客戶移除存取權。
今年稍早,在 Claude 開發商 Anthropic 試圖為美國軍方使用其技術劃定紅線後,川普的國防部曾將其列為「供應鏈風險」。這項認定實際上禁止政府機構和承包商使用 Anthropic 的技術。Anthropic 當時對川普政府提起了訴訟。
週二,Anthropic 公開釋出 Claude Fable 5,這是其 Mythos AI 模型的一個版本,內建了安全防護措施,可防止其回答有關網路安全、生物學和化學的問題。在公開發布之前,Anthropic 表示這是與美國政府合作進行的,Mythos Preview AI 模型已於四月進行了有限的試用。
其目標是讓公司和組織有機會利用其強大的網路安全能力來改善防禦,並消除人們對該技術可能被惡意行為者利用來開發強大駭客工具的擔憂。
Anthropic 在週五的一篇部落格文章中表示,他們於美國東部時間下午 5 點 21 分收到美國政府的信函。Anthropic 寫道:「信函沒有提供具體的國家安全擔憂細節。」
公司補充說:「我們的理解是,政府認為他們已經發現了一種繞過或『越獄』Fable 5 的方法。」「我們審查了這種特定技術被用來識別少量先前已知的輕微漏洞的演示。這些漏洞都顯得相對簡單,我們發現其他公開可用的模型也能在無需繞過的情況下發現它們。」
在部落格文章中,該公司辯稱已實施強大的安全防護措施,以降低 Claude Fable 5 被濫用的可能性。Anthropic 還聲稱美國政府發現的 Claude Fable 5 越獄漏洞是狹隘的,並不會使攻擊者比使用其他 AI 模型時更具威脅性。
該公司在部落格文章中表示:「迄今為止,政府只向我們提供了潛在的狹隘、非普遍性越獄的口頭證據,這基本上包括要求模型閱讀特定的程式碼庫並修復任何軟體缺陷。」「我們的理解是,一個潛在的越獄方法已與政府分享。」
白宮和美國商務部的發言人沒有立即回應 WIRED 的置評請求。
Anthropic 執行長 Dario Amodei 本週稍早在政策文章中表示,他和公司支持公平、結構化和透明的政府流程,以阻止不安全 AI 模型的發布。在公司週五的部落格文章中,Anthropic 辯稱「這項行動不符合這些原則」。

