美國政府於週五以國家安全為由,命令 Anthropic 立即關閉其兩款最強大的人工智慧模型,Claude Fable 5 和 Claude Mythos 5 的存取權限。Anthropic 在 X 上宣布已遵從指令,但明確表示他們認為政府的決定有誤。

Anthropic 表示,這項指令於美東時間週五下午 5 點 21 分收到,強制該公司對全球所有用戶停用這兩款模型,而不僅僅是政府出口管制命令名義上針對的外國國民。Anthropic 其他模型的存取權限則不受影響。

為何此事如此重要?Mythos 是 Anthropic 最強大的 AI 模型,該公司在四月初預覽後便嚴格限制其使用,因為 Anthropic 形容它在尋找軟體安全漏洞方面具有卓越能力。據 Anthropic 說法,Mythos 在所有測試過的主流作業系統和網頁瀏覽器中都發現了缺陷。

因此,Anthropic 並未廣泛發布 Mythos,而是啟動了一個名為「Project Glasswing」的受控計畫,與約 50 個經過審查的組織分享,包括 Amazon、Apple、Google、Microsoft 和 CrowdStrike,用於防禦性網路安全工作。而 Fable 5 則是在三天前發布,是 Anthropic 為應對明顯的商業壓力而推出的版本。

Fable 5 是 Mythos 的一個變體,配備了防護措施,可阻擋網路安全和生物學等高風險領域的回應,Anthropic 認為這使其足夠安全,可以公開發布。根據追蹤 AI 技術性能的 Vals AI 公司基準測試,Fable 5 立即成為當時公眾可用的最強大 AI 模型。

政府的指令被定性為出口管制行動,限制外國國民存取這些模型。但在 Anthropic 的一篇長篇部落格文章中,該公司表示其理解是,根本原因在於 Fable 5 據稱被「越獄」。Anthropic 稱,到目前為止,政府只提供了「潛在的、狹窄的、非普遍性越獄」的口頭證據。

Anthropic 形容這種越獄行為,無非是提示模型讀取特定程式碼庫並識別軟體缺陷。該公司補充說,這種「能力水平」在其他公開可用的模型中已經廣泛存在,包括 OpenAI 的 GPT-5.5。Anthropic 還表示,網路安全專業人員也經常將其用於防禦目的。

Anthropic 更廣泛的論點是,其最強大的安全防護措施是透過獨立的分類器系統運作,這些系統與模型本身是分開的。這意味著即使有人說服 Fable 在拒絕後繼續對話,針對最危險輸出的底層保護仍然存在。

顯然,這些都未能阻止政府採取行動,Anthropic 也沒有隱藏其沮喪。「我們不同意發現一個狹窄的潛在越獄就應該成為召回一個已部署給數億人的商業模型的理由」該公司寫道。「如果這個標準適用於整個行業,我們認為它將實質上阻止所有前沿模型供應商的所有新模型部署。」

Anthropic 普遍預計將在今年進行首次公開募股(IPO),並將其大部分公開形象建立在作為其競爭對手「安全意識」的替代方案上。觀察家們沒有忽略其中的諷刺意味:Anthropic 在限制 Mythos 時所展現的謹慎,它將其宣傳為一個危險到無法公開發布的模型,現在顯然吸引了正是那種可能對其業務造成最大干擾的政府審查。

OpenAI 的 Sam Altman 至少對此感到樂見。四月時,他告訴播客主持人 Ashlee Vance,Anthropic 對 Mythos 的處理方式無異於「基於恐懼的行銷」。「很明顯,說『我們製造了一顆炸彈。我們即將把它投到你頭上。

我們將以 1 億美元的價格賣給你一個防空洞』是一種令人難以置信的行銷方式」Altman 說。Altman 的公司也普遍預計會盡快進行 IPO,他沒有預測政府會關閉模型,但他確實指出了一點,這現在反過來困擾了 Anthropic:當你花數月時間告訴全世界你的 AI 獨特危險時,全世界,包括美國政府,往往會聽進去。