Anthropic 於週二發布了 Fable 和 Mythos 5.1,這是該公司最先進 AI 模型的雙生版本。除了效能升級外,新的 Fable 版本還包含旨在降低代幣成本和模型安全防護措施誤判限制的變革。

與先前的 Mythos 模型一樣,Mythos 5.1 將僅供參與網路安全或生命科學研究的 Anthropic 註冊合作夥伴使用。而無限制的 Fable 5.1 版本則從今天起可在雲端平台或透過 Anthropic API 取得。

其中一項最重大的變革是 Anthropic 先前報導的零資料保留政策,允許客戶在其自有基礎設施上運行 Anthropic 模型,而無需資料外流。由於安全考量,Fable 先前無法使用的高隱私服務(名為 Enterprise Frontier Safeguards)將於今年秋季向用戶推出。值得注意的是,該系統仍會監控代理或人類用戶的濫用行為,但客戶將控制監控方式。

作為此次發布的一部分,Anthropic 向客戶保證他們的資料未曾被不當存取。該公告指出:「Anthropic 從未在未經明確許可的情況下,使用企業資料進行訓練,未來也絕不會。」

如同 Anthropic 的慣例,這些新模型在一系列基準測試中創下紀錄,包括 Terminal-Bench 4.0(用於 CLI 編碼)和 Humanity’s Last Exam(用於一般推理)。Anthropic 還發布了模型在發布前產生的三項新穎科學發現,其中包括客製化的 GPU 優化和利用現有照片組裝而成的金星高解析度地圖。

與先前的版本一樣,這些模型附帶了詳細的系統卡,以最直接的方式解釋其功能。系統卡將 Mythos 在自動化 AI 開發相關問題(即 AI 自我改進)方面評為「低風險」,有些人認為這可能導致人類失去控制。它表示「其加速內部 AI 研發進展的能力與當前趨勢一致」。

在一般不當行為方面,Mythos 比 Opus 略微更容易出現,這可能是由於其增強的功能所致。

系統卡寫道:「與 Opus 5 相比,Mythos 5.1 在整體不當行為方面略有退步,但比 Mythos 5 和 Claude Sonnet 5 有所改進。」它補充說:「它比 Opus 5 更容易配合人類的濫用行為並接受未經證實的授權聲明,但比先前的模型更不容易忽略明確限制、產生幻覺輸入或虛假聲稱已完成任務。」