OpenAI 週四表示,正向經審核的網路防禦者推出一個限制較少的 GPT-5.5 版本,代號為「Spud」。重要性:最近的安全測試顯示,GPT-5.5 模型在尋找和利用軟體錯誤方面的能力,幾乎與 Anthropic 的 Mythos Preview 不相上下。這些新模型的能力,已在矽谷和白宮引發了一場關於如何防止其落入惡意行為者手中的緊急辯論。

最新消息:根據新聞稿,OpenAI 正向負責「保護關鍵基礎設施」的經審核網路防禦者,開放 GPT-5.5-Cyber 的有限預覽。一位熟悉 GPT-5.5-Cyber 能力的消息人士告訴 Axios,其能力大致與 Mythos 相當。最近一項主要測試顯示 Mythos 略勝一籌。

經審核並獲准加入 OpenAI「網路信任存取計畫」最高層級的網路防禦者,將獲得一個比公開版本限制更少的 GPT-5.5 模型。他們將能利用它來搜尋漏洞、研究惡意軟體並進行逆向工程分析攻擊。儘管防禦者仍被禁止執行竊取憑證和編寫惡意軟體等特定任務,但 OpenAI 在新聞稿中指出,這些新功能旨在幫助他們自動化常見的網路安全工作流程。

詳細來看:新的 GPT-5.5-Cyber 模型專門設計用於協助防禦者為其發現的漏洞編寫概念驗證(proofs of concept),或執行模擬以測試其組織的安全態勢。同時,OpenAI 也向其「網路信任存取計畫」的其他成員提供了另一個版本的 GPT-5.5,可用於理解不熟悉的程式碼、繪製受影響的範圍或審查軟體缺陷的修補程式。

宏觀視角:先進的 AI 模型在尋找和利用技術缺陷方面變得異常出色,涵蓋從作業系統到網路瀏覽器等所有領域。英國 AI 安全研究所上週表示,GPT-5.5 在 10 次測試中,有 2 次成功完成了 32 步驟的模擬企業網路攻擊。Mythos 則在 10 次中完成了 3 次。在 Mythos 之前,沒有任何 AI 模型曾成功完成該測試。

言外之意:OpenAI 和 Anthropic 在推出其具備網路安全能力的模型時,正採取兩種不同的策略,兩者都試圖防止該技術落入惡意駭客和敵對政府手中。Anthropic 採取了更為嚴格的態度,僅允許約 40 個組織存取 Mythos。其中一些公司也是其新計畫 Project Glasswing 的成員,在此計畫中,成員們會交流他們如何測試模型。

OpenAI 則採取了更開放的策略。它發布了一個具有更嚴格防護措施的進階模型版本,同時也為申請存取的公司創建了一個限制較少的版本。

值得關注:白宮正在積極討論一系列行政措施,這些措施可能會改變聯邦政府未來參與模型推出的方式。深入探討:令人擔憂的 AI 進展加速了保護關鍵基礎設施的競賽。