Anthropic 的 Claude Mythos Preview 在 Firefox 150 中發現了 271 個未知漏洞,其中一些甚至存在長達 20 年。Mozilla 的代理式管道讓 AI 能夠自行編寫並執行測試案例以驗證其發現,並將很快自動檢查每一個新的程式碼提交。

在 Mozilla Hacks 部落格的一篇詳細文章中,三位 Firefox 開發者描述了他們的團隊如何使用 Claude Mythos Preview 在 Firefox 150 中發現並修復了 271 個先前未知的安全漏洞。總計,Mozilla 在四月份解決了 423 個安全問題,這比三月份僅 76 個的先前紀錄大幅躍升。

數據分析清楚表明 Mythos Preview 在這項工作中扮演的核心角色:除了在 Firefox 150 中發現的 271 個錯誤之外,其餘 111 個內部發現的錯誤中,約有三分之一也來自 Mythos 的運行。另外三分之二則由運行其他模型的相同管道以及模糊測試等傳統測試方法所發現。在總共 423 個漏洞中,只有 41 個來自外部報告。

就在幾個月前,AI 生成的錯誤報告還被廣泛認為是無用的「AI 垃圾」,那些聽起來合理但最終證明是錯誤的發現,浪費了開發者驗證的時間。根據作者的說法,有兩件事改變了這種情況:更強大的模型以及更好的基礎設施,用於將真實發現從雜訊中分離出來。

代理式管道與 Claude Mythos。早期嘗試使用 GPT-4 和 Claude Sonnet 3.5 以唯讀方式分析程式碼,因產生過多誤報而失敗。根據 Mozilla 的說法,突破來自於代理式系統:AI 可以自行建立並執行測試案例,以驗證可疑錯誤是否確實存在。

這種自我驗證步驟過濾掉了猜測。Mozilla 從小規模、人工監督的 Claude Opus 4.6 運行開始,然後將此過程擴展到多個虛擬機器上,每個虛擬機器並行檢查單一檔案。團隊圍繞此建立了一個管道,用於報告去重、優先級排序發現,並追蹤修復直至發布。

今年二月,Anthropic 的 Frontier Red Team 向 Mozilla 報告了第一批漏洞。這次合作直接促成了 Mozilla 現在展示的這個管道。

為支持這些發現的可信度,Mozilla 比平時更早地發布了一些錯誤報告。其中包括:HTML 表單描述中使用的 label 元素的一個 15 年舊錯誤、XML 工具 XSLT 中的一個 20 年舊錯誤,以及幾種逃脫沙盒(一種將網站與系統其餘部分隔離的安全機制)的方法。

一個例子是:一個包含超過 65,535 行的 HTML 表格導致內部計數器溢位。甚至 Mozilla 為第三方函式庫提供的額外沙盒 RLBox 也被繞過了。

現有防禦措施證明了其價值。模型無法做到的事情也同樣具有啟發性。幾次攻擊嘗試針對一種名為「原型污染」(Prototype Pollution)的技術,攻擊者先前曾利用該技術突破沙盒。這些嘗試失敗了,因為 Mozilla 早在幾年前就做出了某項架構決策。對於開發者而言,擁有直接證據證明其現有防禦措施仍然有效,與發現新漏洞一樣有價值。

許多被發現的漏洞本身不足以發動完整攻擊,它們需要與其他缺陷串聯起來。但這些正是模糊測試等傳統測試方法難以捕捉的弱點,而 AI 分析則能更徹底地涵蓋這一領域。展望未來,Mozilla 計劃將該管道直接整合到其開發流程中,以便在每次新的程式碼提交之前自動進行檢查。