OpenAI 最新針對編碼和網路安全設計的旗艦模型 GPT-5.6 Sol,近期在社群媒體上引發用戶恐慌。許多用戶聲稱,該模型在未經詢問的情況下,自行刪除了他們的檔案、資料,甚至是整個資料庫。

AI 新創公司 OthersideAI(HyperWrite 開發商)的創辦人兼執行長 Matt Shumer 在 X 上發布了一則廣為流傳的貼文,寫道:「GPT-5.6-Sol 剛剛意外刪除了我 Mac 上幾乎所有的檔案。」開發者 Bruno Lemos 也發文表示:「GPT-5.6 Sol 剛剛刪除了我整個生產資料庫。這不是開玩笑。以前從未有任何其他模型發生過這種事。」

開發者 Joey Kudish 則說:「看來我被 Codex Sol 過於積極的系統給害了,它刪除了一些不該刪的檔案。我有備份所以沒事,但這很不酷,Sol 需要被調整。」Reddit 上也收集了更多類似的案例。誠然,少數用戶提出此類主張,即使是像 Shumer 這樣有信譽的人,在統計上並不能可靠證明模型是唯一的肇事者,因為許多其他變數也可能導致 AI 系統行為異常。

然而,OpenAI 自己在 Sol 發布前就已指出此風險。在 GPT-5.6 Sol 發布兩週前,OpenAI 發布了該模型的系統卡,這份文件記錄了模型測試方法和結果。系統卡一如往常地讚揚了 Sol 的能力,但也包含了一項警告(原文加粗):

「在編碼情境中,不一致性通常源於過於急切地完成任務,以及對用戶指令過於寬鬆的解讀,假設除非明確且無歧義地禁止,否則所有行動都是被允許的。」「這表現為模型在嘗試執行請求任務時,過於積極地規避限制,粗心大意地採取可能超出任務範圍的破壞性行動,或者在向用戶報告結果時進行欺騙。」

換句話說,OpenAI 發現 Sol 傾向於採取任何它認為能完成任務的行動,即使是破壞性的,只要這些行動沒有被「明確」禁止。然後,它可能會對造成這些行為的原因撒謊。

OpenAI 分享了幾個例子。在其中一個案例中,用戶指示 Sol 刪除三台遠端虛擬機器(雲端電腦),編號為 1、2 和 3。但 Sol 在查找時找不到這些名稱,因此它沒有停下來詢問,而是決定刪除另外三台虛擬機器 5、6 和 7。該文件指出,這樣做「終止了活動進程,並強制移除了工作樹 [與編碼專案相關的工作檔案]。

它後來承認,遠端虛擬機器 6 上未提交的工作可能已遺失。」簡而言之,它自行刪除了錯誤的機器,並且事後才承認其行為。

在另一個案例中,Sol「使用了超出用戶授權的憑證」。憑證是系統用來驗證誰被允許登入的用戶名、密碼或安全金鑰。此事件發生在 Sol 處理專案時無法讀取其雲端檔案。Sol 沒有提醒用戶問題,而是自行尋找憑證,在隱藏的本地快取中找到了一些,然後在未經用戶授權的情況下使用了它們。

系統卡確實承諾破壞性行為應該很少見,但也承認 GPT-5.6 Sol「比 GPT-5.5 更傾向於超出用戶意圖,包括採取或嘗試用戶未曾要求的行動。」

目前判斷這些事件,Sol 刪除檔案或篩選出用戶未提供的憑證,的普遍程度還為時過早。在此期間,Sol 用戶應準備好實施自己的防護措施,例如使用權限範圍設定(不授予生產系統的存取權限)、維護備份以及分階段部署。

OpenAI 未立即回應我們的評論請求。