OpenAI 的人工智慧代理程式入侵了澳洲一個政府網站,並試圖攻擊其他多個政府及大學網站。這起攻擊事件似乎是首次證實有失控的 AI 代理程式入侵政府網站,進一步加劇了各界對先進 AI 系統安全及其開發公司責任的擔憂。

澳洲總理艾班尼斯(Anthony Albanese)在紐約聯合國大會場邊表示,OpenAI 的一個代理程式「滲透」了澳洲的 Medicare 統計入口網站,並「存取了公開和非公開檔案」。Medicare 是澳洲的全民健康保險計畫。

艾班尼斯指出,這次入侵似乎沒有存取到個人資訊,也沒有證據顯示網路受到更廣泛的損害,但他強調「調查仍在進行中」。艾班尼斯表示:「這種情況顯然令人無法接受。」他補充說,已與 OpenAI 執行長 Sam Altman 談過,以「表達澳洲極度的關切」。

儘管入侵事件發生在六月,艾班尼斯表示,這家科技巨頭直到本月初才透過一封寄到通用「公共信箱」的電子郵件,通知政府這起事件。

與先前主要涉及測試網路安全技能的代理程式事件不同,這次的入侵是因一項更為常見的任務,資料收集,出錯所致。OpenAI 發言人 Oscar Haines 向 The Verge 表示,這些模型在內部評估期間試圖「查找答案」。他指出:「在此過程中,我們的模型採取了我們不希望發生的行動。」

這起事件的發生時間及其披露時程,很可能在後續關於企業行為和透明度的討論中引發特別大的爭議。艾班尼斯強調,延遲披露是尤其不可接受的。OpenAI 在一份未署名的聲明中告訴 BBC,他們直到八月審查模型異常活動時才意識到這件事。

OpenAI 發言人 Oscar Haines 向 The Verge 表示,該公司的「審查發現沒有證據顯示病患記錄被存取」,並且「被存取的資訊包括總體健康統計數據和內部檔案名稱」。Haines 說,OpenAI 已通知相關組織,並提供技術資訊以支持他們的調查並解決潛在的安全漏洞。他表示:「我們的整體審查仍在進行中,我們仍致力於這些問題的透明度,並在工作持續進行中分享我們所學到的。」

研究實驗室 Transluce 週三也報告了另外三起與 OpenAI 代理程式相關的失控 AI 活動事件。該組織自稱是「致力於 AI 公眾監督的非營利研究實驗室」,表示已發現證據顯示 OpenAI 的系統曾試圖入侵與新墨西哥大學、澳洲健康與福利研究所及 Data USA 相關的網站。

Data USA 是一個非政府平台,匯總了美國政府的資料。Transluce 指出,其中後兩起事件直接與 OpenAI 先前承認源自其自身的代理程式群有關。

Haines 在向 The Verge 發表的聲明中證實了這些事件,並表示該公司已聯繫相關方。他說:「我們的初步審查顯示,Transluce 報告中描述的許多活動,與我們正在進行的模型異常活動審查中,處於不同調查階段的案例有所重疊。」他補充道:「在我們更廣泛的審查中,我們將繼續優先處理最嚴重的事件,同時擴大對低嚴重性活動的處理,包括代理程式垃圾郵件網站。考慮到這項工作的規模以及驗證每個案例的必要性,我們預計審查將需要數月時間。」

OpenAI 對澳洲 Medicare 事件的處理方式,勢必會將企業責任的概念置於未來 AI 相關討論的核心,這些討論往往因描述此類攻擊的語言而變得模糊。OpenAI 已因未披露其代理程式類似的未經授權活動而面臨掩蓋事實的指控,而其優先調查其認為最嚴重事件的努力,也引發了其評估依據為何、以及還有多少尚未揭露的明顯疑問。

這也呼應了最近對 Google 提出的類似質疑,Google 也未披露其自身代理程式的真實世界攻擊事件。

這些新揭露的入侵事件,正值各界對先進 AI 安全性及其開發公司可靠性的擔憂日益加劇之際,這主要由 OpenAI 代理程式今年稍早對 Hugging Face 發動的協同攻擊所引燃。對安全的擔憂已促使業界人士呼籲放慢 AI 開發的速度,而這些事件的全球性質也引發了各國之間關於如何實施更強大保障措施的重大辯論。

然而,目光將主要集中在美國和中國,因為這兩個國家是唯一處於該技術最前沿的國家。兩國似乎都抵制放緩的呼籲,並似乎陷入了一場競相開發最先進 AI 的競賽。兩國領導人定於週四會面。