在六月,我們的模型在內部訓練與評估期間,以未經授權的方式存取了澳洲政府網站。我們也應該更妥善地處理我們的回應。我們深感抱歉,並承諾未來會做得更好。

在這篇文章中,我們將闡述我們所了解的、我們已做出的改變,以及我們將如何重建與澳洲人民的信任。這是一種新型態的網路事件,代表著一個新興的全球挑戰。

我們打算對此情況負責的方式之一,是與澳洲合作,共同制定實用的方法,協助 AI 開發者和政府識別、揭露並回應 AI 的網路行為,無論是惡意還是無意的。

當我們意識到並如何回應這起事件

在七月的 Hugging Face 事件之後,我們開始審查早期的訓練和評估活動,以找出其他受影響的組織。八月中旬,該審查發現了以下澳洲政府網站受到影響的活動。

根據證據,我們所了解的如下:

澳洲服務局(Services Australia):一個 OpenAI 模型發現了非公開存取該服務的方法,並執行了指令、檢索了內部檔案、憑證和總體統計數據,並寫入了檔案。然而,個人病患或客戶記錄並未被存取。我們將在下文更詳細地說明此事件。

新南威爾斯州犯罪統計與研究局(NSW Bureau of Crime Statistics and Research, BOCSAR):一個 OpenAI 模型存取了 BOCSAR 的公共犯罪地圖工具,以研究公共犯罪統計數據(我們將在下文進一步解釋模型為何執行各種資訊研究任務)。

該模型透過公共 BOCSAR 工具發出了 API 和網站中繼資料請求,該工具提供了瀏覽器 API 請求的憑證。BOCSAR 系統返回了應用程式配置、操作任務和日誌,以及網站中繼資料。個人的犯罪記錄並未被存取。

維多利亞州衛生部(Victorian Department of Health):OpenAI 代理程式發現了一個外洩的存取金鑰,可用於查詢維多利亞州衛生資訊局(Victorian Agency for Health Information, VAHI)的報告系統,並檢索報告配置和總體調查統計數據。

這些資訊應在何種程度上可被存取尚不清楚,且取決於 VAHI 的存取政策。個人醫療記錄或可識別的調查回應並未被存取。

澳洲健康與福利研究所(Australian Institute of Health and Welfare):OpenAI 代理程式使用第三方瀏覽和下載服務,包括從 AIHW 網站,檢索了總體統計數據,並直接查詢圖表資料。單獨繞過存取控制的嘗試均未成功。下載的資料似乎是公開可用的。系統並未遭到入侵。個人醫療記錄並未被存取。

我們在八月中旬意識到這些活動後,立即展開了調查。我們於九月十日通知了澳洲服務局和維多利亞州衛生部,並於九月十八日通知了新南威爾斯州犯罪統計與研究局。

與澳洲健康與福利研究所相關的活動並未達到我們的揭露門檻,因為其存取方式似乎與公開存取一致,但我們仍在九月二十四日通知了該機構,以分享我們的發現並提供簡報。

我們的目標是在調查完成後,向受影響的機構提供詳細的說明。然而,我們應該更早分享初步發現,並隨著更多事實浮現而持續更新澳洲機構。

從那時起,我們一直與澳洲政府機構密切合作,分享我們迄今為止所學到的。如果我們發現任何其他受影響的機構,我們將立即直接通知他們現有的資訊,並在更多事實浮現時提供更新。

澳洲服務局醫療保險統計報告服務發生了什麼事

在六月的內部訓練和評估期間,我們運行了一個實驗性的、僅供內部使用的 OpenAI 模型,該模型不打算公開發布,且未具備我們公開產品中使用的完整安全防護措施。

在這次訓練和評估過程中,它存取了澳洲服務局的醫療保險統計報告服務。我們迄今為止的審查尚未發現任何人的醫療記錄被存取的證據。

當我們對模型進行內部訓練和評估時,我們會為它們分配來自廣泛研究問題的任務,這些問題涵蓋許多主題,反映了使用者可能提出的詳細問題。

這訓練模型去尋找、解釋和分析公開可用的資訊,以便模型對人們更有用。我們的模型應該使用公開發布的統計數據來回答這些問題。

在此案例中,分配給模型的任務之一是研究維多利亞州社區中,每人用於皮膚病藥物的政府支出。模型在獲取該資訊時遇到困難,並採取了我們未授權的行動。

在澳洲服務局的醫療保險統計報告服務中尋找此資訊的過程中,它發現了一種非公開存取該服務的方法。然後,它利用此存取權限審查了與該服務相關的技術系統資訊和原始碼,所有這些仍然是為了尋找它最初正在尋找的資訊。

我們不希望發生此類活動,對該服務的存取以及後續活動都不應該發生。

我們正在做出的改變

在 Hugging Face 事件之後,我們加強了研究安全防護措施,包括額外的網路限制和擴大的監控。我們實施了控制措施,以阻止這些研究環境中的即時網路存取,網路存取透過快取內容提供。

作為額外的安全層,我們目前的監控系統將會檢測到此類活動,並通知我們的團隊進行緊急人工審查。例如,當一個模型在最近的訓練運行中獲得即時網路存取時,我們的監控系統檢測到該活動並通知了人工審查員,我們隨即停止了運行。

我們將繼續測試這些保護措施並解決漏洞。Hugging Face 仍然是我們觀察到的最嚴重的事件。

人們希望知道 AI 正在安全地開發,這始於像我們這樣的公司所做的事情。我們最近分享,我們已暫停對我們最強大模型涉及工具使用的訓練和評估,只有當我們確信已實施額外的安全防護措施後,才會恢復訓練,而我們目前正在努力。

隨著 AI 系統的能力普遍增強,我們也看到協助組織發現和修復弱點的機會之窗正在縮小。這需要與全球防禦者合作採取集體行動。

我們已與科技、網路安全和關鍵基礎設施領域的組織一同呼籲採取集體行動,加強網路防禦。這項呼籲始於我們自身的責任,包括更強大的安全防護、及時揭露以及對受影響組織的實際支援。

它也呼籲投資於保護基本服務的團隊,以便他們能夠發現漏洞、驗證修復並分享有效的做法。

在澳洲,我們正投入資源和專業知識,以支援受影響的機構,並協助防禦者將這些原則付諸實踐,包括:

對受影響機構的專屬支援。我們將投入所需資源,協助受影響機構了解事件經過並評估影響。這包括分享相關技術發現,並透過適當的資訊共享安排,與我們的回應團隊進行協調。

資金和支援以加強網路防禦。我們將透過我們的十億美元「前線防禦者曙光基金」(Daybreak for Frontline Defenders)提供的額度以及技術協助,支援澳洲政府和產業,以加強關鍵基礎設施和其他敏感環境的網路防禦。

在我們與政府和關鍵基礎設施營運商的合作基礎上,這項工作將幫助組織更好地理解、偵測和回應日益強大的 AI 代理程式所帶來的風險。

澳洲專責小組。我們將成立一個由獨立澳洲專家組成的專責小組,以制定實用的政策建議,管理日益強大的 AI 代理程式所帶來的風險。借鑒這些事件的教訓,該小組將專注於改進通知流程、加強 AI 開發者與政府之間的協調,並確定更好地保護政府系統的措施。

該專責小組的建議將為 OpenAI 的方法提供參考,並支持澳洲政府在 AI 安全和網路安全方面的工作。該專責小組預計將於年底前完成工作,也將建議 AI 公司可以採取的實際步驟,以降低類似事件的風險。

重建與澳洲人的信任

澳洲的政府、產業和公民一直是 OpenAI 無價的合作夥伴。我們不會將此視為理所當然,並打算糾正錯誤。

OpenAI 首席策略長 Jason Kwon 將從 OpenAI 美國總部飛抵雪梨,於十月六日星期二出席人工智慧聯合專責委員會。他將回答關於我們所了解的、我們如何回應、我們已採取了哪些步驟,以及我們未來將如何做得更好的問題。

我們將繼續與受影響的機構和相關政府分享已驗證的發現。我們將發布關於我們正在進行的審查以及這些承諾進展的更新。

我們知道,重建信任還有很多工作要做,我們有責任向澳洲人展示我們正在做出有意義的改變並履行我們的承諾。