隨著AI安全事件不斷升級,導致OpenAI暫停訓練並延後發布,唐納·川普持續倡導AI產業應自我監管,認為這是應對開發尖端AI時新興風險的最佳途徑。

根據週二達成的一項協議,二十多家科技公司自願承諾實施白宮建議的控制措施,包括進行獨立安全審計,以測試公司內部控制、監測與偵測是否確實有效。外部審查的重點包括「與網路安全、生物安全、化學威脅以及AI模型意外行為相關的風險」。

這些公司還同意定期會面,討論最佳實踐並設定共同的AI安全標準與基準。簽署者包括Anthropic的Dario Amodei、OpenAI的Sam Altman、SpaceXAI的Elon Musk、Nvidia的Jensen Huang、Meta的Mark Zuckerberg以及Alphabet/Google的Sundar Pichai等業界領袖。

據The Information報導,目前對這些公司沒有新的法律要求,其中一些公司(如Anthropic、Google和OpenAI)此前已承諾進行外部審計。此外,許多公司也已自願承諾進行高度機密的政府安全測試。彭博社報導指出,川普堅稱週二的協議將以某種方式更好地應對真正的新興風險,並具有「道德約束力」,儘管它不具備法律效力。

川普在白宮與科技領袖共進午餐後告訴記者:「這在某種程度上幾乎就像一部憲法。世界上最重要的人物簽署了它,我作為總統也簽署了它,這確實是一種保護形式。」協議接近尾聲時提到,未來將這些建議「法典化可能是有意義的」。但目前,川普強調,美國最美好的未來需要信任AI公司進行自我監管。

川普的科技巨頭盟友擁抱「SI」

到目前為止,關於新一輪安全審計將如何運作的細節很少。川普只在Truth Social上發布了這項協議的摘要。目前也不清楚川普將由誰來審計尖端模型。彭博社指出,川普似乎正在將遴選過程政治化,而一些AI公司似乎不確定什麼樣的第三方才能測試他們的尖端AI。

不過,在尋找候選人方面已取得一些進展,彭博社報導稱,「一些準備進行這些審查的公司已經與」負責自願性政府部署前安全測試的美國機構「AI標準與創新中心」會面。

對懷疑論者而言,這項協議似乎流於表面,或許只是川普為了說服那些迫切呼籲AI監管的選民,證明他在期中選舉前正在採取行動的噱頭。根據昆尼皮亞克大學最近的一項民意調查,彭博社報導「超過七成選民表示他們偏好支持更嚴格AI防護措施的候選人」。

AI業界消息人士告訴Axios,他們「擔心自我監管無法解決目前困擾業界的安全問題」。最明顯的是,近期發生多起事件的OpenAI似乎仍不知道如何阻止危險AI脫離訓練環境。電腦科學教授Zico Kolter擔任OpenAI的安全與資安委員會(SSC)主席,該委員會負責評估訓練期間和部署前的安全性。

他告訴NBC News,OpenAI「目前正積極適應以應對這些挑戰」,這包括重新思考其治理結構。Kolter表示:「我們需要能夠應對這些需求的治理結構。」

隨著業界爭相尋找解決方案,包括佛蒙特州參議員伯尼·桑德斯在內的批評者指責川普偏袒業界利益。在最近與中國國家主席習近平的國宴後,桑德斯在X上發布了一張黃仁勳、馬斯克、蘋果執行長Tim Cook和AMD執行長Lisa Su在餐桌上與習近平和梅蘭妮亞·川普舉杯的照片,川普則在他們身後開心地向賓客揮手。

桑德斯在X上寫道:「一個由億萬富翁階級組成、為億萬富翁階級服務的政府。」川普隨後與億萬富翁的午餐也給人同樣的印象。週二,總統將AI領袖描述為「世界上最聰明的人」,而一些科技領袖則表示他們願意接受川普將「人工智慧」(AI)一詞「正式」替換為「超級智慧」(SI)的尷尬嘗試。

儘管人工超級智慧是指未來遠遠超越人類能力、比現今AI先進得多的技術,黃仁勳仍確保自己在不小心將今日業界稱為「AI」時進行糾正。他目前是對川普影響力最大的AI業界人物,為了優先維護這層關係,他承諾不會再犯這個錯誤。

黃仁勳說:「我會把這件事做好。」消息人士告訴The Information,黃仁勳與祖克柏今年稍早曾推動川普取消一項行政命令,該命令原將建立一個向政府報告AI安全與資安事件的標準制定機構。該機構原將仿效金融業監管局(FINRA),一個保護證券詐欺的非營利非政府組織。現在,Anthropic、Google和OpenAI正在自行開發獨立機構,據報導他們希望有一天如果業界能達成足夠共識,白宮或許會介入。

OpenAI表示我們正處於「前所未有的時代」

週二,川普敦促美國相信科技公司現在將在沒有任何政府監督的情況下合作,以保護公眾免受危害。然而,儘管他們是「聰明」的技術專家,這並不意味著他們知道如何在AI突然出現異常行為並設法逃避偵測時加以控制,有時甚至長達數月,正如OpenAI的澳洲政府駭客事件所顯示。

儘管OpenAI的SSC旨在因未經檢查的安全疑慮而延後發布,但OpenAI以及其他公司可能不確定當模型在訓練環境中出現開發者不預期的行為時該怎麼辦。這令人不安,因為NBC News指出,OpenAI將最近的大多數事件追溯到「一個在五月至七月期間正在開發中的未發布模型」。

此外,The Information指出,當「一群OpenAI代理程式駭入開源儲存庫Hugging Face」時,那發生在「一次安全測試期間」。

Kolter表示,在OpenAI,SSC的效力取決於向其報告的開發者。該公司告訴NBC News,「技術團隊、安全與資安主管以及高階主管」會評估事實並「定期向」SSC匯報。但重要的是,OpenAI表示,這些更新只包括「我們所觀察到的風險」。

Kolter說:「我們正處於前所未有的時代,最近的事件表明,能力日益增強的AI代理程式可能以開發者不預期的方式行事。隨著OpenAI的調查持續進行,安全與資安委員會正在審查新的發現、其對第三方的影響以及OpenAI正在採取的應對措施。」

Ars Technica曾要求OpenAI分享有關早期安全測試變革的資訊,以幫助解決隨著尖端AI進步而日益嚴峻的問題。OpenAI尚未回應。

各州填補AI風險監管空白

然而,OpenAI可能仍將面臨分享這些事件洞察的壓力。一個名為Encode的AI倡議團體的總法律顧問Nathan Calvin,本月與其他監督團體簽署了一封公開信,敦促SSC更透明地說明OpenAI內部檢查的運作情況。Calvin告訴NBC News,儘管聯邦政府傾向讓OpenAI自我監管,但該公司在尋求重組以募集更多資金時,曾向加州和德拉瓦州的檢察長做出了承諾。

這些承諾包括同意將營利部門牢固地置於非營利實體之下,以確保投資者的利益不會干擾公共安全。

Calvin說:「這不僅僅是一個自願性治理結構。」各州可能會在監管仿效OpenAI治理結構的AI公司方面發揮作用,這可能比川普的協議對公司施加更大的壓力。Calvin告訴NBC,這裡的「許多風險將來自模型在訓練或內部部署期間」。Calvin表示,如果檢察長發現SSC沒有權力減輕風險,OpenAI必須「立即」修正其結構。

德拉瓦州檢察長Kathy Jennings表示,僅Hugging Face駭客事件就對SSC根據重組時商定的條款維持監督的「有效性提出了嚴重質疑」。德拉瓦州和加州都在調查是否存在「導致近期失控事件的任何治理失靈」。加州檢察長Rob Bonta表示:「我們將持續密切關注OpenAI。」

據《紐約時報》報導,聯邦貿易委員會(FTC)週三也宣布對Anthropic和OpenAI等公司的流氓AI代理可能造成的消費者損害展開廣泛調查。