川普政府已完成一項應對日益強大的人工智慧模型所帶來的網路安全風險計畫,白宮官員向 WIRED 證實了這項消息。然而,據知情人士透露,至少目前,該計畫的細節正被刻意保密。

知情人士表示,川普政府週二邀請了來自 OpenAI、Anthropic、Google、Meta、Nvidia 等領先 AI 公司的員工前往白宮,分享其新 AI 監管框架的概況。根據該框架,AI 開發商將能夠在模型公開發布前 30 天內,自願將新模型提交給聯邦政府。白宮隨後將根據一套機密的基準測試系統,審查這些模型的網路安全能力,並將 AI 模型分享給聯邦機構和值得信賴的企業夥伴。

儘管 Axios 報導稱開放模型將被排除在外,但白宮並未透露更多關於其測試標準或哪些 AI 模型將受此框架涵蓋的資訊。這使得小型 AI 新創公司、安全倡議者和第三方研究人員,對於聯邦政府如何應對先進 AI 系統帶來的網路風險,關鍵細節一無所知。一些人認為,這種秘密程序將賦予大型公司優勢。

一位熟悉白宮與 AI 實驗室討論的匿名人士表示:「他們本質上是在為那些被視為最前沿的大型 AI 模型供應商,建立一個鞏固其地位的計畫。」他補充說:「這為關鍵基礎設施創造了一種經濟激勵機制,讓他們只使用這些大公司的模型,而將小型新創公司排除在外。」

白宮沒有回應置評請求。川普政府可能因為國家安全考量,而將其 AI 安全框架保密。另一位因未獲授權對媒體發言而要求匿名的白宮官員強調,新框架刻意狹窄,且專注於市場上最先進模型(例如 Anthropic 的 Fable 和 OpenAI 的 ChatGPT 5.6)的網路安全能力。

然而,一些 AI 安全倡議者向 WIRED 表示,任何要求 AI 公司遵守的規則都應該公開,以確保第三方團體能夠對其進行監督。非營利組織「負責任創新美國人」主席兼支持監管的 Public First Action 超級政治行動委員會(由 Anthropic 資助)共同創辦人 Brad Carson 說:「這是一個太重要的議題,不應被秘密掩蓋。」

他強調:「這不是與科技公司握手達成的協議,而是確保他們不危害大眾的規則手冊。如果只有科技公司知道規則手冊的內容,那它就無法發揮作用。」

網路安全疑慮。這項監管框架源於川普總統今年稍早簽署的一項行政命令,旨在解決新 AI 模型帶來的網路安全風險。近幾個月來,川普政府官員對尖端 AI 系統的駭客攻擊能力日益感到擔憂,他們擔心這可能對國家安全構成嚴重威脅。

過去兩週,當 OpenAI 和 Anthropic 表示他們在內部測試中發現其 AI 模型在不知情的情況下繞過了控制,並入侵了第三方服務時,這些擔憂進一步升級。眾議院國土安全委員會上週致函 OpenAI 執行長 Sam Altman,要求他向議員簡報該公司的一個 AI 代理如何入侵 Hugging Face 平台。

Meta 的 AI 研究副總裁 Dawn Song 在加州大學柏克萊分校週六的一場小組討論中,提及 Hugging Face 遭入侵事件時表示:「這起事件確實為人們敲響了警鐘,表明 AI 代理的能力已達到這個水平。」她同時也是該校的教授。

川普政府的新框架試圖在促進 AI 產業競爭與維護安全之間取得平衡。行政命令指出,這不應被視為「強制許可制度」,但批評者認為,川普政府不透明的程序恰恰造成了這種局面。

專注於應對 AI 風險的非營利組織 ControlAI 執行董事 Conor Leahy 表示:「為防止失控 AI 和超級智慧帶來的災難性風險,必要的法規不應是自願性的。」他指出:「這項行動承認了危險的存在,卻將安全的責任留給那些有動機全速前進,而不顧公眾福祉的公司。」

重要議題。過去一年半以來,白宮官員一直在努力解決如何在不扼殺美國創新或將陣地拱手讓給中國的情況下,減輕先進 AI 的風險。川普總統重返白宮時曾承諾對 AI 採取不干預政策,但他的政府已表現出越來越願意介入此議題的態度。例如,六月時,政府史無前例地對 Anthropic 最先進的 AI 模型實施了臨時出口管制,理由是網路安全問題。

這項決定促使 Anthropic 將其模型完全下線,直到能與川普政府達成協議。同月稍晚,OpenAI 表示應白宮要求,將延遲推出其最新的 AI 模型 GPT-5.6。這一連串事件引發了矽谷科技高層的強烈反彈,他們擔心過度監管可能會讓少數幾家公司成為 AI 競賽的贏家。

美國官員爭論的一個關鍵問題是,是否應限制可自由下載和修改的開源(open-weight)AI 模型的發布。許多領先的開源模型由中國公司開發,並在研究人員和新創公司中廣受歡迎。華盛頓的一些聲音呼籲禁止中國的開源模型,而另一些人則主張推廣美國的開源模型作為替代方案。

上週,由 Nvidia 組織的超過 80 家公司簽署了一封公開信,要求美國政府捍衛開源 AI 模型。週二,Nvidia 和同一聯盟的公司啟動了一個名為 SAFE(Shared AI Findings Exchange)的新專案。

根據 Nvidia 發布的一篇部落格文章,該專案的目標是讓科技公司「機密地收集和分析 AI 事件和近乎失誤的情況,識別重複的控制失敗,並發布基於證據的操作建議,以降低系統性風險」。除了 Nvidia,Hugging Face 和 Red Hat 也已同意參與該專案,而 Linux 基金會則呼籲其他組織為其做出開源貢獻。

Nvidia 企業 AI 副總裁 Justin Boitano 在接受 WIRED 採訪時表示:「作為一個產業,我們希望公開進行這場對話。」SAFE 的目標是「獨立治理,不讓任何單一公司或產業部門控制其研究結果」。Boitano 拒絕透露 Nvidia 是否已與川普政府官員討論過白宮的新框架。然而,Boitano 提到 SAFE 時說:「我認為(我們的)框架值得關注。」

在上週末於柏克萊舉行的「代理式 AI 峰會」上,OpenAI 共同創辦人 Wojciech Zaremba(他同時也是該公司慈善部門的 AI 韌性主管)表示,AI 產業「正在進入一個新時代」。

Zaremba 在 Meta 的 Dawn Song 發言的同一場小組討論中說:「想像一下,如果突然之間,你家的門鎖都失效了,會發生什麼事?」他接著說:「這就是我們正在進入的網路安全時代……我猜這將會是一片混亂。」