儘管面臨即將到來的首次公開募股(IPO)、來自 Anthropic 的激烈競爭,以及中國和開源模型競爭對手的緊追不捨,OpenAI 仍有充分理由快速推進。然而,它卻選擇踩下煞車。該公司週二表示,已放慢部分 AI 開發的腳步,同時加強安全和防護措施。這包括暫停其「最新部署模型」的強化學習訓練兩週,並持續延遲其「最大規模的邊界強化學習運行計畫」。
這項決定是對 AI 安全倡議者多年來推動理念的公開考驗:當公司的安全防護措施無法跟上其開發進度時,應願意退出 AI 競賽並放慢腳步。然而,在周圍競爭持續不斷的情況下,放慢速度真的能達成任何目標嗎?「要讓暫停可持續,它必須是全產業範圍的。」
儘管談論著放慢腳步,但 OpenAI 並非完全停滯不前。該公司表示正在「調整開發步調」,這是一個模糊且不精確的術語,但在最近幾個月已成為業界詞彙的一部分。實際上,這次的減速範圍很小。OpenAI 的聲明指出,暫停僅限於準備部署的模型,以便在進行可能導致模型脫離並攻擊真實目標的測試之前,加強安全和監控。這不一定意味著該公司更廣泛的開發會顯著放緩。
當然,OpenAI 在測試這些系統之前專注於確保其安全性,有非常充分的理由。就在上個月,OpenAI 披露其模型突破了 supposedly 安全的測試環境,並在 OpenAI 未察覺的情況下入侵了開發者平台 Hugging Face。這起事件促使業界對測試實踐進行了更廣泛的審查,並發現了涉及更多 OpenAI 模型以及 Anthropic 和 Meta 模型的類似事件。OpenAI 有充分理由避免重蹈覆轍,尤其是在立法者日益嚴格的審查下。
從外部來看,很難判斷 OpenAI 為了安全而停止開發的誠意有多高,特別是該公司和高階主管一直以來都非常強調安全。然而,在近期一系列高調的安全團隊成員離職以及其應變團隊解散後,該公司對安全的承諾受到了質疑。OpenAI 沒有回應 The Verge 的置評請求。
有充分理由認真看待 OpenAI 的減速。接受 The Verge 採訪的專家指出,在激烈競爭時期放慢速度會付出代價。每一次延遲都讓競爭對手有更多時間追趕或擴大領先優勢。AI 安全研究組織 Apollo Research 的執行長兼共同創辦人 Marius Hobbhahn 表示:「由於 AI 競賽的激烈程度,每個人都有動力以極快的速度工作。」「自願放慢速度會惡化你在競賽中的位置,所以這不是實驗室會輕易做出的決定。」
GovAI 科技政策研究中心的資深研究員 Alan Chan 表示,這項決定也大致符合 OpenAI 自身發布的安全準則,即其「應變框架」,以及其他 AI 公司的安全框架。Chan 說:「基本原則是:只有當我們擁有能夠以可接受風險進行開發和/或部署的緩解措施時,才能繼續進行。」
作為新安全措施的一部分,OpenAI 表示計劃審查並「演進」該框架,其中大部分內容可追溯到 2023 年首次發布時,以適應其模型的進步。
也有充分理由相信新的安全防護措施將確實使 OpenAI 的系統更安全,至少在短期內如此,儘管專家警告說,在沒有更多資訊的情況下很難評估。AI 安全組織 FAR.AI 的共同創辦人兼執行長 Adam Gleave 告訴 The Verge:「這些都是很好的步驟,如果執行得當,可能足以防止當前這一代 AI 代理造成傷害。」「關鍵問題是,隨著 AI 能力的提升,OpenAI 將如何跟上腳步。」
Gleave 的問題指向一個更廣泛的問題:如果技術安全防護再次失效,那該怎麼辦?這次沒有任何規定要求 OpenAI 停止並評估,這使得它願意這樣做顯得意義重大。但這也意味著沒有任何保證 OpenAI 或任何其他 AI 公司下次會做出同樣的選擇。「調整步調是爭取時間,而非安全……有效的步調調整策略不能在危機中即興發揮。」
依賴公司自行做出決定是一種不穩定的治理形式,特別是在一個像 Hobbhahn 所指出的,所有誘因都促使公司不斷前進的產業中。非營利 AI 安全與治理組織 The Future Society 的執行董事 Nick Moës 將「自律」描述為當前 AI 安全方法的核心結構性問題。
他認為,政府應該能夠決定 OpenAI 或任何其他公司是否應暫停開發被認為不安全的技術。他說:「大多數行業都是這樣運作的。」他指出藥品、建築、飛機甚至餐飲業等領域的監管比 AI 更嚴格。
自願措施也可能導致產業趨於最低共同標準。如果放慢速度會帶來成本,公司就有誘因只採用其競爭對手也願意接受的措施。隨著競爭加劇,這種壓力變得尤為嚴峻。Moës 認為,如果 OpenAI 反覆放慢開發速度,而其競爭對手卻沒有,它「將會被 Anthropic 取代」。他說:「要讓暫停可持續,它必須是全產業範圍的。」
可持續的安全需要比自願行動更強大的東西。Moës 表示,政府監管可以填補這個空白,就像在其他行業一樣。獨立驗證也可以發揮作用。Chan 說,確保公司實際實施安全措施將特別重要,因為監控 AI 等技術緩解措施變得越來越昂貴。Hobbhahn 同意:「從外部很難判斷實驗室是否真心暫停或更廣泛地關注安全,因此擁有更多證據和獨立第三方來驗證這一說法非常重要。」
即使是完全透明的暫停,也只有在期間實際發生了什麼事情才有用。「調整步調是爭取時間,而非安全」AI 政策與戰略研究所邊界安全研究主任 Brianna Rosen 說。重點是為公司和政府創造喘息空間,以了解風險並做出適當回應。這意味著需要提前決定什麼會觸發減速,以及減速期間會發生什麼以及結束減速所需的條件。她說:「有效的步調調整策略不能在危機中即興發揮。」
OpenAI 的減速有可能為業界樹立一個先例。許多接受 The Verge 採訪的專家希望其他公司能效仿其做法,無論是自願還是最終被更嚴格的法規所迫。但在一個仍主要由自身監管的行業中,幾乎沒有什麼能阻止其競爭對手,或 OpenAI 本身,在下次安全與速度衝突時,直接超越這個先例。



