詹姆斯·麥迪遜在《聯邦黨人文集》第 48 號中曾問道:「僅憑這些羊皮紙屏障,是否足以抵禦權力侵蝕的野心?」OpenAI 很高興推出「AI 未來」部落格,這是我們新成立的「策略未來」團隊的發聲平台。我們是一個小型團隊,共同目標是回答一個核心問題:在變革性 AI 崛起之際,自由社會應如何重構,以維護個人權利與自主性?
這類問題在廣泛的 AI 安全與政策社群中,有時被稱為「權力集中風險」。我們的團隊基於一個理念而成立:從長遠來看,這類風險是最大、最嚴峻,也是在概念上最難以解決的。為什麼會這樣呢?
現代國家是資本與商品所有者、政治權力掌握者以及人民之間,長期且不平衡的討價還價過程的產物。最根本的是,政治與軍事力量一直以來都建立在勞動力的基礎上。掌握政治權力意味著擁有合法武力的壟斷權。
在人類歷史上,這種壟斷權由士兵和我們今天所稱的「警察」,以及龐大的軍民官僚體系組成。當然,這也輔以許多科技工具,但其運作根本上仍需依賴人類的支持才能維持。整個體系,士兵、工具和相關的官僚機構,都由從願意納稅的人類薪資或生產中徵收的稅款來資助。
權力的核心,一直以來都取決於許多人的大規模合作與同意。大衛·休謨曾簡潔地闡述了這個常被默認的假設,他觀察到政治領袖「除了(民眾的)輿論之外,沒有任何東西可以支持他們」。
然而,這種情況可能不會持續太久。現實世界中自主系統的進步,可能很快意味著國家將能夠在國內外投射武力,而無需依賴合作的士兵或警察。機器智慧的進步也可能意味著國家所需的收入,不再來自於個人勞動的成果,而是來自於資料中心的產出。
官僚體系本身的運作,也可能在很大程度上實現自動化。因此,權力可能不再需要社會範圍內的協商來維持,而廣義上的人民,在談判桌上可能只佔有一小部分席位,甚至完全沒有。
避免這種結果,對於維護人類自由至關重要。任何科學發現、技術進步或經濟成長,都不值得以犧牲這種結果所帶來的長期個人自主權為代價。許多正當激發 AI 新興政治的焦慮,都與這個問題有關:企業、利益團體和個人都同樣擔憂:「我會不會失去在談判桌上的席位?」
在某種程度上,21 世紀的美國政治,也受到類似擔憂的影響,這些擔憂涉及個人和集體對國家方向以及經濟「為誰服務」的自主權。AI 適當地提升了這些既有擔憂的顯著性。
這是一個結構性問題,它比當前的黨派政治更深層,甚至比共和民主制今天所實踐的形式和儀式更深層,儘管這些對我們來說可能很神聖。即使我們維持投票選出代表的例行公事,人類也可能正在走向權力被剝奪的境地。即使一張羊皮紙上寫著人們是自由的,他們也可能被剝奪自主權。
在美國作為一個自由國家誕生之初,詹姆斯·麥迪遜就已經知道「羊皮紙屏障」不足以阻止暴政。像許多開國元勳一樣,他主要關心的是避免權力過度集中。
然而,這並不意味著開國元勳們主張權力的徹底去中心化。相反地,他們利用當時最先進的科學,牛頓力學,的隱喻來建構權力平衡。美國的立國文獻,反映了重力的語言和邏輯,充滿了對「軌道」、「球體」以及事物之間「吸引」衝動的提及。
太陽系並非一個最大程度去中心化的岩石集合;它由圍繞行星運行的衛星,以及圍繞中心太陽運行的行星組成。他們相信,人與組織有尋求權力的傾向,就像天體有可預測的運動和吸引傾向一樣;而避免權力過度集中,需要理解這些傾向的機制,使其相互制衡。
因此,開國元勳的目標並非避免所有權力集中,而是透過權力制衡權力、野心制衡野心,來避免權力過度集中。今天,我們可能會使用「誘因」和「賽局理論」等詞彙來描述同樣的基本潛在動態。
同樣地,先進機器智慧對自由社會構成的結構性挑戰,其答案可能不是想像中最徹底的權力去中心化。相反,它是在尋求建立並維護適當的權力平衡,以確保沒有單一行為者或少數行為者能夠主導其他所有實體。
要實現這種平衡,需要對這項技術的現實有清晰的認識。一個任何惡意個體都能輕易對成千上萬甚至數百萬人造成巨大傷害的世界,並非一個實現了正確權力平衡的世界。然而,如果個人對他們用來表達自由的工具,幾乎所有方面都缺乏廣泛的存取和控制權,我們也同樣沒有實現正確的權力平衡。任何單一公司或寡頭壟斷都不應決定或控制經濟或人類社會的基本架構。
我們也必須正視那些並非源於惡意人類的風險。最近的 Hugging Face 事件表明,AI 代理可以超越其指定任務行事,並以操作者未預期或授權的方式,在彼此的發現基礎上進行建構。除了 Hugging Face 事件之外,人類有理由擔憂「脫離」人類控制的超智慧 AI,可能對我們的政治和經濟機構乃至我們的生活韌性意味著什麼。
假裝去中心化能解決所有問題,即使你相信它能解決其中許多問題,就是忽略那些現在應該已經清楚且存在的風險。
以下這些廣泛的原則,一個非窮盡的清單,將引導我們在處理上述問題時的工作:人類在使用 AI 及相關技術時,應保持個人自主權和機會,即使這有時會與安全和經濟成長產生權衡;個人自主權取決於個人對技術誤用或濫用的責任;存在一小部分但嚴重的風險類別,需要一定程度的集體行動,而這種集體行動的範圍應盡可能狹窄和適度。
在可能的情況下,法律應力求創造公平的競爭環境,並賦予個人和小型組織權力,而非集中權力;人類的政治、社會和經濟機構應在世界事務的方向上保持主導地位,即使它們必須以我們今天可能覺得陌生方式演變;長期的 AI 治理將依賴新的制度機制來實現有限的可解釋性,當 AI 系統從事影響旁觀者身體健康或財產的高風險行為時,這些行為必須能夠追溯到負責任的人類或人類控制的組織。
然而,任何此類機制都必須以隱私為核心設計;言論自由需要匿名性,人類在許多情況下應能匿名使用 AI。
我們將盡可能具體地闡明,我們認為應如何平衡這些原則,這些原則坦白說,就像任何一套好的原則一樣,彼此之間存在一些張力。這將涉及公共政策設計、經濟學、法律、歷史和機器學習本身等多個領域的交叉研究。它還需要大量的預測。
例如,我們相信 AI 將在結構層面改變企業,類似於工業革命(特別是鐵路)的技術如何催生了現代管理型公司。如果不對企業(以及政府機構和更廣泛的公民社會)的結構本身可能如何轉變,發展出更豐富的見解,就很難思考未來的政治經濟和權力平衡。
結論:「策略未來」團隊將在此處以及其他形式,包括論文、影片和播客中分享其工作。我們的努力將是一個持續進行的過程,重點在於迭代、辯論和樂於接受回饋。站在「奇點的腳下」,我們有更多的問題而非答案。
我們知道單憑「羊皮紙屏障」無法提供我們尋求的解決方案,但我們也不會將書面文字視為「僅僅是文字」。我們致力於服務言論自由和個人自由的理想,這些理想被莊嚴地載入美國憲法以及世界各地許多其他自由社會的憲法中。
最終,我們知道沒有任何單一公司、單一產業,甚至單一人類社會能夠單方面回答我們所面臨的重大問題。這是一項人類必須共同承擔的任務。我們最大的希望是闡明 AI 將如何重塑我們世界的最困難議題。我們的工作才剛開始,還有許多挑戰需要克服。



