Anthropic去年支持了美國第一波尖端AI安全法規,在加州和紐約成功推動了新的透明度要求。儘管矽谷許多公司反對,認為這會扼殺AI產業的蓬勃發展,但Anthropic表示這些法律可能已經過時,公司現在正推動各州採納更嚴格的法規。

Anthropic美國州及地方政府關係主管Cesar Fernandez在接受WIRED採訪時表示:「2025年以透明度為重點的安全法案是一個非常重要的開始,但隨著AI系統的能力持續快速進步,政策回應也必須跟上。」他補充說:「我們認為,對於最強大的AI系統而言,透明度和自我報告已不足以作為安全措施。」

對於一家估值近兆美元的新創公司來說,如此支持監管是一個奇怪的訊息。然而,Anthropic本身就是一家不同尋常的公司。正如我們之前所寫,Anthropic的領導者認為,公司需要建立一個龐大的業務,透過開發和銷售先進人工智慧的存取權限,來實現其創立使命:「確保世界安全地過渡到變革性AI時代。」

隨著Anthropic的成長,它開始支持全國對尖端AI公司提出的一些最嚴格的法規。其中許多規則旨在減輕災難性的AI風險,包括先進模型可能導致金融災難或大規模死亡的可能性。

除了加州和紐約的自我報告法規外,Anthropic還支持伊利諾州的措施,要求AI實驗室的安全性流程必須由第三方稽核員評估。最近,該公司更支持麻薩諸塞州的一項政策,該政策同樣要求AI實驗室進行第三方稽核,並賦予州檢察長權力,對不遵守規定的公司尋求禁制令救濟。

本週我與Fernandez會面,以了解該公司的AI政策走向。Fernandez今年稍早加入Anthropic,此前曾擔任體育博弈巨頭FanDuel的美國州政府關係主管,以及Uber的高級公共政策專員。他曾協助這兩家公司在全國各州贏得政策戰。由於國會在通過AI法規方面持續停滯不前,各州正扮演主導角色,他的專業知識對Anthropic來說可能極具價值。

「可疑的」動機儘管Anthropic支持監管的議程受到了AI安全團體、工會和公司其他盟友的讚揚,但一些矽谷領導者卻以更險惡的角度解讀其政治努力。

前白宮AI沙皇、現任唐納·川普總統科技顧問David Sacks聲稱,Anthropic本質上是試圖通過繁瑣的法律,將小型AI新創公司困在繁文縟節中,從而鞏固其在AI競賽中的領先地位。

Sacks去年在社群媒體貼文中寫道:「Anthropic正在執行一項基於散佈恐懼的複雜監管俘虜策略。」他認為:「它主要應對損害新創生態系的州級監管狂熱負責。」

Fernandez斷然否認這項指控,他指出Anthropic僅支持適用於「大型AI模型開發商」的州級AI法案。儘管這個術語在每個法案中的定義不同,但通常指的是那些在AI開發上投入數億美元,且年收入超過5億美元的公司。Fernandez表示:「很難想像一家新創公司能達到這個門檻。」

然而,在一個開發具競爭力的尖端AI模型需要數十億美元資金的世界裡,確實有一些有潛力的新創公司可能很快達到這些門檻。舉例來說,Safe Superintelligence、Thinking Machines Lab和Mistral都已從投資者那裡籌集了數十億美元,儘管它們的收入遠低於Anthropic或OpenAI。當然,這些並非普通的新創公司,但它們是Anthropic的潛在競爭對手。

我認為Fernandez論點中更具說服力的版本是,任何規模足以開發強大AI模型的公司都應受到相同的監管,因為這項技術的潛在風險是相同的。Fernandez指出,Anthropic的目標之一是「激勵一場競相提升的賽跑,開發最安全可靠的AI系統」,公司認為這包括推動政府立法。

Fernandez表示:「我們的使命是確保美國人和全人類都能順利過渡到一個擁有先進AI的世界。」他強調:「如果你是一個正在開發強大AI系統的AI模型開發商,就必須對人們透明地說明你正在建構什麼、模型的能力,以及該模型對各州關鍵基礎設施可能帶來的風險,所有這些都應該是最高優先事項。」

Anthropic的底線然而,在缺乏聯邦監管的情況下,Anthropic對於各州應採取的行動也有其限制。在上個月發布的一份政策文件中,該公司建議政府應建立一種機制,如果認為新的AI模型不安全,就可以阻止公司部署這些模型。這個建議有些諷刺,因為川普政府最近曾要求Anthropic暫停外國公民存取其兩款最強大的AI模型,而Anthropic對此舉並不太滿意。

Anthropic認為,阻止不安全AI模型部署的權力應保留給聯邦政府,而非州立法者,儘管Fernandez指出這是一個不斷演變的討論。在川普政府向Anthropic發出出口管制指令,導致其將Mythos和Fable 5模型對所有人下線後,該公司在一篇部落格文章中寫道,阻止AI模型部署應僅透過公平、透明的評估過程進行。

Fernandez不願多談Anthropic的聯邦政策工作,因為那不屬於他的職權範圍,但該公司在該領域也一直很忙碌。上個月,它致函美國政府,指控中國科技巨頭Alibaba進行「蒸餾攻擊」,本質上是透過系統性提示從Anthropic的模型中提取資訊,以開發自己的AI工具。

一些AI研究人員駁斥這些說法,認為這是另一種形式的監管俘虜。他們認為Anthropic的真正目標是說服美國政府禁止開源權重中國模型,這可能會促使數千家依賴這些模型的美國企業轉而使用Anthropic的企業級產品。值得注意的是,Anthropic執行長Dario Amodei過去曾向國會警告開源AI的危險。

在州級層面,Fernandez表示Anthropic在其支持的任何立法中都沒有特別針對開源AI模型。他解釋說:「這與模型建構的關係較小,更多是關於模型的能力,當它們達到一定水準時,就應該被納入這些州級框架中。」

無論你是否相信Anthropic的努力是真誠的,該公司仍在塑造AI政策的未來方面扮演著強大的角色。其最新的模型發布將先進AI的網路安全能力帶入了全國焦點。在此之前,該公司已經花費數年時間,向全國各地的立法者警告先進AI可能帶來的災難性風險。

美國選民更常提出的AI相關擔憂,例如可能因技術而失業、資料中心進駐社區的負面影響,以及聊天機器人對兒童的影響,並未激發尖端AI實驗室發起類似的立法運動。Anthropic及其幾個競爭對手已承諾,普通納稅人不會被迫支付資料中心的費用,Anthropic也發布了應對未來AI導致工作流失的提案。然而,該產業在推動解決這些問題的州級法律方面,投入的政治力量明顯較少。

當被問及這種差異時,Fernandez表示Anthropic「渴望與立法者就災難性AI安全風險以外的問題進行接觸」,並且已經「在各州進行這些對話」。

然而,目前這些討論尚未產生Anthropic針對尖端模型帶來的生存風險所發起的、協調一致的州級推動。