今年稍早,Google AI 主管 Jeff Dean 在一場 Podcast 中討論了一個當時在科技圈外鮮為人知的概念:蒸餾(distillation)。Dean 談到 Google AI 模型開發時表示,他和同事們發現了人工智慧蒸餾技術,因為 Google 希望在不依賴單一大型影像辨識模型的情況下,提升其系統的效能。

Dean 在二月時說:「透過蒸餾,這是一種讓小型模型更具能力的關鍵技術,你必須擁有領先模型,才能將其蒸餾到你的小型模型中。」五個月後,蒸餾突然成為從矽谷到華盛頓特區的熱門話題,科技界人士和立法者們正在辯論這種做法是否正在演變成國家安全威脅,並讓中國在高風險的 AI 競賽中追上美國。

上週晚些時候,中國實驗室 Moonshot AI 發布了 Kimi K3,用戶很快發現其競爭力可與 Anthropic 和 OpenAI 最好的商用 AI 匹敵,引發了擔憂。與領先的美國 AI 公司出售專有模型存取權不同,Moonshot 和其他中國實驗室提供所謂的開放權重模型,允許用戶下載技術、調整並在任何地方運行。

一些政府官員將 Moonshot 快速追趕的能力歸因於蒸餾,稱其為竊取美國智慧財產權,特別是透過整合 Anthropic 的領先模型 Fable。白宮顧問 Michael Kratsios 週三在 X 上發文表示:「我們有情報顯示 Moonshot AI 為開發其 K3 模型,蒸餾了 Anthropic 的 Fable。」

他補充說:「為此,他們開發了一個複雜的內部平台,對美國模型進行大規模蒸餾,讓他們能夠快速切換多種存取方式以避免偵測。」

從高層次來看,蒸餾是指利用聊天機器人的答案或進階 AI 模型的產出,來訓練另一個模型。這種做法之所以備受爭議,是因為根據其使用方式,它可能讓模型開發者透過簡單地使用那些投入數百萬甚至數十億美元開發最複雜訓練技術的公司的產出,來創造出具有競爭力的產品。

Pukar Hamal,AI 安全公司 SecurityPal 的創辦人說:「這就像有人去聽了課、讀了教科書,並努力完成了所有作業。然後另一個學生說:『嘿,我沒做那些,我可以抄你的作業嗎?』」無論是 Kratsios 的發文還是其他原因,全球最大的科技巨頭們在週五以前所未有的方式齊聚一堂,明確表達他們的立場。

經過一週的社群媒體發文,Nvidia、Microsoft、Meta、Palantir 等超過 20 家科技公司聯合發布了一封信,敦促政策制定者避免對開放權重 AI 模型施加「過早的限制」,以免「扼殺競爭或將創新推向海外」。他們寫道:「蒸餾,或使用一個模型的輸出幫助訓練或改進另一個模型的做法,是一種廣泛用於模型改進、演進和驗證的技術。」

蒸餾的出現給美國政策制定者帶來了難題,他們長期以來一直關注中國技術在智慧財產權竊取和國家安全方面的問題。喬治城大學安全與新興技術中心研究員 Colin Shea-Blymyer 表示,美國政府正在努力釐清其立場。

Shea-Blymyer 說,政府可能會辯稱中國和俄羅斯公司「利用了勤奮的美國模型的產出,使其自身表現更佳,因此他們在那裡擁有不公平的優勢。」Box 執行長 Aaron Levie 是週五信函的簽署人之一。Levie 在接受採訪時表示,為了保持競爭力,美國公司需要能夠存取最好的技術,無論它在哪裡開發。

Levie 說:「總體趨勢將是,無論創新來自美國、中國還是其他地方,你都應該期待更多的 AI 進展,而且隨著時間的推移,它通常會趨向於更低的成本和更高的效率。」Info-Tech Research Group 研究總監 Shashi Bellamkonda 表示,儘管目前許多討論都圍繞著 Kimi K3 等中國開放權重 AI 模型,但許多公司在創建自己的模型時都採用了蒸餾技術。

例如,Nvidia 在其 Llama Nemotron 系列模型的訓練過程中使用了蒸餾技術,相關研究論文中也有詳細說明。Bellamkonda 說:「這是一種合法且非常有價值的技術,可以用較大的模型輸出訓練較小、較便宜的模型,而且一直都在實踐中。」

然而,Anthropic 持不同看法,因為該公司了解其模型的使用方式,並有不斷發展的業務需要保護。二月時,該公司表示其 Claude 的能力正被中國的 DeepSeek、Moonshot 和 MiniMax 以「工業規模」進行蒸餾,這些公司使用了大約 24,000 個虛假帳戶,產生了 1,600 萬次互動。

Anthropic 公司估值接近 1 兆美元,並有在近期上市的願景,他們表示阻止非法蒸餾是國家安全問題。該公司在二月的貼文中表示:「Anthropic 和其他美國公司建立的系統,旨在防止國家和非國家行為者利用 AI 開發生物武器或進行惡意網路活動。」阻止這種行為需要「產業參與者、政策制定者和全球 AI 社群之間迅速、協調的行動」。

OpenAI 和 Anthropic 在其服務條款中禁止蒸餾。Bellamkonda 表示,他們實質上是在暗示,未經授權使用他們的大型模型可能構成智慧財產權竊盜。但隨著 AI 成本飆升,公司將不惜一切代價提高效率。

Hamal 表示,他會毫不猶豫地在 SecurityPal 使用 Kimi K3 等中國開放權重模型,該公司利用 AI 自動化安全評估。他說這可以為他們節省大量資金。Hamal 說:「我們會確保程式碼中沒有惡意後門。但在我們完成評估後,將其託管在我們自己的基礎設施上,何樂而不為呢?」

Anthropic 和 OpenAI 在試圖證明智慧財產權竊盜方面面臨一個大問題,那就是這兩家公司都曾依賴其他內容來源來建立其模型,並因此被起訴。Boies Schiller Flexner 律師事務所的律師 Max Pritt 代表書本作者對 AI 公司提起著作權訴訟,他表示政府也處於同樣的困境。

Pritt 說:「政府,至少在公開場合,將其努力重點放在保護科技公司的智慧財產權上,而對於未經授權使用的創作者和個人智慧財產權,則在很大程度上保持沉默。」