在所有關於AI潛在弊端的激烈辯論中,有一個擔憂在矽谷的AI愛好者中引起了最大的焦慮。他們擔心那些銷售專有模型的巨型AI實驗室,正以某種方式扮演著「特洛伊木馬」的角色。

這種擔憂在於,當新創公司和企業使用來自OpenAI和Anthropic等實驗室的AI模型時,這些實驗室將越來越多地接觸到這些公司最敏感的商業資訊。模型開發商隨後可以利用這些知識為己所用,潛在地成為其客戶的競爭對手。發出此類警告的人包括創投家Jason Calacanis和Palantir執行長Alex Karp。

現在,微軟執行長薩蒂亞·納德拉(Satya Nadella)在週日發表的一篇令人驚訝的部落格文章中,也加入了這個行列。納德拉警告說,AI使用者(他稱之為「買家」)正在付出雙重代價。他們有意識地支付AI token使用費,但在這個過程中,他們也無意識地交出了寶貴的資料。

他寫道:「你本質上是為智慧支付了兩次費用,一次是金錢,另一次則是更寶貴的東西:你必須揭示的專有知識才能讓智慧變得有用。你越希望模型表現得好,你就必須餵給它越多的知識!」

他認為,最危險的是,企業實際上正在教導模型關於其業務的細微之處。

他寫道:「模型從『殘留資訊』中學習,包括人們編寫的提示詞、代理工具的使用方式,尤其是人們在模型出錯時所做的修正。每一次修正都被提煉成機構的專業知識。」

這是一種「競爭對手永遠無法買到的知識」,然而企業卻正在將其拱手讓人。

納德拉認為,如果AI公司可以自由抓取網路資料來訓練其模型,那麼企業反過來研究,或「提煉」,這些模型也是公平的。「提煉」是一種利用模型自身輸出,來學習其運作方式並基於這些洞察訓練一個新的、通常更便宜的模型的方法。今年二月,Anthropic曾指控中國開源模型向Claude發送數百萬個提示詞,以改進其自身模型,並敦促美國政府加強出口管制。

納德拉的觀點是,模型開發商不能兩頭佔便宜。他們自由地利用全球資料進行訓練,卻限制他人對其模型做同樣的事情,這是偽善的。

納德拉寫道:「雖然模型供應商擁有合理使用權來訓練公共資料所帶來的巨大創新是必要的,但我發現現狀卻是轉身對『提煉』施加限制性條款,這很諷刺。」

當模型開發商「保留從客戶使用和互動資料中學習的權利」時,納德拉尤其感到擔憂。

納德拉的解決方案是大型雲端供應商執行長會建議的那種。他希望公司「保留」其資料的所有權,包括提示詞、回饋等。因此,他敦促他們在雲端上建立自己的「專有學習環境」(他們的資料可能無論如何都已經儲存在雲端,而且方便地,這可能意味著微軟的雲端服務Azure)。

他還希望公司建立他所謂的「編排層」,本質上是一種可以輕鬆在不同供應商的AI模型之間切換,而不是被鎖定在單一模型中的方式。像AI「閘道」這樣讓公司能夠做到這一點的工具正變得越來越受歡迎。

雖然納德拉從未使用「開源」一詞作為保留所有權的方法,但這是一個明顯的潛台詞。然而,還有另一個潛台詞。

許多大型公司,除了使用雲端外,仍擁有自己的部分資料中心,它們已經開始轉向在其內部部署(業界術語為「on-prem」)開源模型。Solo.io的創辦人兼執行長Idit Levine表示,她正親眼目睹這種轉變在她的客戶中發生。在嘗試了專有模型開發商後,他們開始自問:「我能否在內部部署一個開源模型?

它能做到大型模型近90%的功能,而且成本會低得多。」她告訴TechCrunch:「他們明白這一點,而且他們可以控制它。」

Solo.io的技術去年被選為Linux基金會Agentgateway專案的技術支援。該公司擁有T-Mobile、ADP和SAP等企業客戶。她看到公司越來越多地安裝地端開源模型,並將其視為企業AI使用的下一個大趨勢。

她並非孤身一人。Vercel(以建立和託管網站平台聞名,最近增加了AI模型切換工具)和OpenRouter(一家幫助開發人員在不同AI模型之間路由請求的公司)都看到了開源模型流量的激增。事實上,上個月透過Vercel閘道路由的所有流量中,開源模型佔了29%。

微軟執行長,一家同時投資了OpenAI和Anthropic的公司,現在公開敦促企業警惕使用專有模型,我們敢打賭這個趨勢將會持續增長。納德拉寫道:「在消費智慧的同時,你也在創造智慧。而你創造的,應該屬於你。」