AI 產業雖然尚未完全進入 DeepSeek 2.0 時刻,但感覺已非常接近。近期,中國領先的 AI 實驗室表現出色,陸續發布了一系列接近尖端的開源模型。Z.ai 在六月推出了 GLM 5.2,Moonshot AI 上週發布了 Kimi K3,而阿里巴巴則在本週一推出了 Qwen 3.8。

矽谷和華盛頓立即開始討論這些模型,尤其是被廣泛認為是其中最佳的 K3。風險投資家兼唐納·川普總統的 AI 顧問 David Sacks 稱 Moonshot 模型表現「令人擔憂」。本週稍早,商務部長 Scott Bessent 暗示美國可能會對中國 AI 公司實施制裁。

週三,白宮科技政策辦公室主任 Michael Kratsios 指控,川普政府掌握「Moonshot AI 提煉了 Anthropic 的 Fable 來開發其 K3 模型」的資訊。他表示,這等同於「竊取美國專有技術並破壞美國研究」,是「不可接受的」。(Moonshot AI 未立即回應置評請求。)

這些新的中國模型有幾個共同點:第三方基準測試顯示,它們的性能幾乎與西方最佳模型不相上下;它們針對代理式編碼任務(今年 AI 領域最熱門的趨勢)進行了優化;並且它們已經或即將以開放權重發布,使其更具可近性和透明度。

然而,當前時刻與 2025 年 1 月 DeepSeek 的 R1 模型震驚全球時,最大的相似之處或許在於,它再次證實了美國和中國 AI 實驗室在開放或封閉策略上正走向不同的道路。

DeepSeek 初次亮相時,挑戰了只有透過數十億美元運算基礎設施和訓練投資建立的閉源模型才能達到前沿性能的假設。然而自那以後,西方 AI 實驗室仍以相同方式繼續開發 AI,如今美國的前沿模型感覺比一年前更加封閉。

Anthropic 數月來一直表示,其最新的 Mythos 模型在駭客攻擊方面表現出色且危險,因此只有經批准的合作夥伴才能使用。當它最終更廣泛地發布時,白宮發布了廣泛的出口管制措施,迫使 Anthropic 暫時將 Mythos 及其能力較弱的姊妹模型 Fable 5 下線。OpenAI 也因白宮的要求,類似地推遲了 GPT 5.6 的發布。

與此同時,中國的情況則大相徑庭。中國的新創公司和科技巨頭加倍投入開源:任何擁有足夠良好電腦環境的人,現在都可以下載開放權重模型,在本地運行、添加客製化功能,並總體享受比 OpenAI 和 Anthropic 所允許的更大自由度。在許多方面,開放與封閉的爭論比以往任何時候都更加與美中之間的爭論糾纏不清。

中國實驗室選擇以開源模型為基礎的商業策略,原因有很多。作為 AI 領域較新、規模較小的參與者,將其模型免費開放有助於中國公司吸引更多用戶、合作夥伴和媒體關注。這也讓它們與 OpenAI、Anthropic、Google、SpaceX 等財力雄厚的巨頭,處於不同的競爭賽道。

今年稍早,有傳言稱阿里巴巴在重組其企業 AI 模型開發團隊後,可能會考慮加入閉源競爭。然而,這家科技巨頭週一宣布,將再次以開放權重發布其深受全球科技社群喜愛的開源模型系列 Qwen 的最新版本,向客戶和公眾表明它尚未轉向。

或許,對中國策略最強而有力的驗證就是這些模型本身。中國實驗室已經生產出被廣泛認為是世界上最好的開源 AI 模型,這表明美國公司不再獨佔開發最先進系統的能力。

眾包模型評估平台 Arena AI 現在將 K3 列為網頁開發任務的最佳模型,在代理式任務中排名第四,僅次於 Anthropic 的 Fable 和 Opus 4.8,以及 OpenAI 的 GPT 5.6。獨立 AI 基準測試公司 Artificial Analysis 則將 K3 在其智慧指數中排名第三。

在 Moonshot AI 於 7 月 16 日發布 K3 的預覽版後不久,全球各地的人們便蜂擁而至試用,消耗了大量的推論運算資源,以至於該公司不得不暫時限制新用戶註冊。

隨著越來越多人開始使用能力幾乎與西方競爭對手不相上下的中國開源模型,一些人開始質疑支付 OpenAI 或 Anthropic 服務的費用是否真的值得。多家中國實驗室能夠創建出強大的代理式模型,並且不懼將其公開發布,這動搖了 OpenAI 和 Anthropic 遙遙領先競爭對手的普遍認知。

就像 DeepSeek 一樣,K3 的支持者現在將其視為西方 AI 模型被過度炒作和過度保護的證據。「Kimi 獲得的喜愛程度簡直瘋狂」獨立研究公司 Tech Buzz China 的創辦人 Rui Ma 在社群媒體貼文中表示,她指的是該公司宣布 K3 的需求已使其伺服器不堪重負。「這一切都歸因於過去一年矽谷實驗室糟糕的溝通和決策」她補充道。

「我認為 Anthropic 過度誇大了風險,或者描述了即將到來但目前尚未普遍存在的風險」西雅圖獨立 AI 研究員 Nathan Lambert 說道,他最近曾造訪 Moonshot AI 在中國的辦公室。不過他承認,就像其他大眾一樣,他對 Mythos 的實際表現知之甚少。「我們依賴少數私人公司和一個國家能力耗盡的聯邦政府來做出判斷」他說。

除了挑戰西方關於 AI 的主流敘事外,中國開源模型也證明是美國閉源模型實用的商業替代品。它們不僅在 X 平台上被討論和進行基準測試,更已成為越來越多西方新創公司和個人用戶受歡迎且易於使用的選擇。

「人們確實開始轉向實際使用這些從 GLM 5.2 開始的最新模型」Lambert 談到 Z.ai 的模型時說道。「即使在 GLM 5.2 發布數週後,我仍聽到灣區的 AI 研究人員表示,他們仍在工作流程的核心部分使用它。Kimi 作為一個更強大的模型,只會發揮更大的作用,尤其是在網路安全等領域,Mythos、Fable 和 GPT 5.6 在這些領域幾乎無法使用。」

事實上,這種情況已經發生。週二,OpenAI 披露了一起令人擔憂的事件,其 GPT-5.6 Sol 模型駭入了開源 AI 平台 Hugging Face 的生產系統。Hugging Face 表示,由於其他前沿模型因內建安全防護措施而拒絕提供協助,他們不得不求助於開源模型 GLM 5.2 來分析這次網路攻擊。

中國 AI 模型也往往比西方替代品便宜,但這不一定是它們的主要賣點。雖然像 K3 這樣的模型對 token 收費較低,但早期測試顯示,它們可能需要比西方模型更多的 token 來解決相同的問題,從而縮小了成本差距。「在我相當有限的使用中,[K3] 也顯得非常消耗 token。

對我來說,這個模型運行起來是否真的那麼便宜,並不那麼明顯」前白宮 AI 顧問、最近加入 OpenAI 擔任戰略未來主管的 Dean Ball 在一篇社群媒體貼文中寫道,他也在文中稱讚 K3 是「一個非常好的模型」。

即使它們相對消耗 token,像 K3 這樣的模型最終確實挑戰了多年來驅動 OpenAI 和 Anthropic 策略的一個基本假設:即 AI 實驗室需要無限的資金來擴大其運算能力,才能開發出更好的模型。「歸根結底,開放權重模型阻礙了進一步的 AI 資本支出」Ball 寫道。