Nvidia 本週正積極宣傳其全新的 Vera Rubin 晶片系統,並在競爭對手 AMD 週四於舊金山舉辦年度產品發表會前,揭露了這款 GPU 與 CPU 組合的最新效能基準。上週在加州聖克拉拉總部舉行的一場冗長技術研討會上,Nvidia 高層向一小群記者誇耀了該晶片系統提升的效能與效率。

其中最大的重點是:長期專注於製造 GPU 的 Nvidia,正日益嘗試將自己定位為能驅動 AI 代理(AI agents)的 CPU 供應商。

儘管 GPU 仍然是企業用於訓練和運行 AI 模型的主要硬體,但產業轉向更複雜、代理式(agentic)系統的趨勢,增加了對 CPU 的需求。CPU 能夠協調資料流、網路和其他軟體任務,這很可能是 Nvidia 熱衷於將自己推廣為完整 AI 系統供應商,而非僅僅是 AI 晶片供應商的原因之一。

Vera Rubin 是 Nvidia 混合式超級晶片系統 Grace Blackwell 的繼任者,代表著其在近期未來驅動 AI 產業的關鍵。它設計為每兩個 GPU 配備一個 CPU。在單一的 Vera Rubin NVL 72 超級晶片系統中,包含 36 個 Vera CPU 和 72 個 Rubin GPU。

Nvidia 也將 Vera CPU 作為獨立產品銷售,據報導已告知中國客戶這些產品最快可能在八月上市。

Nvidia 高層強調,其全新的 Vera Rubin NVL72 機櫃,將一系列晶片整合到單一液冷平台中,比其早期產品更具「隨插即用」的特性。在參觀矽谷的 Nvidia 資料中心實驗室時,Nvidia 高層透露 OpenAI 已經在使用一個 Vera Rubin 機櫃。

Nvidia 執行長黃仁勳上週並未出席聖克拉拉的研討會;他當時正在日本,宣布該晶片製造商與多家日本公司建立新的合作夥伴關係,以開發用於機器人的 AI 技術。這些簡報會改由 Nvidia 長期擔任加速運算副總裁,同時也是該公司 CUDA 軟體架構師的 Ian Buck 主持。

Buck 告訴記者:「我們的發展藍圖是推出新的架構,不僅僅是 GPU,還有 CPU。」他補充道:「我們將持續創新,因為在矽谷,這是生存或死亡的選擇。」

Nvidia 發言人向 WIRED 透露,這些會議在黃仁勳的行政簡報中心舉行,附近多張桌子上堆滿了執行長從最近台北國際電腦展(Computex)帶回來的台灣零食。台北國際電腦展是一年一度的大型半導體貿易展。

Nvidia 聲稱 Vera Rubin NVL72 系統的每瓦特處理 token 數量將是該公司 Grace Blackwell 超級晶片的 10 倍。該公司表示,其 Vera CPU 在處理代理式 AI 任務方面比來自 AMD 和 Intel 的競爭對手 CPU 更快(儘管其用於支持這些基準測試的測試似乎使用了競爭對手稍舊的 CPU 型號)。

新晶片上的本地化記憶體子系統也將提供近三倍於 Blackwell 的記憶體頻寬,這在目前高頻寬記憶體持續短缺的情況下,對許多公司來說可能是一個吸引人的功能。

Nvidia 表示,它還顯著減少了將晶片連接到多機櫃伺服器系統中所需纜線的數量,甚至將 Vera Rubin 宣傳為「無線運算」和「熱插拔」。這意味著客戶理論上可以將每個機櫃的安裝時間從數小時縮短到幾分鐘,這一點由 Buck 和 Nvidia 硬體工程資深副總裁 Andrew Bell 共同提出。此外,新的晶片系統採用 100% 液冷,可以減少晶片冷卻所需的能源,因為氣冷更耗能。

自從 Nvidia 在 2025 年春季首次揭露 Vera Rubin 以來,該公司一直在緩慢釋出更多關於該晶片系統的細節,同時堅持它將按時發布。黃仁勳一再表示 Vera Rubin 正在「全面生產」,並將於今年下半年出貨,早期客戶包括 Microsoft、OpenAI 和 Oracle。

Nvidia 對於任何延遲的說法都特別敏感,因為據報導,其上一代 Blackwell 晶片在連接到該公司客製化伺服器機櫃時曾出現過熱問題,迫使他們進行設計更改並推遲出貨。

Nvidia 對 Vera Rubin 的行銷推廣正值競爭對手 AMD 年度大會之前,預計 AMD 高層將在會上宣傳其下一代 AI 和資料中心晶片。週日,AMD 揭露了其 Helios AI 晶片機櫃的更多細節,該機櫃旨在與 Nvidia 的新產品競爭。

AMD 和 Nvidia 都一直在爭奪大規模、多年期的合約,為 Meta 和 Amazon 等 AI 超級運算商以及 OpenAI、Anthropic 和 SpaceXAI 等 AI 實驗室供應晶片。

在過去兩年中,AMD 在資料中心使用的 CPU 市場份額顯著增長。該公司長期以來被認為是 x86 處理器中現代小晶片(chiplet)架構的先驅,而 x86 處理器仍然佔據資料中心 CPU 收入的絕大部分。相比之下,Nvidia 的資料中心 CPU 則基於 ARM 架構,這是一種以其電源效率聞名的替代晶片架構。

Nvidia 高層 Buck 和負責 Nvidia CPU 產品行銷的 Hannah Coutand 都強調,Vera Rubin 放棄了許多現代處理器使用的小晶片架構,轉而採用單一的「單晶片」(monolithic chip)設計。Coutand 認為,將多個小晶片拼接在一起會對記憶體頻寬和資料傳輸造成「沉重負擔」,而 Vera Rubin 的單晶片設計則允許資料在單一積體電路上更快地移動。