輝達(NVIDIA)超大規模運算與高效能運算副總裁 Ian Buck 親自將 Vera CPU 系統交付給 AI 生態系夥伴,標誌著 Vera CPU 已開始大規模出貨。
編者註:這篇部落格文章最初於 2026 年 5 月 18 日發布,並於 2026 年 8 月 27 日星期四更新。AWS 和 NVIDIA 昨天宣布大幅擴展長達 16 年的合作關係,其中包括計畫增購 200 萬顆 NVIDIA GPU,並將基於 Vera CPU 的基礎設施導入 AWS。
AWS 已收到其首批 NVIDIA Vera CPU 伺服器和 Vera Rubin GPU,由 NVIDIA 超大規模運算與高效能運算副總裁 Ian Buck 在西雅圖親自交付。
AWS 是 Vera 在 AI 生態系中快速部署的最新一站。此前,Buck 已將 Vera CPU 系統交付給 Oracle Cloud Infrastructure (OCI) 以及三家領先的 AI 實驗室:Anthropic、OpenAI 和 SpaceXAI。
Buck 表示:「代理式 AI 正在 AI 工廠中創造一個新的 CPU 時刻,隨著模型從回答問題轉向執行動作,Vera 專為大規模推動這類工作而設計。」
為何是 Vera,為何是現在?核心理念是:想像你能以 10 倍的速度工作,你的電腦能跟上嗎?代理式 AI 對於人們執行各種工作的基礎設施提出了前所未有的需求,無論是製作簡報、編譯和測試軟體、分析資料、搜尋檔案,甚至是執行模擬。
AI 代理並非僅靠 GPU 運作。每個代理式沙盒、每個工具呼叫、每個協調層、每個長上下文檢索操作,都屬於 CPU 的工作。Vera 正是基於這種現實而設計的新型 CPU。
這些並行、即時的任務對 CPU 造成了壓力,而傳統以核心密度為主的設計從未優先考慮這些。Vera 搭載 88 個 NVIDIA 自訂設計的 Olympus 核心,提供 1.2TB/s 的記憶體頻寬,並在代理式 AI 工作負載上實現高達 1.8 倍的單核心效能提升。在持續負載下,工作能更快完成,從而提高整個 AI 工廠的效率,並幫助使用者以更快的響應速度完成工作。
NVIDIA Vera 正前往 @awscloud。NVIDIA 的 Ian Buck 在西雅圖的 AWS 總部,親自將 AWS 的首台 Vera CPU 伺服器和 Vera Rubin GPU 交付給 Willem Visser 和 Supreeth Sheshadri。Vera 專為代理式 AI 而生:提供更高的每美元代幣數、為使用者帶來更快的結果,以及…
從發布到交付:Vera 前往 AWS。Buck 推著 AWS 的首台 Vera CPU 伺服器和 Vera Rubin GPU 經過西雅圖的 Spheres,並將它們交付給 Amazon EC2 副總裁 Willem Visser。Amazon EC2 硬體工程副總裁 Supreeth Sheshardi 也一同參與,並深入探討 Vera 和 Vera Rubin 將為 AWS 客戶帶來什麼。
Vera 進駐南灣與 OCI。在 Oracle AI 客戶卓越中心內,OCI 團隊(包括負責整體產品管理的 Karan Batta 和首席客戶與合作夥伴成功長 Gary Miller)參觀了已開箱的 Vera CPU 系統。背景中,一個 NVIDIA GPU 機架正在處理來自全球 OCI 客戶的工作負載。該中心是 Oracle 客戶測試各種 AI 工作負載的地方。
Buck 解釋了 Vera 將如何提供幫助。他指出:「當 AI 模型被問到一個問題時,答案通常並非預先準備好的。模型實際上必須生成一些 Python 程式碼才能得出正確答案。」他解釋說,這正是 Vera CPU 擅長的任務,也是 CPU 需求飆升的原因。
OCI 團隊也觀察到這一趨勢。Batta 表示:「OCI 計畫從 2026 年開始部署數十萬顆 NVIDIA Vera CPU,因為代理式 AI 需要大規模的持續效能。Vera 的架構專為高吞吐量的推理工作負載而設計,能提供 OCI 所需的效率、密度和佔用空間,以推動下一代企業 AI。」
OCI 是首家大規模部署 Vera 的雲端服務供應商。對於企業客戶而言,這意味著能獲得其他雲端供應商目前無法比擬的生產級代理式 AI 基礎設施。
Miller 表示,OCI 團隊渴望讓 Vera 投入運作,為客戶提供另一個系統來客製化和驗證其代理式 AI 和工作負載。他說:「我非常期待來訪者的反應,並期待與他們合作,充分發揮 Vera 的最大潛力。」
在半島與 SpaceXAI。五月,當天最後一次 AI 實驗室交付在 Palo Alto 的 SpaceXAI 辦公室進行。NVIDIA 團隊向 Elon Musk 介紹了系統內部。Musk 仔細聆聽,然後開始提問,內容涉及核心、記憶體配置和散熱。
SpaceXAI 正在評估 Vera,用於強化學習工作負載以及驅動其訓練堆疊的基於代理的模擬管線。
在 OpenAI 預覽。在 OpenAI 位於 Mission Bay 的總部,交付儀式移至室外,在主辦公室外的一個開放式陽台進行。舊金山出了名的多變天氣這天卻很配合,OpenAI 運算基礎設施主管 Sachin Katti 感謝 Buck 帶來了這台伺服器。Buck 介紹了 Vera 的功能,並在某個時刻,從口袋裡掏出一把螺絲起子,打開了蓋子,展示了系統內部。
Vera 前往舊金山與 Anthropic。五月的第一批交付抵達了 Anthropic 位於舊金山 SoMa 區的時尚辦公室。Anthropic 運算主管 James Bradbury 在他們靠近海灣的會議室完成了接收。
Buck 拿著一塊裸露的 NVIDIA Vera CPU 主機板作為參考,向 Bradbury 介紹了圍繞這款新 CPU 構建的伺服器,並講解了 Vera 的獨特功能。Bradbury 表示:「擴展運算能力是模型成長的重要加速器。我們很高興看到 Vera 在解決代理式工作負載方面,成為生態系中一個有前景的組成部分。」
Vera 的價值。Vera 是 NVIDIA 極致協同設計故事的一部分,與 NVIDIA Rubin GPU、BlueField-4 DPU、Spectrum-X 和 MGX 機架架構並駕齊驅。除了為獨立 CPU 系統提供動力外,Vera 還是 Vera Rubin NVL72 的主處理器,透過第二代 NVIDIA NVLink-C2C 與一對 Rubin GPU 配對。
在這些系統中,Vera 和 Rubin 共享統一記憶體架構,確保加速運算能高效利用。Vera 快速的 CPU 核心和互連技術處理協調、控制和資料移動,以兩倍於傳統基礎設施的能源效率為 GPU 提供資料。
代理式 AI 時代擁有了專為其設計的 CPU,它的名字就是 Vera。了解更多關於 NVIDIA Vera CPU 的資訊。



