OpenAI 與 Broadcom(NASDAQ: AVGO)今日共同發表了「Jalapeño」,這是 OpenAI 的首款智慧處理器。這款加速器是根據 OpenAI 對未來大型語言模型(LLM)推論的願景所設計,也是兩家公司共同打造多代運算平台中的首款 AI 加速器。其目標是讓先進 AI 更快、更可靠,並能讓更多人使用。
Broadcom 總裁暨執行長 Hock Tan 與總裁 Charlie Kawwas 將 Jalapeño 交付給 OpenAI 執行長 Sam Altman 和總裁 Greg Brockman。這標誌著 OpenAI 建立其模型和產品背後完整技術堆疊(full stack)策略的重要一步。
OpenAI 憑藉對 LLM 基礎的深刻理解,並結合其模型、核心、服務系統和產品需求藍圖,從零開始設計這款晶片。合作夥伴 Broadcom 和 Celestica 則協助將該平台工業化,涵蓋晶片實作、電路板、機架系統整合、高效能網路以及可擴展的生產系統。
Jalapeño 的設計具備彈性,能根據 OpenAI 對業界當前及未來 AI 模型推論需求的洞察,支援所有 LLM。目前 Jalapeño 晶片的工程樣本已在實驗室中以生產目標頻率和功耗執行機器學習工作負載,包括 GPT‑5.3‑Codex‑Spark。
儘管 OpenAI 仍在測量最終效能,但早期測試顯示 Jalapeño 的每瓦效能將大幅優於目前的頂尖水準。詳細的技術效能報告將在未來幾個月內發布。其架構減少了資料移動,並平衡了運算、記憶體和網路資源,使實際利用率更接近理論峰值效能。Broadcom 的晶片實作和網路技術,包括 Tomahawk 網路晶片,有助於將該平台推向大規模生產。
OpenAI 總裁暨共同創辦人 Greg Brockman 表示:「世界正邁向一個由運算驅動的經濟體。Jalapeño 是我們長期全端基礎設施策略的一部分,旨在讓運算資源更為充裕,從而使 AI 對個人和企業而言更快、更可靠、更經濟實惠,並能用於解決更重要的問題。透過自行設計更多技術堆疊,我們能以更高的效率提供更多智慧,並持續推動先進 AI 走向更廣泛的普及。」
領導 OpenAI 硬體計畫的 Richard Ho 指出:「Jalapeño 是根據我們與 OpenAI 研究人員密切合作的詳細洞察,從零開始為 LLM 推論設計的。我們針對前沿 AI 模型最重要的核心、記憶體移動、網路和服務模式進行了架構優化。根據早期測試,Jalapeño 將能以接近硬體理論極限的效率執行我們最重要的工作負載。」
Broadcom 總裁暨執行長 Hock Tan 表示:「我們與 OpenAI 的合作,代表著對未來十年 AI 所需實體基礎設施擴展的根本承諾。這僅是多代發展藍圖的開端。透過與 OpenAI 直接共同開發我們業界領先的晶片,我們將能從 2026 年開始,與 Microsoft 及其他合作夥伴共同部署兆瓦級規模的資料中心。」
Jalapeño 旨在成為 LLM 的最佳推論平台。它是專為現代 LLM 推論而全新設計的,而非從早期 AI 工作負載改編而來的通用加速器。其設計靈感來自 OpenAI 日常運行 ChatGPT、Codex、API 和未來代理產品的系統,同時也為業界當前和未來的 LLM 所設計。
目標是將當今領先 AI 加速器的強大運算能力和吞吐量,與最快專用推論系統的低延遲相結合,使 Jalapeño 非常適合大規模的互動式 LLM 產品。
這就是全端(full-stack)優勢。OpenAI 不僅開發前沿模型或在其之上建構產品,它還設計了其底層基礎設施:晶片架構、核心、記憶體系統、網路、排程、部署系統和產品體驗。由於 OpenAI 掌握整個技術堆疊,每一層都能圍繞著相同的目標進行優化:讓其模型對使用者而言更快、更可靠、更經濟實惠。
Jalapeño 強化了 OpenAI 進步的飛輪效應。更好的基礎設施推動運算效率,更高的運算效率則能實現更好的訓練和服務,最終驅動更強大的 AI 模型。更好的模型轉化為對個人、開發者和企業而言更優質的產品。更優質的產品帶來更多使用量、更多客戶和更多收入,這讓 OpenAI 能夠再投資於下一代基礎設施。隨著時間推移,這個循環有助於讓智慧變得更強大、更可靠、對所有人來說更便宜。
僅九個月完成設計定案,並由 OpenAI 模型加速。Jalapeño 從初始設計到製造定案(tape-out)僅用了九個月共同開發完成。這個客製化 AI 加速器計畫,代表著我們認為是高效能先進半導體領域有史以來最快的 ASIC 開發週期。這種速度反映了 OpenAI 工程團隊深度的軟硬體協同開發、Broadcom 的晶片實作專業知識,以及利用 OpenAI 模型加速部分設計和優化流程。
服務於使用者的相同模型,正協助改進運行未來模型所需的基礎設施。如果 AI 能幫助工程師更快地設計出更好的晶片,就能降低整個產業的運算成本,並有助於普及先進 AI 的使用。
與合作夥伴共同打造多代平台。Jalapeño 是多代運算平台的第一步,該平台預計於 2026 年底前首次部署,並在未來幾年內擴展。它結合了 OpenAI 設計的加速器、Broadcom 的晶片實作、網路和連接技術,以及 Celestica 在電路板、機架和系統方面的專業知識。
讓先進 AI 更廣泛可用。這項工作的重點很簡單:推論是 AI 觸及人們的環節。成本、速度和可靠性的每一次改進,都能體現為更快的 ChatGPT 回應、Codex 任務能以更少等待時間執行更多步驟、更便宜的 API 產品,或在高需求時更可靠的存取。
普及 AI 意味著讓先進模型足夠可用、可靠且經濟實惠,以供更多人日常使用。Jalapeño 幫助 OpenAI 將其更多基礎設施轉化為對學生、開發者、小型企業、研究人員、企業以及任何試圖學習、創造或解決難題的人有用的智慧。



