NVIDIA AI雲端生態系正加速全球AI工廠基礎設施的建置。合作夥伴正擴大其運算能力,以滿足企業、新創公司、各國、AI實驗室以及開發者擴展代理式AI應用日益增長的需求。NVIDIA AI雲端是一個不斷成長的專用雲端生態系,旨在服務當今最受歡迎AI應用背後激增的token需求。
這些AI雲端與NVIDIA的全端AI基礎設施共同設計,以滿足企業、新創公司和各國尋求新供應商及區域運算能力時對AI的強勁需求。它們結合了NVIDIA的加速運算、網路和AI軟體,協助合作夥伴支援訓練、微調、推論、代理式AI、實體AI和主權AI部署。
具體配置因合作夥伴和工作負載而異。AI雲端合作夥伴選擇NVIDIA,是為了獲得最佳經濟效益,最低的token成本、最佳的每瓦吞吐量,來運行前沿和開源AI。這些雲端採用NVIDIA加速運算、網路和AI軟體建構,將AI工廠帶到更接近資料、開發者、用戶和產業的地方,協助客戶大規模訓練、微調和運行代理式AI應用。
該生態系幾乎遍及全球各地,為前沿模型建構者、企業、新創公司、軟體供應商和國家AI計畫提供區域和主權AI能力。NVIDIA創辦人暨執行長黃仁勳表示:「每家公司和每個國家都需要AI工廠基礎設施,將資料轉化為智慧。NVIDIA AI雲端將全端AI工廠帶到更接近正在建構下一代AI的地區、產業和開發者,從模型訓練到即時推論,以及將改變人們和組織工作方式的AI代理。」
AI雲端供應商、電信業者、主權AI建構者和垂直整合基礎設施供應商正與NVIDIA合作建構AI工廠,為前沿AI、企業AI、電信、開發者雲端和國家AI計畫的客戶提供服務。區域成長在東南亞、澳洲和美洲加速,隨著非洲的Cassava和南美洲的Claro加入,NVIDIA AI雲端現已遍及六大洲。
NVIDIA AI雲端正將大規模AI工廠的建置與領先AI實驗室、企業、政府和數位服務供應商的需求結合。CoreWeave、Firmus、IREN和Nscale等合作夥伴正在擴展AI基礎設施,以支援前沿模型開發、企業AI、代理式應用和大規模推論。
在各個地區,NVIDIA AI雲端正將AI工廠帶到更接近當地產業和主權AI生態系。Firebird、GMI Cloud、Indosat Ooredoo Hutchison、Lambda、Naver Cloud、Sharon AI、Yotta和YTL等合作夥伴正在支援新興AI公司、國家AI計畫、金融服務、電信、製造、教育、醫療保健和開發者生態系。
對於政府和受監管的產業,區域AI雲端可以支援主權控制和當地合規要求。對於開發者和企業,它們可以減少存取加速基礎設施的阻力,用於AI代理、企業協作助理、數位員工以及其他必須在靠近用戶和資料處運行的AI服務。Firmus擴展AI工廠足跡至澳洲和亞太地區Firmus Technologies正在擴展其在南澳和東南亞的AI工廠足跡,建構節能基礎設施,以支援大規模訓練、推論和代理式AI工作負載日益增長的需求。
透過「南門計畫」(Project Southgate),Firmus正在塔斯馬尼亞、墨爾本、南澳和新南威爾斯開發AI工廠,重點關注再生能源、先進散熱和模組化基礎設施,以更快地投入運作。該公司還透過與ST Telemedia Global Data Centres的合作,在新加坡部署了AI基礎設施。
Firmus正在其建置中採用NVIDIA的加速運算和參考架構,NVIDIA DSX協助簡化AI工廠的設計、部署和營運。液冷式Firmus HyperCube與NVIDIA DSX平台協同設計,旨在加速模組化AI工廠的建置,並優化每token的低成本。
Firmus正在AI工廠供應鏈的各個環節進行創新,包括散熱和能源。Firmus共同執行長Tim Rosenfield表示:「AI代理正在創造一種新型的工業規模token需求,亞太地區需要能夠更快建置、更有效率地液冷並以千兆瓦規模運行的AI工廠。
Firmus正與NVIDIA合作,建構液冷式AI基礎設施,旨在為該地區最重要的客戶盡可能高效、迅速地提供AI token。」CoreWeave推動實體AI和下一代AI工廠發展CoreWeave正在擴展其NVIDIA AI雲端平台,以支援下一波代理式AI、實體AI和前沿模型工作負載。
作為NVIDIA Vera Rubin和NVIDIA Vera CPU的早期採用者,CoreWeave也是首批採用NVIDIA Spectrum-X乙太網路光學技術的公司之一,這有助於為百萬GPU的AI工廠提供網路基礎。CoreWeave正在擴展其平台,用於機器人技術和實體AI工作流程,包括使用最新的前沿世界基礎模型NVIDIA Cosmos 3,協助團隊生成合成資料、微調模型並加速機器人資料飛輪。
包括Anthropic在內的領先AI實驗室都在CoreWeave的基礎設施上建構,以大規模支援前沿模型。CoreWeave共同創辦人、董事長暨執行長Michael Intrator表示:「AI工廠正成為代理時代的基礎。CoreWeave正與NVIDIA合作,建構全端雲端基礎設施,為AI實驗室、企業和開發者提供所需的效能、規模和可靠性,將前沿模型、AI代理和實體AI系統轉化為生產應用。」
Nebius為代理式工作流程建構開放式實體AI工作台Nebius正在擴展其NVIDIA AI雲端,提供一個用於訓練、推論和實體AI開發的全端平台。作為NVIDIA Vera Rubin的早期採用者,Nebius正在建構從晶片到軟體的整合式AI基礎設施,包括其Nebius AI Cloud、Token Factory推論層和新的Physical AI Workbench。
該工作台將NVIDIA Cosmos 3、NVIDIA Isaac Sim和Isaac GR00T等技術整合到可由AI代理組裝的可組合工作流程中,協助機器人技術和自主系統團隊更快地從模擬和合成資料轉向訓練和評估。Nebius創辦人暨執行長Arkady Volozh表示:「開發者應該能夠建構AI系統,而無需花費數週時間來連接基礎設施。
Nebius正與NVIDIA合作,創建一個AI雲端,讓AI代理能夠組合所需的工具、資料和運算能力,以加速AI工作負載,從機器人技術和生命科學到企業,從實驗到生產。」NVIDIA典範雲端動能自NVIDIA去年推出典範雲端(Exemplar Cloud)以來,已有六家NVIDIA雲端合作夥伴獲得典範雲端地位:CoreWeave、Crusoe、Lambda、Nebius、Vultr和YTL。
不斷增長的合作夥伴名單反映了市場對能為生產級AI工作負載提供一致效能、可靠性和效率的AI雲端基礎設施日益增長的需求。這些供應商正協助提升整個AI雲端生態系的效能標準,為企業、開發者和AI實驗室提供更多經過驗證的選項,以擴展訓練、推論和代理式AI服務。
為AI工廠經濟效益而設計隨著AI從模型開發轉向推理和大規模推論,基礎設施的衡量標準不再僅僅是公布的容量,還包括由平台利用率、正常運行時間、長資產壽命以及人們可以投入使用的有用AI代理的廣度與深度所驅動的token輸出經濟效益。建構於NVIDIA全端AI工廠平台之上,AI雲端協助合作夥伴針對這些衡量標準優化基礎設施。
每token成本是總體擁有成本指標,直接考量了硬體效能、軟體優化、生態系支援和實際利用率。NVIDIA透過實際token吞吐量、軟體優化以及跨運算、網路、記憶體和儲存的全端協同設計,實現了業界最低的每token成本。DSX協助AI雲端更快投入運作NVIDIA AI雲端正在採用NVIDIA DSX平台來設計、建構和營運AI工廠。
DSX整合了經過驗證的參考設計、模擬、軟體和生態系技術,協助雲端供應商更快地投入運作、更有效率地營運並最大化收入。DSX Sim協助團隊在部署前對AI工廠進行建模和驗證。DSX Flex協助AI工廠動態調整工作負載以適應電網狀況。DSX MaxLPS協助功耗受限的AI工廠在固定功耗預算內最大化運算能力,可啟用多達40%的GPU。
DSX OS協助自動化生命週期管理和大規模營運。DSX協助AI雲端降低部署風險、提高韌性、每瓦提供更多token並實現最低的token成本。



