RTX Spark 是 Nvidia 首次進軍 Windows 筆記型電腦的產品,專為在本地執行 AI 代理程式而設計。這款硬體是已知的 DGX Spark 晶片的 Windows 版本。Nvidia 在 GTC 台北發表了 RTX Spark。

在高階版本中,該晶片與為 DGX Spark 提供動力的 GB10 Grace Blackwell 超級晶片相同。差異在於目標客群。RTX Spark 不再是針對 AI 開發者的 Linux 工作站,而是鎖定消費者的 Windows 筆記型電腦和小型桌上型電腦。

Nvidia 提供多種變體,具有不同的核心和 SM 數量,以及從 16 到 128 GB 的記憶體選項。頂級 SKU 將 Blackwell RTX GPU(配備 6,144 個 CUDA 核心和第五代 Tensor Cores)與 20 核心的 Arm 架構 Grace CPU 配對,透過 NVLink-C2C 連接。

根據 Nvidia 的說法,聯發科協助設計了這款 CPU。記憶體最高可達 128 GB,由 CPU 和 GPU 共享。所宣稱的 1 petaflop 峰值是指在 FP4 精度下且具稀疏性(sparsity)的表現,這是根據 Nvidia 規格的理論最佳情況。

Nvidia 表示,根據工作負載,GPU 效能接近 GeForce RTX 5070 筆記型電腦 GPU。

Nvidia 對 Apple Silicon 和 Snapdragon 的回應

RTX Spark 遵循了 Apple 在 2020 年以其 M 系列晶片所開創的道路:將 Arm CPU、GPU 和記憶體控制器整合在一個封裝中,共享統一記憶體池而非獨立的 VRAM。Apple 的 M4 Max 也提供高達 128 GB 的統一記憶體,頻寬為 546 GB/s,但其神經網路引擎最高僅達 38 TOPS (INT8)。

相較之下,RTX Spark 聲稱約 1,000 TOPS,儘管這是 FP4 精度且具稀疏性的情況,因此條件非常不同。儘管如此,原始 AI 運算能力的差距仍然顯著。Nvidia 的真正優勢仍在於其 CUDA 堆疊,包括 TensorRT 和 RTX,這些都可原生運行。

Qualcomm 也在 2024 年以 Snapdragon X Elite 進軍 Windows-on-Arm 筆記型電腦市場,隨後於 2025 年 9 月推出 X2 Elite,將 18 個 Oryon 核心的效能提升至 80 TOPS。

這些晶片圍繞著 Microsoft 的 Copilot+ 功能而建,而非用於數十億參數模型的本地推論。來自 Intel 和 AMD 的傳統 x86 平台仍然依賴獨立的 CPU 和 GPU 記憶體,並配備小得多的 NPU。

本地 AI 代理程式獲得新的安全防護

Nvidia 認為,AI 代理程式很少在用戶的主要裝置上運行,因為缺乏適當的安全工具。新的 Windows 元件旨在提供身份管理、代理程式隔離和策略執行。Nvidia OpenShell Runtime 增加了另一層:它定義了代理程式被允許做什麼,根據隱私設定將請求路由到本地或雲端模型,並在雲端查詢中遮蔽個人資料。

根據 Nvidia 的說法,開源專案 Hermes Agent 和 OpenClaw 已將此層整合到其 Windows 應用程式中。

Adobe 也宣布計劃為現代 GPU 重建 Photoshop 和 Premiere。Premiere 將獲得一個新的視訊管線,並整合 Nvidia TensorRT。Photoshop 將獲得一個新的引擎,具備 GPU 加速的合成功能。在 RTX Spark 上,Premiere 也將受益於共享記憶體池。Adobe 表示,目標是將 AI、編輯和特效工作流程的速度提升兩倍。

除了筆記型電腦晶片,Nvidia 還展示了適用於 Windows 的 DGX Station。它基於 GB300 Grace Blackwell Ultra 桌上型超級晶片,擁有高達 748 GB 的共享記憶體和 20 petaflops 的 FP4 效能。

Nvidia 表示,它可以在本地運行高達一兆參數的模型。它將於 2026 年第四季出貨。RTX Spark 裝置將於 2026 年秋季開始由 ASUS、Dell、HP、Lenovo、Microsoft Surface 和 MSI 等廠商提供。