前瞻智慧正走向在地化。在 IFA 2026 大會上,NVIDIA、Microsoft 及其合作夥伴攜手合作,提供更快的推論速度和新工具,讓代理程式更容易在 NVIDIA 硬體上進行設定與在地運行。全新精巧的 NVIDIA RTX Spark Windows PC 也將於十月上市,為 AI 愛好者、開發者和創作者提供更多方式,能在本地安全地運行強大的代理程式。
今日的發布內容包括:Hermes Agent、OpenClaw 和 Perplexity Portable Computer 將提供簡化的 NVIDIA GPU 在地 AI 支援。在地推論速度最高可提升 1.9 倍,新的 llama.cpp 和 vLLM 優化現已直接提供,並可透過 LM Studio 和 Ollama 取得。
NVIDIA PAIR 是一款個人 AI 路由器工具,能智慧地將 AI 推論任務分配到使用者在地網路上的多台 PC。NVIDIA RTX Spark 將於十月上市,屆時將有 Lenovo 和 Acer 等品牌推出新款 Windows PC。
Electronic Arts、Embark 和 Ubisoft 等遊戲發行商和開發商也將其熱門遊戲帶到 NVIDIA RTX Spark 平台。
此外,八月對於在地 AI 而言也是繁忙的一個月:Nemotron 3.5 Lightning 是一款 300 億參數模型,已正式推出,可在 NVIDIA RTX PC、RTX PRO 工作站、DGX Spark 和 Jetson 上運行。Z.ai 的 GLM-5.3-Flash 是一款多模態專家混合 (MoE) 模型,將代理式 AI 帶到 DGX Station。
Qwen 發布了 Qwen3.8-Flash-Next,這是一款開源權重多模態 MoE 模型,可在 DGX Spark 和 DGX Station 上在地運行。同時也推出了 Qwen3.8-27B,這是一款 270 億參數的開源模型,針對 NVIDIA GPU 上的在地代理式和編碼工作負載進行了優化。
LTX 的 LTX 2.5 是一款針對 NVIDIA RTX GPU、DGX Spark 和 DGX Station 優化的開源世界影片生成模型,透過新的 NVFP4、FastVideo 和 ComfyUI 增強功能,實現更快、更節省記憶體的在地生成。
MiniMax-H3 是一款帶有同步音訊的開源影音生成模型,可透過 ComfyUI 在 NVIDIA GPU 上在地運行。FastVideo 與 NVIDIA 研究人員合作,透過發布 FastH3 進一步改進了這項技術,這是一個開源的四步驟蒸餾版本,效能提升了 7 倍。
針對 NVIDIA RTX GPU 和 DGX Spark 優化的 FastVideo 配方即將推出。
Meta 的 Muse Glimmer 是一款 300 億參數的開源權重模型,用於編碼和代理式工作負載,可在 GeForce RTX PC、DGX Spark、DGX Station 和 Jetson 上在地運行。NVIDIA 還發布了支援 DGX Spark 的 NVFP4 量化技術,以實現更節省記憶體的在地部署。
DeepSeek v4 Flash 是一款 2840 億參數的 MoE 模型,具有 130 億個活躍參數,可在 2 個 DGX Spark 叢集和 DGX Station 上在地運行。
簡化在地代理程式的啟動流程
過去,要讓在地代理程式與在地模型一起運行需要一些努力,包括選擇模型、尋找相容的推論伺服器、調整量化設定並保持所有內容更新。現在,在 RTX 和 DGX 系統上,這些摩擦點正在消失。
三個最廣泛使用的代理程式應用程式將在 Windows 上提供簡化的在地模型設定,每個都基於 llama.cpp 並整合了 NVIDIA 最新的推論優化。新的設定體驗旨在減少手動配置,讓在地代理程式更容易啟動和運行。
上個月,Perplexity 推出了其 Portable Computer 代理程式,為使用者提供了一種簡單的方式,可以在 NVIDIA DGX Spark 等 Linux 系統上在地運行 Perplexity,將模型、編排和工具打包成一個單一的應用程式體驗。
Perplexity Portable Computer 適用於至少具有 24GB VRAM 的 NVIDIA RTX GPU(運行 Linux),並即將支援 Windows,將同樣簡化的設定帶給更廣泛的 PC 使用者。使用者可以在不消耗點數的情況下在地運行完整的工作流程,同時在需要額外研究或推理時,選擇性地將任務的一部分上傳到雲端中的 15+ 個前瞻模型之一。
Portable Computer 在將內容發送到雲端之前會徵求許可,幫助使用者將敏感資訊保留在裝置上。
以下是一些使用案例範例:工程:審查已連接 GitHub 儲存庫中的開放 PR,並將其分類為準備就緒、受阻、過時和需要審查,每個都標記了下一步。找出與最新合併不同步的文件並進行修復,並為這些更改開啟 PR。金融:將代理程式指向兩年的券商摘要、合併的 1099 表格和報稅表,讓它追蹤產生最多可避免費用和稅務拖累的重複持有,每個數字都引用到確切的文件和頁面,所有這些都無需文件到達聊天機器人。
新創公司:詢問為何啟用率停滯不前,代理程式會在本地分析漏斗匯出,找出新註冊用戶在安裝和首次完成任務之間流失的位置,然後將最重要的見解直接發布到團隊的 Slack 頻道。
立即試用 Portable Computer。
Hermes Agent 由 Nous Research 開發,是一款數百萬人使用的通用代理程式,以其可靠性和自我改進能力而聞名。Hermes 不受模型和供應商限制,旨在全天候在在地系統上運行,這使得 RTX PC、RTX PRO 工作站和 DGX Spark 成為其理想的運行平台。
在 Hermes 中配置在地模型將為使用者提供 RTX 和 DGX 系統在 Windows 上的一鍵設定。代理程式將自動偵測 NVIDIA GPU,選擇適當的模型和配置,並透過整合的 llama.cpp 運行,其中已包含 NVIDIA 推論優化,從而無需手動下載和調整模型。即將支援 Linux。
一旦運行,Hermes 的運作方式與其他地方相同。它使用工具,在任務之間保持上下文,在會話之間記住資訊,並隨著時間的推移創建可重複使用的技能,使代理程式隨著持續使用而變得更加強大。在 GPU 上在地運行模型可保持快速效能,同時將資料保留在系統上。
一鍵在地模型設定現已在 Windows 上提供,即將支援 Linux。了解更多關於 Hermes Agent 的資訊。
OpenClaw 已成為開源代理程式運動的標誌性專案之一,它是 GitHub 上最大的 AI 專案,擁有超過 38 萬顆星,並且擁有一個快速成長的社群,正在研究、工程、專案管理和日常生產力方面建立工具和技能。NVIDIA、Microsoft 和 OpenClaw 一直在合作,讓在 Windows PC 上設定這種體驗變得更容易。
為了減少入門摩擦,OpenClaw Windows App 簡化了在任何具有至少 24GB VRAM 的 RTX GPU 上設定優化在地模型的過程。
在 OpenClaw 部落格中了解更多資訊。
更快的推論為在地代理程式帶來提升
推論效能對於保持在地代理程式的響應速度至關重要。NVIDIA 持續與開源 llama.cpp 和 vLLM 社群合作,加速在地 NVIDIA 平台上的代理式工作負載。
llama.cpp 透過 GeForce RTX 5090 上的核心優化、增強的推測解碼技術和更快的預填充,提供高達 1.9 倍的吞吐量。vLLM 在 RTX PRO 6000 Blackwell 工作站版上提供 1.2 倍的效能,在兩個 DGX Spark 叢集上最高可達 1.4 倍。FlashInfer 中的新 XQA 注意力核心和後端優化有助於加速這兩個平台上的推論。
這些效能提升可在 llama.cpp 和 vLLM 推論後端上使用。使用者也可以透過 LM Studio 和 Ollama 應用程式體驗這些功能。
利用閒置 PC 獲得更多在地 AI 運算能力,透過 NVIDIA PAIR
超過一半的美國家庭擁有兩台或更多 PC,其中大部分運算能力在一天中處於閒置狀態。NVIDIA 個人 AI 路由器 (PAIR) 是一款免費的開源軟體工具,可讓這些系統協同工作,用於在地 AI。
代理式工作流程通常將複雜任務分解為可以平行運行的小型作業,但當每個請求都競爭相同的 GPU 時,效能可能會變慢。PAIR 會自動發現在地網路上的相容 PC,並將獨立的推論請求路由到任何有容量的系統。它適用於 Ollama 和 LM Studio,並且可以隨著裝置加入或離開網路而調整。
例如,使用者可以要求 Hermes 透過整理雜亂的收件匣並優先處理現在需要關注的、可以等待的和可以跳過的內容來創建一個「週日重置」計畫。Hermes 可以將這項工作分配給多個子代理程式,而 PAIR 則將這些作業分配給可用的 PC,而不是讓它們都等待單一 GPU。
結果是為在地代理程式提供了更多的運算能力,可以平行運行更多的任務,並且靈活地將 AI 工作負載轉移到另一台 PC,同時主系統用於遊戲、創作或其他工作。NVIDIA PAIR Beta 版適用於 Windows、macOS 和 Linux,透過圖形和終端介面提供,支援 NVIDIA GeForce RTX 20 系列 GPU 及更新版本、NVIDIA RTX PRO 工作站 GPU(Turing 架構及更新版本)、NVIDIA DGX Spark 和 Apple M4 或更新的晶片。
查看 NVIDIA 技術部落格以開始使用 NVIDIA PAIR。
透過 CyberLink PhotoDirector AI PC 模式在 RTX Spark 上進行強大的裝置端照片編輯
開源影像和影片模型使藝術家能夠在 PC 上嘗試創意 AI 模型。這使得藝術家能夠迭代和探索概念和想法,而無需擔心代幣焦慮,並將更多創意作品保留在裝置上。
訊連科技 (CyberLink) 的全新 PhotoDirector AI PC 模式是首批將這些擴散模型直接整合到創意軟體中的應用程式之一,並將其轉變為藝術家觸手可及的創意工具。當 PhotoDirector 365 推出並針對 NVIDIA RTX Spark 進行優化時,AI PC 模式使用者將獲得 AI 驅動的編輯工具,用於生成式編輯、影像增強、物件和干擾移除、背景移除和替換、人像精修以及創建全新的視覺效果,並可根據任務靈活選擇在地或雲端處理。
在 NVIDIA GPU 上,PhotoDirector 使用 TensorRT-RTX 和 FP8 來加速在地 AI。
立即開始使用訊連科技的 PhotoDirector 365 照片編輯軟體,並了解更多關於將於十月隨 RTX Spark 推出的 PhotoDirector AI PC 模式。
NVIDIA RTX Spark Windows PC 將於 2026 年十月上市
NVIDIA RTX Spark 將於今年十月上市,在 IFA 2026 上,合作夥伴正在展示他們的硬體。在 IFA 上,新宣布的設計加入了現有六家 OEM 廠商將於十月出貨的行列。Acer 展示了其精巧的桌上型 RTX Spark 概念,Lenovo 宣布了其 Yoga Pro 9n 和 Yoga 9n 二合一筆記型電腦。
RTX Spark 是 Windows PC 的新開端。一台專為創作者、遊戲玩家和 AI 代理程式打造的 PC。憑藉強大的 1 Petaflop RTX Blackwell GPU、高達 128GB 的統一記憶體和高效的 20 核心 Grace CPU,RTX Spark 提供令人難以置信的效能和效率。
這款超級晶片使高效能輕薄筆記型電腦能夠實現全天電池續航,並使精巧的桌上型電腦能夠為始終在線的代理程式提供動力。搭配新的 Windows Agent 框架,它使代理程式能夠在作業系統層級控制下安全地在背景運行。
上週在 Gamescom 上,Electronic Arts、Embark 和 Ubisoft 是最新將其熱門遊戲帶到 NVIDIA RTX Spark Windows PC 的遊戲發行商和開發商之一。他們加入了在五月 COMPUTEX 上宣布支援 RTX Spark 的發行商,包括 KRAFTON、NetEase、Riot Games 和 XBOX。閱讀更多。
註冊以在 RTX Spark 筆記型電腦和桌上型電腦上市時收到通知。
#ICYMI:NVIDIA 在地 AI 的更多更新
🎮 NVIDIA 將新 RTX 技術和遊戲帶到 Gamescom,NVIDIA 發布了 DLSS 4.5 光線重建,採用新的第二代 Transformer 模型,可改善光線追蹤和路徑追蹤遊戲的影像品質。Gamescom 還帶來了針對 007 First Light、CONTROL Resonant 和 Gears of War: E-Day 等遊戲的新 RTX 公告,以及對即將推出的 NVIDIA RTX Spark 的擴展遊戲支援。
🐋 介紹 DeepSeek Harness,DeepSeek 的新開源 Harness 與 DeepSeek-V4-Flash 搭配使用,為 NVIDIA DGX Station 上的在地代理式編碼工作流程提供動力。



