個人代理正掀起熱潮,OpenClaw 與 Hermes 等開源專案在 GitHub 上被 AI 開發者社群迅速採用。 這些代理專為適應個人偏好與工作流程而打造,可與應用程式互動、生成內容、自動執行重複性流程並管理多步驟任務,而且所有工作都能在裝置上本機執行。
今天在 COMPUTEX 的 NVIDIA GTC Taipei 上,NVIDIA 發表 NVIDIA RTX Spark 這款專為個人代理打造的新型 Windows PC,同時推出一系列更新,將本地代理擴展至更廣泛的 NVIDIA RTX 與 DGX 生態系統。
安全且私密地執行代理需要能勝任任務的硬體。 RTX Spark 的 1 petaflop AI 運算能力與 128GB 統一記憶體可滿足裝置上代理的運算需求,提供從工具到隊友的全新電腦。 RTX Spark 專為 AI、創作與遊戲而設計,將 NVIDIA 30 年的技術創新融入纖薄的 Windows 筆記型電腦,提供全天候續航力與超高效率的桌上型 PC。
NVIDIA 與 Windows 的合作關係從個人解決方案擴展至企業解決方案。 同時在展會上推出 NVIDIA RTX Station,這是一款專業人士專用的極致 AI 桌上型超級電腦,配備資料中心級的 GPU 與 CPU,用於在桌上型電腦系統進行推論,並配備 Windows 以提升管理性、安全性和相容性。
其他公告包括:
- NVIDIA OpenShell 執行階段即將登陸 Windows,其建置於 Microsoft 全新的代理程式安全基元上,為開發者提供一套易於部署的套件,實現安全的裝置端 AI 代理。Hermes Agent 與 OpenClaw 也將 OpenShell 與 Microsoft 安全底層機制整合至新的 Windows 應用程式。
- NVIDIA NemoClaw 藍圖正在 NVIDIA 完整的本機 AI 產品陣容中擴展:GeForce RTX、RTX PRO、RTX 與 DGX Spark、RTX 與 DGX Station,並提供全新的簡化安裝程式以及對 Hermes Agent 的支援。
- 在cpp 與 vLLM 中透過多 Token 預測,在頂級代理模型上獲得 2 倍的推論效能,以及 llama.cpp 與 ComfyUI 的全新多 GPU 最佳化。
- H Company 正發布電腦用工具,包括新模型與即將推出的桌上型代理Harness,並已針對 RTX 與 DGX PC 最佳化。
- Adobe 正在重新建構其 Photoshop 與 Premiere 應用程式,Blender 則正在新增 NVIDIA DLSS 4.5 光線重建,而 NVIDIA 則公布了 RTX 影片畫格生成,並將支援 ComfyUI。所有這些更新都於今年秋季透過 RTX Spark 一起推出。
- NVIDIA Broadcast 2.2 更新帶來 Studio Voice 功能最佳化,並支援 Elgato Stream Deck。 NVIDIA Project G-Assist 也新增了 Stream Deck 整合。
本地代理 AI:在 Windows RTX PC 上個人化、私密化且快速
代理的廣泛採用受到限制,因為無法在使用者的主要 PC 上安全且隱密地執行代理。
NVIDIA 與 Microsoft 正在合作,為裝置端代理打造安全穩健的 Windows 平台,以應對這一挑戰。
這項協作以堅實的基礎為起點:全新的 Windows 安全性基礎原語與 NVIDIA OpenShell 執行環境,確保代理在完全由使用者掌控的環境下安全運行。
全新 Windows 基本元件提供身分識別、隔離、政策控管與端對端安全功能,可原生打造並執行代理程式。NVIDIA OpenShell 提供了額外的政策功能,讓使用者定義代理能做什麼與不能做什麼,能夠根據使用者的隱私權政策,將查詢智慧地路由至本地模型,並且能夠在傳送至雲端模型的查詢中偽裝個人資訊。
Hermes Agent 與 OpenClaw 等領先的代理程式開發者,正於其新 Windows 應用程式中採用此強大安全與隱私層。這些新 App 將讓使用者能輕鬆安全地存取強大的裝置上代理,在 Windows 應用程式中執行任務、透過跨應用程式工作流程推理、生成影像與影片、編寫外掛程式與 App 的程式碼,以及語義搜索本機檔案。
若要在本機裝置驅動代理,既需要穩健的安全機制,也需要高效能的硬體。RTX Spark 具備高達 1 petaflop AI 算力和 128GB 統一記憶體,以滿足裝置端 AI 代理的處理需求。
NVIDIA 也在加速這些代理所仰賴的本機開放式模型生態系統。
NVIDIA 與 llama.cpp 社群協作,實現多項功能與最佳化,例如多 token 預測 (MTP):一種推測性解碼技術,由較小的草稿模型一次提出多個 token,再由目標模型在單次傳遞中進行驗證。這與程式化相依啟動與其他最佳化功能相結合,在 Qwen 3.6 與 3.5 27B 上提供 2 倍效能,並在 Qwen 3.6 與 3.5 35B 上提供 1.6 倍的效能提升。這些更新內容可透過 llama.cpp webUI 與 LM Studio 使用。

為了支援執行多 GPU 設備的 AI 愛好者,NVIDIA 與開源社群合作,強化兩款最熱門的本機 AI 工具:
- cpp 新增張量平行運算,在兩台等效 GPU 上最高可達 2 倍記憶體與 1.8 倍運算能力。
- ComfyUI 獲得全新的免分類器指導方法,在兩部等效 GPU 上最高可達 2 倍效能,並可選擇在多 GPU 之間拆分模型鏈,以充分利用組合後的記憶體。


NVIDIA 也正與 H Company 一起擴展代理程式功能。 H Company 的電腦使用的Harness,讓代理程式能像使用者一樣觀察螢幕、操控滑鼠與鍵盤,在 PC 上導航,即使在沒有應用程式介面的 App 中也是如此,而且很快將在支援本機模型的 RTX 與 DGX PC 上推出。
NVIDIA 已與 H Company 合作,量化其最先進的 Holo 電腦使用模型,並加速其中繼工具,在 NVIDIA GPU 上加速 2 倍,同時將記憶體消耗降低 35%。模型現已開放下載,而 Holo Desktop App 也將很快推出。
Linux 的代理程式最佳化
對於需要隨時可存取的本機代理的開發者而言,NVIDIA DGX Spark 是最強大的個人代理 AI 電腦,適合需要 Linux 環境的開發者,將大型記憶體、快速運算能力以及與 NVIDIA CUDA 生態系統的相容性統一起來。
本月的 DGX Spark OS 版本透過簡化的 NemoClaw 安裝程式,帶來最簡化開箱即用的體驗,並在頂級代理模型上提供更快的推論速度。
NemoClaw 現已支援 Linux 上所有 NVIDIA RTX 與 DGX PC 以及 Windows Subsystem for Linux。 透過全新簡化的安裝程式安全地在 Linux 上部署本機代理,提供自動沙盒功能,並新增對 Hermes Agent 的支援。
NVIDIA 已與 vLLM 合作,透過 vLLM 中的最佳化以及針對 Qwen 3.6 35B 的新最佳化 NVFP4 檢查點,來最佳化代理程式的推論。與 Unsloth 先前提供的 NVFP4 檢查點相比,這些更新在 DGX Spark 上提供 2.6 倍的效能,並包含核心改良、混合精確度以及 MTP 的 CUDA Graph 支援。
閱讀 vLLM 部落格,瞭解在 DGX Spark 上提供 NVFP4 專家混合 (mixture-of-experts) 模型服務的完整逐步說明:從統一記憶體調校到正常運作的 NVIDIA Nemotron 3 Super 參考設定。
透過 Adobe 提供強大的創作體驗
NVIDIA 與 Adobe 合作,為 RTX Spark 重新設計 Adobe Premiere 與 Photoshop 的架構。 Photoshop 中由 Firefly 支援的生成式填色以及 Premiere 中的生成式延伸,都是數百種能提供創意能力、精確度與控制力的加速工具之一。RTX Spark 進一步提升這些功能,在整個創意工作流程中提供速度提升高達 2 倍的 AI、編輯、著色及效果。
Adobe Premiere 將支援全新的影片管線,利用 RTX Spark 的統一記憶體、Blackwell GPU 與 TensorRT 軟體,提供即時效能以編輯與色彩校正、GPU 加速的 AI 效能,以及更有效率地渲染複雜時間軸。 此外,Adobe 的 Substance 3D Painter 與 Stager 將在 RTX Spark 上原生執行,實現更流暢、更靈敏的 3D 紋理加工與場景創作工作流程。
Adobe 的新一代 Photoshop 引擎將針對 GPU 加速合成進行最佳化,支援即時濾鏡、高動態範圍以及現代自然筆觸。AI 原生管線旨在充分利用 RTX Spark 的全部功能,包括 TensorRT。
Adobe 將進一步擴展 Premiere 與 Photoshop,允許使用者使用 Windows 代理程式創作、編輯與設計,為創作者提供協作的隊友,加速工作流程。
Premiere、Photoshop 與 Substance 等 Adobe 創意 App 的更新預計將與 RTX Spark 的推出同步開始。
為創作者提供的新工具與 App 更新
全新的 NVIDIA 平台更新與合作夥伴 App 最佳化正在更廣泛的 RTX 生態系統中推出——部分已於今日推出,其他則將於今年秋季隨 RTX Spark 一併推出。
NVIDIA Broadcast 2.2 的 Studio Voice:一項可讓任何麥克風聽起來都達到工作室音質的 AI 功能,從今日起正式脫離測試版。Studio Voice 現已在 GeForce RTX 3060 GPU 或以上版本上執行,效能大幅提升。 該應用程式也獲得 Elgato Stream Deck 整合以及可設定鍵盤快捷鍵。
Project G-Assist 也透過 Elgato MCP Server 新增 Stream Deck 支援,讓使用者能在串流設定中啟用 AI 助理功能。
此外,Blender Cycles 正整合 DLSS 4.5 光線重建作為全新的降噪器,將路徑追蹤視埠變成互動式的即時檢視器。 這讓 3D 藝術家在場景中自由導航,同時看到接近最終的渲染品質,徹底改變了燈光與視覺開發工作流程。 更新將於今年秋季隨 Blender 5.3 及 RTX Spark 一併推出。
RTX 影片畫格生成也隨 RTX Spark 推出,這是一種全新的 AI 效果,可即時將影片畫格率提高一倍或四倍,適合用於增強 AI 模型通常生成的每秒 15-20 畫格 (FPS) 輸出。它以 Python wheel 和 ComfyUI 節點的形式提供,讓 AI 藝術家能以低FPS加速生成影片,再透過插補提升至流暢的播放幀率。
#ICYMI:RTX AI Garage 最新消息
🪐 閱讀完整版 NVIDIA RTX Spark 公告,瞭解超級晶片、NVIDIA 與 Windows 在代理程式上的合作成果,以及合作夥伴筆記型電腦與小型桌上型電腦的詳細資料。
💻ASUS ProArt 創作者筆記型電腦現已搭載 Black Forest Labs 的 FLUX.2 Klein 4B — 這是一款透過 MuseTree App 預先安裝的蒸餾影像模型,並已針對 NVFP4 格式與 NVIDIA TensorRT for RTX 軟體開發套件進行最佳化。創作者最高可獲得 2.5 倍加速,並減少 560% 的記憶體使用量,首次執行體驗從開箱到在本機生成影像都直接完成,無需下載模型或 ComfyUI 設定。
🎬 NVIDIA AI for Media 軟體開發套件正在推出更新,包括針對法語、德語與西班牙語最佳化的全新 LipSync NVIDIA NIM 微服務。 Active Speaker Detection NIM 微服務也新增了多攝影機支援,具備跨影片的說話者關聯功能。
🤖 查看最新的 RTX AI Garage 部落格文章,瞭解 Hermes Agent 以及在 RTX PC 與 DGX Spark 上自我提升的 AI。
請參閱更多軟體產品資訊 通知 。
