IT之家10月2日消息,輝達今日正式披露DGX Spark產品更新,推出64GB內存版本的DGX Spark桌面AI計算機,起售價4,999美元(現匯率約合33,566人民幣),將於10月23日正式發售。宏碁、戴爾、華碩、技嘉、微星、H3C等OEM廠商也將推出基於該平台的整機產品。
官方此前推出的128GB版本也同步更新了定价,128GB FE 版本的售价为6,950美元(IT之家注:现汇率约合46,666元人民币)。


在硬件方面,DGX Spark基於GB10 Grace至Blackwell的超算芯片,依靠統一內存架構來連通CPU與GPU的內存空間。此次新增的64GB內存版本,整機總內存為64GB,其中系統預留約8GB,可供模型權重與KV緩存使用的內存空間約56GB。該設備支持NVFP4量化格式,能夠順暢部署Gemma4 26B、Qwen3.8-27B、Meta Muse Glimmer、Nemotron3.5、Lightning等主流開源大模型。輝達表示,模型載入完成後仍留有充足內存餘量用於KV緩存,以支撐長上下文推理任務。
該設備的一大亮點是原生具備多機集羣擴展能力,內置 ConnectX-7 高速網卡,並搭配全新的 NVIDIA Sync 工具套件。根據官方說法,普通開發者無需深厚的網絡運維知識,就能搭建多節點集羣。套件內置的 Cluster Assistant 集羣助手可自動完成網絡配置、設備校驗和 SSH 環境部署,最多支持 4 台 DGX Spark 的組網。
官方實測顯示,兩臺 64GB 的 DGX Spark 组成集羣運行 Qwen3.8-27B 模型時,相比單臺設備性能最高可提升 1.7 倍,顯著提高推理吞吐量。開發者還可以從普通的 PC 遠程接入 DGX Spark 集羣,對接 VS Code、Cursor 等主流 IDE,遠程監控整機狀態,並一鍵啟動 vLLM 推理容器,以降低分佈式 AI 的開發門檻。
在軟件生態方面,DGX Spark 完整搭載了 NVIDIA CUDA 加速 AI 軟件架構,並深度適配 vLLM、llama.cpp 推理框架。輝達表示,該產品針對本地智能體工作流進行了專項優化,運行本地智能體推理時最高可實現 1.9 倍的速度提升。Perplexity 已完成適配,推出了針對 DGX Spark 優化的便攜式計算機智能體,Laguna S2 118B 大模型也能在該硬體上完成本地部署運行。
同時,Nemotron系列模型、Gemma、Qwen、DeepSeek、Mistral、Stability.ai等主流開源社區模型和框架也已完成適配,可實現開箱即運用先進模型。報道稱,硬體製造商與開源社區已形成完整的開發者生態矩陣。
性能測試顯示,部署在 DGX Spark 上的 Qwen3.8 27B 模型,評測得分與領先的閉源模型僅有 10 分的差距。報導稱,這表明桌面硬體已經具備運行高品質模型的能力。統一內存架構也得到業界開發者的認可。Perplexity 的創始人 Aravind Srinivas 評價稱,DGX Spark 可以近乎滿負載運行,散熱表現穩定,統一內存設計能夠最大化每瓦功耗下的 Token 產出效率,適合 7×24 小時不間斷運行本地智能體任務。
不過,這套平台依然面向專業開發者。4,999美元(現行匯率約為33,566人民幣)的定價,決定了其目標群體主要是AI研究人員、獨立開發者以及小型AI創業團隊,而非普通消費用戶。隨著64GB版本的推出,相較於128GB版本,其採購門檻有所降低,讓更多團隊能體驗到本地集羣的能力。












