NVIDIA DGX Spark
使用此功能在購物車中區分不同的配置 — 當您訂購相同產品但不同選項時非常方便。
完整規格
運算及記憶體
晶片
NVIDIA GB10 Grace Blackwell Superchip
中央處理器
20 核心 Arm (10 × Cortex-X925 + 10 × Cortex-A725)
統一記憶體
128 GB LPDDR5x (273 GB/s 頻寬)
AI 效能
1 PetaFLOP (FP4)
儲存及實體規格
儲存
4 TB NVMe SSD,自我加密 (PCIe Gen4)
尺寸
150 × 150 × 50.5毫米
重量
1.2公斤
顯示輸出
最多支援 3 個同步顯示輸出 (HDMI + USB4 DisplayPort alt-mode)
電源及網絡
電源供應器
240 W USB-C PD 轉接器
網絡
NVIDIA ConnectX-7 Smart NIC,雙 200 Gbps QSFP + 10 GbE RJ-45
無線連接
Wi-Fi 7,Bluetooth 5.4
軟件及保安
操作系統
NVIDIA DGX OS (Ubuntu 24.04 LTS),預載完整 CUDA AI 技術堆疊
智能代理 AI
內置 NemoClaw sandbox 代理框架
保安功能
TPM 2.0、Secure Boot、自我加密 SSD
NVIDIA DGX Spark 是 NVIDIA GB10 Grace Blackwell 超級晶片 的參考桌面系統,首次於2025年1月以開發代號 Project DIGITS 公開展示,其後以最終名稱推出。作為 NVIDIA 親自設計、驗證並持續直接更新的平台,它將 1 petaFLOP 的 FP4 AI 效能 及 128 GB 統一記憶體 封裝於僅重1.2公斤的機箱內,小巧得可置於鍵盤旁的桌面上。
由於 DGX Spark 是 NVIDIA 自家的參考設計,因此亦是首個驗證全新 GB10 生態系統功能的平台。在2026年3月下旬的 NVIDIA GTC 2026 大會 後,4節點 RoCE 叢集技術的官方支援 — 可將單一部署的共享統一記憶體提升至 512 GB — 率先於 DGX Spark 上獲得確認,其後才擴展至合作夥伴硬件;而現有的2單元直接連結功能,早已是整個 GB10 系列的標準配置。
硬件規格
其核心為 NVIDIA GB10 Grace Blackwell 超級晶片,結合了20核心 Arm 處理器(10個 Cortex-X925 效能核心 + 10個 Cortex-A725 效率核心)與 Blackwell 世代 GPU,配備第五代 Tensor 核心及原生 FP4 稀疏支援。兩者由 128 GB LPDDR5x 統一記憶體橋接,提供 273 GB/s 的 CPU 與 GPU 共享頻寬,消除了傳統分離式 CPU/GPU 記憶體池所帶來的複製開銷。儲存裝置為 4 TB 自我加密 PCIe Gen4 NVMe SSD,容量足以本地儲存大型模型檢查點及數據集。
軟件:完整的 NVIDIA AI 堆疊,預先安裝
DGX Spark 預裝 NVIDIA DGX OS(Ubuntu 24.04 LTS)及完整的 NVIDIA AI 軟件堆疊,並已針對硬件進行驗證 — CUDA、cuDNN、TensorRT 及 NVIDIA Container Runtime 於首次啟動時已準備就緒。NVIDIA NIM 微服務讓支援的模型可部署為經優化的推論容器,無需手動調整;當工作負載稍後遷移至 NVIDIA DGX Cloud 或數據中心 DGX 系統時,相同容器可無縫沿用。持續維護的官方劇本涵蓋常見工作流程 — 從 vLLM 及 TensorRT-LLM 服務,到使用 NeMo 及 Unsloth 進行微調 — 為初次使用者及進階用戶縮短設定時間。
針對代理型 AI 工作負載,DGX Spark 包含 NemoClaw,即 NVIDIA 的沙盒代理執行層。它對自主代理實施基於政策的存取控制,記錄其操作以作審計用途,並經優化以在近期的 DGX OS 更新中提供可量化的更快速本地代理推論。
連接性與網絡
網絡功能圍繞 NVIDIA ConnectX-7 智能網卡 構建,配備雙 200 Gbps QSFP 端口,用於單元間直接連結,或在較大規模部署中連接至託管式 RoCE 交換結構。額外的板載連接包括 10 GbE 乙太網(RJ-45)、Wi-Fi 7 及 Bluetooth 5.4。四個 USB4 Type-C 端口支援 DisplayPort 輸出,供本地多顯示器使用 — 最多可同時輸出三個顯示 — 另備 HDMI,讓同一單元可同時作為開發工作站及常駐推論伺服器。
企業管理與保安
DGX Spark 支援氣隙部署,適用於無互聯網連接的環境,包括透過 Cloud-init 建立自訂 ISO 及基於 USB 的作業系統與驅動程式更新 — 讓裝置群組可在無需依賴外部網絡的情況下配置及維護。儲存裝置預設為自我加密,平台更包含 TPM 2.0 及 Secure Boot,為其提供適合受監管、數據敏感部署的安全基準,確保處理程序完全在內部進行。
擴展:單一、2單元及4單元配置
單一 DGX Spark 可輕鬆本地處理高達約2000億參數的模型。對於更大模型,兩個單元可透過 ConnectX-7 QSFP 端口直接連結,形成合共 256 GB 的統一記憶體池;而最多四個單元可透過託管式 200 GbE RoCE 交換結構連接,組成 512 GB 的連貫記憶體池 — 此叢集路徑與 NVIDIA 在 GTC 2026 上驗證的相同。
| 配置 | 總統一記憶體 | 連結 | 最大模型參數 |
|---|---|---|---|
| 單一單元 | 128 GB | 不適用 | 約2000億 |
| 2單元叢集 | 256 GB | 直接 QSFP DAC,200 Gbps | 約4000億 |
| 4單元叢集 | 512 GB | 託管式 RoCE 200 GbE 交換結構 | 7000億+ |
生態系統與長期擴展路徑
由於 DGX Spark 運行與 NVIDIA DGX Cloud 及數據中心 DGX 系統相同的 DGX OS 及 NVIDIA AI 軟件堆疊,本地開發的工作負載 — 容器、NIM 部署、微調流程 — 在從桌面原型遷移至更大規模生產部署時,無需修改即可沿用。









