NVIDIA DGX Spark
用于区分购物车中的不同配置——当您订购相同产品但不同选项时非常实用。
完整规格
计算与内存
芯片
NVIDIA GB10 Grace Blackwell 超级芯片
CPU
20核Arm (10 × Cortex-X925 + 10 × Cortex-A725)
统一内存
128 GB LPDDR5x(273 GB/s 带宽)
AI 性能
1 PetaFLOP (FP4)
存储与物理规格
存储
4 TB NVMe SSD,自加密 (PCIe Gen4)
尺寸
150 × 150 × 50.5 毫米
重量
1.2 千克
显示输出接口
最多支持3个同步显示器 (HDMI + USB4 DisplayPort替代模式)
电源与网络
电源
240 W USB-C PD适配器
网络
NVIDIA ConnectX-7 智能网卡,双200 Gbps QSFP + 10 GbE RJ-45
无线
Wi-Fi 7,蓝牙5.4
软件与安全
操作系统
NVIDIA DGX OS (Ubuntu 24.04 LTS),预装完整CUDA AI堆栈
智能体AI
包含NemoClaw沙盒代理框架
安全
TPM 2.0、安全启动、自加密SSD
NVIDIA DGX Spark 是 NVIDIA GB10 Grace Blackwell 超级芯片的官方参考桌面系统,最初于2025年1月以开发代号Project DIGITS公开亮相,后以最终命名上市。作为 NVIDIA 自主设计、验证并持续直接更新的平台,它将1 petaFLOP 的 FP4 AI 性能和128 GB 统一式一致性内存封装在仅1.2千克的机身中,小巧到可置于键盘旁的桌面上。
由于 DGX Spark 是 NVIDIA 自有参考设计,它也成为新 GB10 生态功能的首发验证平台。在2026年3月下旬NVIDIA GTC 2026 大会后,4节点RoCE集群支持——将单次部署内存提升至512 GB共享统一内存——率先在 DGX Spark 上获得官方确认,随后才推广至合作伙伴硬件,同时GB10系列已有的2单元直连功能仍为标准配置。
硬件规格
其核心是NVIDIA GB10 Grace Blackwell 超级芯片,集成了20核Arm处理器(10×Cortex-X925性能核 + 10×Cortex-A725能效核)与Blackwell架构GPU,配备第五代Tensor Core及原生FP4稀疏支持。二者通过128 GB LPDDR5x统一内存桥接,提供273 GB/s CPU/GPU共享一致性带宽,消除了传统独立CPU/GPU内存池的复制开销。存储采用4 TB自加密PCIe Gen4 NVMe SSD,容量足以本地存储大型模型检查点与数据集。
软件:预装完整NVIDIA AI技术栈
DGX Spark 预装NVIDIA DGX OS(Ubuntu 24.04 LTS)及经硬件验证的完整NVIDIA AI软件栈——CUDA、cuDNN、TensorRT和NVIDIA容器运行时在首次启动即可使用。NVIDIA NIM微服务可将支持的模型部署为经优化的推理容器而无需手动调优,且当工作负载迁移至NVIDIA DGX Cloud或数据中心DGX系统时,这些容器可原封不动转移。持续维护的官方操作手册涵盖常见工作流——从vLLM与TensorRT-LLM模型服务到NeMo及Unsloth微调——为新手和高级用户均显著缩短配置时间。
针对智能体AI工作负载,DGX Spark 内置NemoClaw——NVIDIA的沙盒化智能体执行层。它实施基于策略的自主智能体访问控制,记录操作日志以供审计,并在近期DGX OS更新中优化以实现可量化的本地智能体推理加速。
连接与网络
网络核心为配备双200 Gbps QSFP端口的NVIDIA ConnectX-7智能网卡,用于单元间直连或大型部署中连接托管式RoCE交换架构。板载扩展连接包括10 GbE以太网(RJ-45)、Wi-Fi 7和蓝牙5.4。四个USB4 Type-C端口支持DisplayPort输出实现本地多显示器应用——最多三屏同步输出——并辅以HDMI接口,使单台设备可同时作为开发工作站和常驻推理服务器。
企业管理与安全
DGX Spark 支持无互联网环境的气隙隔离部署,包括通过Cloud-init创建定制ISO以及基于USB的操作系统与驱动更新——使设备群可在无外部网络依赖下完成配置维护。存储默认启用自加密功能,平台集成TPM 2.0和安全启动,为需完全本地化处理的受监管数据敏感型部署提供合规安全基线。
扩展能力:单机、双机与四机配置
单台DGX Spark可轻松本地支持约2000亿参数模型。对于更大模型,两台设备通过ConnectX-7 QSFP端口直连形成256 GB统一内存池,而四台设备可通过托管式200 GbERoCE交换架构组成512 GB一致性内存池——此集群方案与NVIDIA在GTC 2026验证的技术路径一致。
| 配置方案 | 总统一内存 | 互联方式 | 最大模型参数 |
|---|---|---|---|
| 单机配置 | 128 GB | 不适用 | 约2000亿 |
| 双机集群 | 256 GB | QSFP DAC直连,200 Gbps | 约4000亿 |
| 四机集群 | 512 GB | 托管式RoCE 200 GbE交换架构 | 7000亿+ |
生态与长期扩展路径
由于 DGX Spark 运行与NVIDIA DGX Cloud及数据中心DGX系统相同的DGX OS和NVIDIA AI软件栈,本地开发的工作负载——容器、NIM部署、微调流水线——在从桌面原型迁移至大规模生产部署时可无需修改直接转移。









