NVIDIA DGX Spark 64GB发布:支持本地运行千亿参数模型及双机集群扩展
2026/10/02 21:00阅读量 3
NVIDIA推出DGX Spark 64GB配置,搭载GB10 Grace Blackwell超级芯片,旨在为开发者提供无需云依赖的本地AI开发平台。该设备预装完整软件栈,单台即可支持高达1000亿参数的模型运行,并通过NVIDIA Sync Cluster Assistant实现双机无缝集群,性能提升达1.7倍。新配置将于10月23日起由多家主流厂商以4999美元起售价发售。
事件概述
NVIDIA正式宣布推出DGX Spark 64GB统一内存配置版本。该设备整合了NVIDIA Grace Blackwell计算架构、统一内存、ConnectX-7网络接口以及CUDA加速的AI软件栈,定位为个人AI超级计算机。新配置保留了与128GB型号相同的GB10 Grace Blackwell Superchip核心及完整的NVIDIA AI软件栈(包括DGX OS),但将价格门槛降低,旨在让开发者、研究人员和AI爱好者能够以更低的成本在本地设备上运行具备能力的AI代理(AI Agents)和推理任务。
核心信息与技术特性
-
硬件规格与性能:
- 单台DGX Spark 64GB支持在设备端完全运行高达1000亿参数(100B)的模型。
- 通过NVIDIA Sync Cluster Assistant,两台64GB单元可直接通过QSFP线缆连接组成集群,总内存池化至128GB。
- 在Qwen 3.8 27B模型的测试中,双机集群相比单机系统可提供最高1.7倍的性能提升,同时内存带宽翻倍,并支持高达2000亿参数的模型。
- 设备内置NVIDIA ConnectX-7网卡,无需额外设置即可实现多节点集群的网络配置和设备验证。
-
软件生态与开箱即用体验:
- 出厂预装NVIDIA Agent Toolkit、CUDA-X AI库、Nemotron开源模型以及Ollama、vLLM、PyTorch with CUDA等流行运行时环境。
- 开发者可实现从开机到运行模型的分钟级部署。
- NVIDIA Sync Model Launcher即将上线,允许用户通过点击按钮在单台或集群设备上下载并启动如Qwen3.8 27B等模型,并可自动配置OpenCode以便在浏览器中进行编码。
- Blender等主要创作者应用提供商已确认支持该平台,并将提供预构建的安装程序。
-
典型应用场景:
- 全天候AI代理运行:用于代码审查、文档分析或多步骤任务的自动化代理,集群模式可支持更大上下文窗口或多个代理并发工作。
- PC辅助AI应用:DGX Spark处理模型推理,释放日常PC的资源用于其他创作或办公任务。
- 弹性扩展工作流:当单一任务超出单机处理能力时,可通过NVIDIA Sync Cluster Assistant无缝扩展至双机,无需重新配置软件环境。
发售信息与获取方式
- 上市时间:2026年10月23日(星期五)。
- 销售渠道:Acer、ASUS、Dell、Gigabyte、HP和MSI。
- 起始价格:4,999美元。
- 入门指南:用户需下载支持的推理框架(如llama.cpp、Ollama、vLLM或LM Studio)及推荐模型。若需扩展至双机,需通过ConnectX-7端口连接并启动NVIDIA Sync Cluster Assistant。
- 相关资源:build.nvidia.com网站提供了针对DGX Spark的Agentic AI玩法指南(如NemoClaw、OpenClaw等)。
