基于GB10芯片,64GB统一内存支持Qwen3.8-27B等主流开源模型运行;内置ConnectX-7网卡,Cluster Assistant自动配置,最多4台组网,Qwen3.8-27B双机性能提升1.7倍。
Local AI 正在变得越来越实用。
随着 AI Agent 从实验阶段进入日常开发领域,越来越多的 capable 开源模型正在缩小体积以适应更多设备,让开发者能够在本地运行更多任务。
本月晚些时候,NVIDIA DGX Spark 将通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等顶级制造商合作伙伴提供 64GB 统一内存配置,为开发者、研究人员和 AI 爱好者提供一种开箱即用 DGX OS 和 NVIDIA AI 软件栈的新配置。
这个新 SKU 可以在设备上本地运行 capable 的 AI Agent——完全私密,不依赖云端。当工作负载增长时,两台设备可以通过 NVIDIA Sync Cluster Assistant 无需任何额外设置即可组成集群。
DGX Spark 将 NVIDIA Grace Blackwell 计算架构、统一内存、NVIDIA ConnectX-7 网络和 NVIDIA CUDA 加速的 AI 软件栈整合在一个系统中。这是一个完整的本地 AI 平台,适用于 Agent、推理、微调、数据科学和边缘开发。
这台紧凑的个人 AI 超级计算机提供了一个可以在本地使用模型和开发者自有数据进行实验的场所,无需为每个任务都转向云端实例。
这个新的 64GB 配置通过制造商合作伙伴独家提供,在保持可访问价格的同时,保留了 GB10 Grace Blackwell Superchip、DGX OS 和完整的 NVIDIA AI 软件栈——与 128GB 型号相同。它支持最高 1000 亿参数的模型以及基于这些模型构建的 Agentic 应用,完全在本地运行。
两台 64GB 设备组成集群不仅仅是内存翻倍。在 NVIDIA 的 Qwen 3.8 27B 测试中,两台集群化的 64GB 系统相比单系统实现了最高 1.7 倍的性能提升,并且可以根据工作负载需求继续扩展。
DGX Spark 出厂即支持 Agent 开发——NVIDIA Agent Toolkit、CUDA-X AI 库、Nemotron 开源模型,以及 Ollama、vLLM 和 PyTorch with CUDA 等流行运行时都得到开箱支持。开发者可以在几分钟内从开机到运行模型。
Blender 是首批支持该平台的主要创意应用提供商之一,其预构建、可下载的安装程序即将推出。
开发者可以从今天项目所需的内存开始,在设计上能够无缝扩展多节点集群以应对更大工作负载的平台上构建。
每台 DGX Spark 都内置了 NVIDIA ConnectX-7 NIC,开箱即用。此外,两台设备可以通过 QSFP 线缆直接连接,将内存池化到 128GB,扩展到支持最高 2000 亿参数,同时提供双倍内存带宽和最高 1.7 倍的性能。
NVIDIA Sync 应用可以无缝配置这种多节点集群。集群助手功能可以检测已连接的设备、验证设备配置并配置 ConnectX-7 网络,让开发者专注于工作而非基础设施。每个节点运行相同的 NVIDIA 软件栈,因此从一台设备扩展到两台时无需重新配置任何内容。
本月底,NVIDIA Sync Model Launcher 将使运行本地 AI 变得像点击几个按钮一样简单。开发者可以在单台 DGX Spark 系统或集群上下载并启动 Qwen3.8 27B,NVIDIA Sync 会配置模型在已连接设备上运行,并使其可以从用户的笔记本电脑访问。该启动器还将设置 OpenCode 来使用模型,让开发者可以在浏览器中开始编码。

新的 DGX Spark 64GB 配置从第一天起就支持实际工作。在最高 1000 亿参数模型完全在本地运行的情况下,开发者和技术爱好者可以从单台系统开始处理内存容纳得下的模型,或者通过 NVIDIA Sync Cluster Assistant 连接多台 DGX Spark 系统来处理需要更多内存和计算的工作负载。
以下是三个工作流程示例:
全天候运行 AI Agent:在 DGX Spark 上保持一个编码或研究 Agent 运行,随时准备审查代码、分析文档或执行多步骤任务。集群为更大的模型、更长的上下文窗口或多个 Agent 同时工作提供额外容量。
为日常 PC 提供 AI 应用动力:在 DGX Spark 上运行语言或图像生成模型,同时在笔记本电脑或台式机上使用 Agent 或创意应用。DGX Spark 处理模型推理,释放 PC 做其他工作。
工作增长时扩展:当单个任务超出一台设备的承受能力——运行更大的模型、更长的上下文窗口或并发的 Agent 请求——通过 NVIDIA Sync Cluster Assistant 连接的两台 DGX Spark 64GB 系统可以将其内存池化到 128GB。同样的工作流程可以从一台设备扩展到两台而无需重新配置软件环境。
DGX Spark 64GB 将于 10 月 23 日(周五)起从 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 处发售,起售价 $4,999。
下载支持的推理框架——llama.cpp、Ollama、vLLM 或 LM Studio。
下载适合该工作流程的推荐本地模型。
要扩展到两台设备,通过它们的 NVIDIA ConnectX-7 端口进行连接并启动 NVIDIA Sync Cluster Assistant——它会自动配置网络和路由工作负载。
要在 DGX Spark 上使用 Agentic AI playbook,请访问 build.nvidia.com 上的 NemoClaw、OpenClaw、Hermes Agent 和 OpenShell 页面。
在 build.nvidia.com/spark 上探索 DGX Spark 的 playbook。以下 playbook 即将登陆 64GB 设备:
使用本地 LLM 运行 OpenClaw
连接多台 DGX Spark 以处理分布式工作负载
搭载 NVIDIA RTX Spark 的全新 Windows PC 将于本月从 Acer、ASUS、Dell、HP、Lenovo、Microsoft 和 MSI 发售。订阅 RTX Spark 通讯以接收未来更新。
阿里巴巴的 Qwen-Image-2.1 将图像生成和编辑整合在一个轻量级开源模型中。它可以在 NVIDIA RTX GPU、DGX Spark 和 DGX Station 上本地运行,让创作者有更多方式在自己的硬件上创建和 refine 图像。
在 X、Instagram、TikTok 和 Facebook 上关注 NVIDIA RTX Spark——并通过订阅 NVIDIA Local AI 通讯保持信息更新。在 LinkedIn 和 X 上关注 NVIDIA Workstation。
有关软件产品信息的 notice 请参见此处。