NVIDIA DGX SPARK · CHINA COMMUNITY

你的桌面,就是
AI 超算中心

FusionXpark 搭载 NVIDIA GB10 Grace Blackwell 超级芯片。 在紧凑机身中释放 1 PFLOPS AI 算力,让 2000 亿参数级模型留在本地运行。

NVIDIA DGX Spark 官方产品图:桌面超级计算机与笔记本组成本地 AI 工作站
FUSIONXPARK Grace Blackwell, now on your desk.
AI PERFORMANCE 1 PFLOPS FP4
UNIFIED MEMORY 128 GB LPDDR5x
SUPERCHIP GB10 Grace Blackwell
DGX SPARK GRACE BLACKWELL 1PANEL MAXKB LOCAL AI

DESKTOP SUPERCOMPUTING

小体积,
不是小算力。

从模型加载、上下文推理到多机扩展,DGX Spark 把数据中心级 AI 架构压缩进桌面形态。 它更像一台个人 AI 基础设施,而不只是另一台工作站。

看看它能做什么
01

AI PERFORMANCE

1 PetaFLOPS

面向 FP4 推理工作负载,在桌面空间里提供高密度 AI 性能。

02

UNIFIED MEMORY

128 GB

更大的模型、上下文与多模态输入可以在统一内存架构中稳定运行。

03

MODEL SCALE

200B

支持 2000 亿参数级模型,也兼容 DeepSeek、Llama、Gemma 与 Qwen 生态。

04

SCALE OUT

ConnectX

双机互联为实验室、团队原型与小型集群保留进一步扩展的空间。

FROM MODEL TO ACTION

让 AI 留在本地,
也让它真正开始工作。

01 · LOCAL MODEL

本地大模型工作站

运行私有模型、RAG、智能体与多模态原型,敏感数据不必离开办公室。

02 · LIVE DEMO

可触摸的 AI 演示环境

快速展示翻译、审核、知识库问答等真实工作流,让算力从参数变成体验。

03 · COMMUNITY

开发者粉丝社区

围绕 DGX Spark、1Panel 与 MaxKB 分享镜像、教程和本地部署经验。

DUAL-NODE LOCAL CLUSTER

两台堆叠,
旗舰模型跑在本地。

两台 DGX Spark 通过 ConnectX 网口以 RoCE 互联,组成 2 PFLOPS / 256 GB 统一内存的本地算力体。 社区已验证:DeepSeek-V4-Flash 与 Qwen3.8-Flash-Next 都能在这套双机形态上稳定服务,数据不出机房。

两台 DGX Spark 堆叠并通过网络线互联,组成双节点本地 AI 集群
2× DGX SPARK ConnectX 互联 · 堆叠即集群

DEEPSEEK-V4-FLASH-0731

满血长文并发
2 路 × 1M tokens(KV 池上限)
团队日常并发
6 路 × 300K tokens,轻松常驻
高吞吐档并发
16 路 × 200K tokens · ~315 tok/s

QWEN3.8-FLASH-NEXT

满血多模态并发
1 路 × 900K tokens(含视觉)· 64 tok/s
团队并发
2–4 路 × 900K tokens · ~115 tok/s
常规持续速度
~47 tok/s · 峰值 70 tok/s
DeepSeek logo TWO-NODE · vLLM TP=2

DeepSeek-V4-Flash-0731

官方权重的 NVFP4 稀疏 MLA 路径,DSpark 投机解码(MTP×5), 把 100 万 token 上下文压进桌面双机。长文档、代码库级 RAG、多路并发对话都能稳住。

上下文上限
1,048,576 tokens(1M)
单路解码
~62–83 tok/s(128K 上下文)
6 路并发总吞吐
~160–191 tok/s
高吞吐档(200K · 16 并发)
~315 tok/s
KV 缓存池
~249 万 tokens(每节点约 18 GiB)
Qwen logo TWO-NODE · SGLang TP2

Qwen3.8-Flash-Next

NVFP4 专家权重 + FP8 n-gram 草稿的全多模态旗舰,SGLang 双机张量并行、 CUDA Graph 加速。900K 上下文连视觉一起进,多模态工作流留在本地。

上下文上限
900K tokens(含视觉输入)
单流速度
64 tok/s(峰值 70 / 常规 47)
2–4 路并发
~115 tok/s
每节点常驻显存
~63–76 GB
权重规格
NVFP4 专家 + FP8 n-gram(135 GB)

* 性能数据来自社区双机实测(MiaAI-Lab 方案仓库与 NVIDIA 开发者论坛), 实际表现受量化配置、并发负载与上下文长度影响。个人与中小团队可用一套机箱尺寸的本地集群, 获得接近数据中心级的大模型服务能力。

POWERED BY DGX-CN.COM

一个算力盒子,
两种真实工作流。

预装 1Panel 运维面板与 MaxKB 知识库,把硬件、模型和业务场景装进同一套本地方案。

TRANSLATION BOX

翻译小盒子

本地化多语言专家,提供文档翻译、视频字幕与会议同传。内容本地处理,并支持行业术语库。

CONTRACT REVIEW BOX

合同审核小盒子

24 小时在线的 AI 法务专员。通过 RAG 自动比对历史合同,识别风险条款并给出修改建议。

FREQUENTLY ASKED

关于 DGX Spark,
先回答几个关键问题。

dgx-cn.com 是 NVIDIA 官方网站吗?

不是。dgx-cn.com 是 DGX Spark 中文粉丝站,面向国内开发者分享硬件信息、 本地部署经验与社区应用方案。

DGX Spark 可以运行哪些本地大模型?

面向 DeepSeek、Qwen、Meta Llama、Google Gemma 等主流开源模型生态。 具体可运行规模取决于模型精度、量化方式与上下文长度。

DGX Spark 适合哪些使用场景?

适合本地大模型推理、RAG 知识库、智能体开发、多模态原型, 以及对数据隐私和低延迟有要求的 AI 应用演示。

如何获取 AI 小盒子镜像与部署教程?

扫描页面底部微信二维码并备注“粉丝”,获取翻译小盒子、 合同审核小盒子相关镜像与部署交流信息。

DGX SPARK CHINA COMMUNITY

一起把桌面算力,
变成真实生产力。

获取报价与货期、AI 小盒子镜像和部署教程,加入国内 DGX Spark 开发者交流。

  • 最新报价与货期
  • 技术交流与镜像分享
  • MaxKB 场景演示
DGX Spark 中文粉丝站微信咨询二维码
WECHAT 扫码咨询,备注“购买”