两台放在桌上的黑盒子,直接走完了大模型本地部署的“最后一公里”!
DeepSeek V4 Flash 0731正式版开源权重刚释出,社区实测数据就已刷屏:两台NVIDIA DGX Spark个人AI超级计算机,单路生成速度达82.4 tok/s,峰值逼近95tok/s,三路并发合计135tok/s——2840亿参数的大模型,就这样在桌面级设备上跑了起来。

▲ Mia的推文:单路82、峰值约95、三并发135 tok/s
这不是实验室里的理论峰值,是完成2048 token输出后的真实跑分。依托MoE架构与FP8混合精度权重,配合张量并行+投机解码的优化方案,两台DGX Spark组成的256GB统一内存池,不仅能装下整套模型权重,还能支撑100万token上下文窗口、最高6路并发会话,相当于把个人AI超级计算机直接搬上了办公桌。

▲ Mia的推文:完整基准表
而这一切的核心,正是搭载GB10 Grace Blackwell超级芯片的NVIDIA DGX Spark——这款定义为“个人AI超级计算机”的桌面设备,正在为无数开发者、研究者解锁本地大模型开发的新可能。iCEasy商城热卖AI套件【DGX Spark】,现货热销中,现在下单,让你的创新快人一步!

核心引擎:GB10超级芯片
该款个人AI超级计算机由NVIDIA GB10 Grace Blackwell超级芯片驱动,借助 NVIDIA AI软件栈和128GB内存,开发者可以使用主流AI模型进行原型制作、微调和推理,这些模型在本地具有多达2000亿个参数,并无缝部署到数据中心或云端。
- 算力天花板:搭载性能强劲的NVIDIA Blackwell GPU,支持第五代Tensor Core与FP4精度,每秒计算达1 PFLOP,轻松应对前沿主流AI推理模型的微调和推理;
- 协同无瓶颈:采用NVIDIA NVLink™-C2C互连技术,构建CPU+GPU一致性内存模型。

全栈生态:从开发到部署
NVIDIA 全栈AI平台为DGX Spark保驾护航:
- 支持DGX操作系统和 NVIDIA AI软件开发工具包,适用于各种行业和AI工作负载;
- NVIDIA RAPIDS加速库实现数据科学任务零代码优化,开发效率显著提升;
- 兼容多种基础模型,以及第三方主流模型,从台式机到DGX Cloud或加速云/数据中心,模型迁移几乎无需改代码,原型设计、微调与迭代更轻松。

无论是单台设备一键部署实现多Agent服务,还是双机并联追求极致推理速度,DGX Spark都能满足不同场景的本地大模型需求——数据不出本地,算力随时可用,真正实现“Token 自由”!
立即登录了解详情:https://s.iceasy.com/JOJgxz,用DGX Spark的顶尖算力,让创新成本更低,效率更高——同比价格优势热销,别错过这场AI算力特惠!


