我的购物车
资讯分类
全部资讯
最新活动
商城公告
行业信息
新品推荐
元器件知识
资讯标签
iCEasy商城(183) 艾为awinic(161) 艾迈斯欧司朗(151) 英伟达NVIDIA(94) 萤火工场(62) 飞腾派V3(33) 兆易创新(32) 罗彻斯特电子(28) 赛昉科技(StarFive)(27) 灵动微电子(16) 小华半导体(15) 芯佰微(14) 开源社区活动(14) 领麦微LEAMEMS(13) 日清纺微电子(13) Seeed矽递科技(11) 极海半导体(8) 上海雷卯Leiditech(8) 微源半导体 LPSemi(8) 物奇WuQi(7) 航顺芯片(6) 高通Qualcomm(5) 机器人(4) 沃虎VOOHU(3) 峰岹科技(3) BeagleBoard(3) 沃虎WOHU(3) 开源社区(2) 英迪芯微(2) 中科本原(2) 芯查查(2) 小华半导体HXSC(1) 阿加犀(1) 博瑞集信(1) 中电港(1) 硅光电二极管BPW 34 S-Z(1) 蓝光激光二极管PLPT9 450MD_E(1) 绿色激光二极管PLT5 520HB_P(1) 红外传感发射器件SFH 4713B(1)

个人工作站就能跑!DeepSeek V4 Flash单路82token/s,GB10超级芯片+1 PFLOP算力,DGX Spark部署超轻松

发布时间:2026-08-17


两台放在桌上的黑盒子,直接走完了大模型本地部署的“最后一公里”!

DeepSeek V4 Flash 0731正式版开源权重刚释出,社区实测数据就已刷屏:两台NVIDIA DGX Spark个人AI超级计算机,单路生成速度达82.4 tok/s,峰值逼近95tok/s,三路并发合计135tok/s——2840亿参数的大模型,就这样在桌面级设备上跑了起来。

▲ Mia的推文:单路82、峰值约95、三并发135 tok/s


这不是实验室里的理论峰值,是完成2048 token输出后的真实跑分。依托MoE架构与FP8混合精度权重,配合张量并行+投机解码的优化方案,两台DGX Spark组成的256GB统一内存池,不仅能装下整套模型权重,还能支撑100万token上下文窗口、最高6路并发会话,相当于把个人AI超级计算机直接搬上了办公桌。

▲ Mia的推文:完整基准表


而这一切的核心,正是搭载GB10 Grace Blackwell超级芯片的NVIDIA DGX Spark——这款定义为“个人AI超级计算机”的桌面设备,正在为无数开发者、研究者解锁本地大模型开发的新可能。iCEasy商城热卖AI套件【DGX Spark】,现货热销中,现在下单,让你的创新快人一步!




核心引擎:GB10超级芯片


该款个人AI超级计算机由NVIDIA GB10 Grace Blackwell超级芯片驱动,借助 NVIDIA AI软件栈和128GB内存,开发者可以使用主流AI模型进行原型制作、微调和推理,这些模型在本地具有多达2000亿个参数,并无缝部署到数据中心或云端。


  • 算力天花板:搭载性能强劲的NVIDIA Blackwell GPU,支持第五代Tensor Core与FP4精度,每秒计算达1 PFLOP,轻松应对前沿主流AI推理模型的微调和推理;
  • 协同无瓶颈:采用NVIDIA NVLink™-C2C互连技术,构建CPU+GPU一致性内存模型。


全栈生态:从开发到部署


NVIDIA 全栈AI平台为DGX Spark保驾护航:


  • 支持DGX操作系统和 NVIDIA AI软件开发工具包,适用于各种行业和AI工作负载;
  • NVIDIA RAPIDS加速库实现数据科学任务零代码优化,开发效率显著提升;
  • 兼容多种基础模型,以及第三方主流模型,从台式机到DGX Cloud或加速云/数据中心,模型迁移几乎无需改代码,原型设计、微调与迭代更轻松。

无论是单台设备一键部署实现多Agent服务,还是双机并联追求极致推理速度,DGX Spark都能满足不同场景的本地大模型需求——数据不出本地,算力随时可用,真正实现“Token 自由”!


立即登录了解详情:https://s.iceasy.com/JOJgxz,用DGX Spark的顶尖算力,让创新成本更低,效率更高——同比价格优势热销,别错过这场AI算力特惠!