资讯

一台跑不动就上16台!英伟达DGX Spark集群成功跑通Kimi K3:生成速度达38 t/s

驱动之家·2026/9/5 03:13:00🔗 原文

📋总体概括

英伟达开发者论坛用户ciprianveg公布本地算力测试:将16台DGX Spark组网成集群,在Inferact/Kimi-K3-DSpark分布式环境下成功跑通完整Kimi-K3大模型,16000深度下最高生成速度达38 t/s。网络侧采用MikroTik CRS804-4DDQ核心交换机加4根400G转4×100G分支线缆串联全部GB10节点。该测试表明单台桌面设备难以承载千亿参数模型时,可通过堆叠节点的方式实现本地部署,但代价与效率值得掂量。

关键信息

  • 论坛用户ciprianveg用16台英伟达DGX Spark组成集群,成功运行完整Kimi-K3大模型
  • 系统在16000深度下最高生成速度为38 t/s
  • 网络采用MikroTik CRS804-4DDQ交换机,配4根400G转4×100G分支线缆串联GB10节点
  • 运行环境为Inferact/Kimi-K3-DSpark,以分布式方式首次启动该模型
  • 单台DGX Spark算力与显存不足以支撑千亿参数模型,故采用多机并行方案

🔥犀利点评

38 t/s听着热闹,可这是16台设备的合力,平摊下来单机贡献仅2个多token,性价比相当感人。这个案例真正说明的不是DGX Spark多能打,而是桌面级设备的显存天花板有多低——千亿模型逼得玩家用交换机组「穷人超算」。发烧友玩票可以,想当生产力方案,还是省省吧。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文