两台 dgx-spark 部署满血 deepseek v4 flash 完全指南,稳定 60~70tok/s 单流

发布于

前天看 x 上有人做成这事,觉得很不错,于是下单买了两台,花了 6 万 8,选了 nvidia 原厂的 dgx spark 带并连线。

实测这两台刚好能拿捏 deepseek v4 flash 0731,vibe coding 单流的性能稳定在 60–70 tok/s,足以覆盖日常使用;这可不是单纯的“能跑起来”的演示水平,而是可以当主力开发机稳定干活。

购买的主要原因是为了本地化隐私部署,毕竟经常会跟 AI 聊很多机密信息,实在不放心。而且,靠硬件出 token 的话,得好几年才能回本。

欢迎交流!

[GitHub 地址](https://github.com/maliubiao/dgx-spark-2-deepseek-flash-0731)

---

原文链接:[点击查看](https://www.v2ex.com/t/1232688)

评论

暂无评论。

0.035667s