两台 dgx-spark 部署满血 deepseek v4 flash 完全指南,稳定 60~70tok/s 单流
前天看 x 上有人做成这事,觉得很不错,于是下单买了两台,花了 6 万 8,选了 nvidia 原厂的 dgx spark 带并连线。
实测这两台刚好能拿捏 deepseek v4 flash 0731,vibe coding 单流的性能稳定在 60–70 tok/s,足以覆盖日常使用;这可不是单纯的“能跑起来”的演示水平,而是可以当主力开发机稳定干活。
购买的主要原因是为了本地化隐私部署,毕竟经常会跟 AI 聊很多机密信息,实在不放心。而且,靠硬件出 token 的话,得好几年才能回本。
欢迎交流!
[GitHub 地址](https://github.com/maliubiao/dgx-spark-2-deepseek-flash-0731)
---
原文链接:[点击查看](https://www.v2ex.com/t/1232688)
实测这两台刚好能拿捏 deepseek v4 flash 0731,vibe coding 单流的性能稳定在 60–70 tok/s,足以覆盖日常使用;这可不是单纯的“能跑起来”的演示水平,而是可以当主力开发机稳定干活。
购买的主要原因是为了本地化隐私部署,毕竟经常会跟 AI 聊很多机密信息,实在不放心。而且,靠硬件出 token 的话,得好几年才能回本。
欢迎交流!
[GitHub 地址](https://github.com/maliubiao/dgx-spark-2-deepseek-flash-0731)
---
原文链接:[点击查看](https://www.v2ex.com/t/1232688)
评论
暂无评论。