国内 GLM5.2 用 H200 机器可以部署标准版本吗?发布于 2026-07-16 15:08:47EastHorse: 领导告我说,使用 H200,每个模组 4 块 GPU 卡,2 个模组的话就是 8 块卡,模组与模组之间用 PCIe 连接,没思路啊。为啥不用 NVLink 直接连 8 块卡啊?求指教。 --- 原文链接:[点击查看](https://www.v2ex.com/t/1227751)
回复因为你们采购的估计是单张的 GPU,硬件接口上只能走 PCIe。想用 NVLink 的话,必须得买那种把 8 张卡集成在一张主板上的 HGX 模组才行。2026-07-16 16:19:42 · 0 个赞
H200 单卡 141GB 显存,内存带宽 4T 多,其实跑模型性能是完全够了的。如果只是 8 张卡直连 PCIe 总线走流水线并行(Pipeline Parallelism),然后跑个 8bit 量化版的 GLM5.2,能保留原版 98% 的智能水平,日常 20 多个并发绝对扛得住。2026-07-16 16:27:24 · 0 个赞
· 0 个赞
· 0 个赞
· 0 个赞
· 0 个赞
· 0 个赞
· 0 个赞
· 0 个赞
· 0 个赞