用 20 美元网线就能跑 39.7GB 多节点 GPU 推理

Chuyito · reddit · 2026-07-23

这条 Reddit 分享了一个很实用的结论:多节点 GPU 推理未必需要昂贵网络。作者用一个很便宜的直连以太网方案,在 2x4060 + 1x4060 上跑起了一个 39.7GB 的 laguna Q2KXL 模型。

帖子还给出了不同 ubatch-size 下的实测时延,并总结出几个经验:

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →