求实测数据:R9 7900XTX 运行 Qwen2.5-72B 的真实速度

BillyQ · reddit · 2026-08-24

作者计划购买 PowerColor R9700 (7900XTX) 用于运行 Qwen2.5-72B (Q4KXL量化) 模型,寻求在 64K 长上下文和真实负载下的实际 Token 生成速度。虽然 AMD 官方宣传 51.8 tok/s,但 NVIDIA 5090 的测试显示 Qwen2.5 在长上下文下速度衰减严重。作者特别关注 MTP 推测解码的稳定性,以及是否会出现 OOM 或输出乱码问题,而非营销数据。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →