Qwen 2.5 72B 本地实测:长上下文吞吐跌一半

julianharris · x · 2026-09-01

在 MacBook Pro M5 Max 上测试 Qwen 2.5 72B (Qwen 3.8) 的 MTPLX 部署表现。测试发现,随着上下文窗口扩大,27B 模型的吞吐量显著下降;而 Flash-next(Qwen 4 preview)的衰减幅度小得多,虽不及云端 Opus 但表现良好。

所属事件:128GB Mac 实测 Qwen 3.8:更强但内存需求高(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →