同任务 27B 花 10 分钟,Qwen Flash Next 跑 2.5 小时引困惑

poofph · reddit · 2026-09-28

一位本地部署新手在双 RTX 5090 上对比两个 Qwen 模型完成同一修 bug 任务的耗时:Qwen3.8 27B 约 5-10 分钟完成,而 Flash Next 花了 2.5 小时。硬件吞吐上 27B 反而更快(infill 2000-3000、输出 100-150 tok/s vs Flash Next 1600-2300、60-100 tok/s)。

更奇怪的是,他观察到 Flash Next 实际在约 0.5 小时后就已写入代码修改,之后约 2 小时都在“跑测试或不知道在干嘛”,不再改动代码。作者非程序员,代码均由 AI 生成,他询问原因及能拉平耗时的设置。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →