Qwen3-Next-80B Thinking 过度冗长,工具调用表现不佳

rebellioninmypants · reddit · 2026-08-21

用户反馈 Qwen3-Next-80B-A3B-Thinking 模型在推理时极度冗长,频繁输出“Alternatively”、“Wait”等无用思考词。即便简单查询也会思考数分钟,在 GitHub Copilot 场景下更是产生 2-3 分钟的幻觉与推测。相比之下,此前使用的 Qwen3.5-35B-A3B 体验更流畅。用户提供了详细的 llama-server 启动参数,怀疑是配置问题,并询问社区是否有类似体验。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →