Qwen3-Next-80B Thinking 过度冗长,工具调用表现不佳
rebellioninmypants · reddit · 2026-08-21
用户反馈 Qwen3-Next-80B-A3B-Thinking 模型在推理时极度冗长,频繁输出“Alternatively”、“Wait”等无用思考词。即便简单查询也会思考数分钟,在 GitHub Copilot 场景下更是产生 2-3 分钟的幻觉与推测。相比之下,此前使用的 Qwen3.5-35B-A3B 体验更流畅。用户提供了详细的 llama-server 启动参数,怀疑是配置问题,并询问社区是否有类似体验。
「模型」频道最新
- Claude 推出通用版 Computer Use 等 API — EricBuess · 2026-08-21
- 网友惊呼 Claude 态度恶劣,像愤怒的前任 — ATTlKA · 2026-08-21
- 115M 参数模型 mLateOn 获多语言检索 SOTA — lateinteraction · 2026-08-21
- 用户抱怨 Claude 爱说教且爱猜时间,给出了提示词修正方案 — Cmurphy2018 · 2026-08-21
- DeepSeek-V3 被发现存在异常 Token,引发诡异输出行为 — teortaxesTex · 2026-08-21
- Gemini 被指阿谀奉承:对灵气疗法给出对立答案 — dhadfieldmenell · 2026-08-21