Qwen3.8-27B代码审查实测:分析出色但推理浪费一半token

Ok-Shower7286 · reddit · 2026-08-15

Reddit用户Ok-Shower7286对Qwen3.8-27B进行了代码审查任务测试,发现其分析质量不错,能发现缓存失效、NULL处理、死代码和连接泄漏等真实bug,但推理过程浪费严重:在写回修复时,超过一半的推理token用于担心字符串匹配、全角半角字符、空白符等细节,并在直接编辑和脚本替换之间反复纠结。作者认为这是推理模型的通病:对低风险可恢复操作过度思考,应该快速尝试并适应反馈。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →