Qwen3.8-27B 推理风格疑似未完全优化

BitterProfessional7p · reddit · 2026-08-25

用户发现 Qwen3.8-27B 模型的思考过程有时呈现“原始人语言”风格(无动词变位、无冠词、短语),有时则正常。推测这可能是因为微调或 RLHF 不完全,或者是类似于泄露的 GPT-5.5/5.6 那样,通过简化推理语言来提高 token 效率。该模型在这一点上似乎仍有改进空间。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →