低量化 Laguna 会反复想太多,消耗上下文很快

IUseClifford · reddit · 2026-07-23

一位用户在双 3090 上以 Q2KXL 量化运行 Laguna,并配合 20 万上下文 的 Q8 配置做测试后发现,这个模型有明显的 “过度思考” 倾向。

具体表现是,它在开始写代码前会不断补充“再检查一个相关项”,语义上看起来合理,但会很快消耗上下文。作者把它和 Qwen3.6 27B Q8 做了对比,认为后者更像“循环”,而 Laguna 则更像“想太多”。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →