Laguna S 2.1 被指变笨,低量化引发过度思考

近期用户反馈 Laguna S 2.1 模型出现“变笨”和“过度思考”现象,消耗上下文极快。社区测试发现,这并非模型本身能力缺陷,而是低量化精度惹的祸。有用户在双 3090 上运行 Q2KXL 量化时遇到明显的过度思考问题,而发帖者指出,若使用 Q8 等较高量化配置,不仅能将完整模型载入内存,还能在部分任务中维持正常推理表现。

2026-07-23 ~ 2026-07-24 · 2 条相关