Qwen 3.8 幻觉上下文即将耗尽,256K 仅用 25% 就拒绝干活

TastesLikeOwlbear · reddit · 2026-10-05

一位用户在本地部署 Qwen 3.8 Flash Next(FP8,VLLM)配合 Pi harness 时发现模型持续幻觉自己的上下文将耗尽:明明 256K 上下文只用了约 25%,模型却频繁拒绝继续或中途停止。追问其依据时,模型承认自己「编造了这个数字并当成真实数据」,承诺改正但反复出现。作者在求教可能的原因。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →