Qwen 3.8 幻觉上下文即将耗尽,256K 仅用 25% 就拒绝干活
TastesLikeOwlbear · reddit · 2026-10-05
一位用户在本地部署 Qwen 3.8 Flash Next(FP8,VLLM)配合 Pi harness 时发现模型持续幻觉自己的上下文将耗尽:明明 256K 上下文只用了约 25%,模型却频繁拒绝继续或中途停止。追问其依据时,模型承认自己「编造了这个数字并当成真实数据」,承诺改正但反复出现。作者在求教可能的原因。
「模型」频道最新
- ChatGPT 用量限额重置竟绑美国东部时间,其他时区用户额度提前耗尽 — NickPassig · 2026-10-05
- 70 小时实测 Opus 5.5:effort 中档、上下文 40 万内效果最佳 — EXM7777 · 2026-10-05
- ChatGPT Dot 当全能助手碰壁:清理邮箱 quickly 触发用量上限 — Desperate_Source_712 · 2026-10-05
- 模型加努力档位组合超 24 种,Reddit 用户吐槽选择过于复杂 — abrahamw888 · 2026-10-05
- 研究员质疑:Claude 明知在评测中,却很少说出口 — a_karvonen · 2026-10-05
- RLHF 联合发明人推出机器专用模型 Jev,70-500ms 返回决策 — DavidLinthicum · 2026-10-05