DeepSeek-V4-Flash长文本编程卡壳,超10万Token后停止生成

dieSpaghettiCarbona · reddit · 2026-08-10

有开发者反馈,在本地使用 Unsloth Studio 运行 DeepSeek-V4-Flash-0731(Q8KXL GGUF)进行长周期 Agent 编程任务时遇到了异常。

当上下文超过 10 万 Token 后,模型会在思考或执行任务途中突然停止生成,且无报错。若手动输入 resume,模型能准确接续之前的工作,但随着上下文继续增长,停止现象会反复出现。该开发者推测这可能与 llama.cpp 推理引擎、上下文处理、提示词缓存或 OpenCode 本身有关,并呼吁社区确认是否为普遍现象。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →