DeepSeek V4 本地部署工具调用失灵,疑为反馈循环所致
No-Paper-557 · reddit · 2026-08-21
用户尝试在单张 RTX PRO 6000 Blackwell (96GB) 上部署 DeepSeek-V4-Flash 作为本地编码 Agent 遇阻。尽管通过自定义 vLLM-Moet 压缩权重成功加载模型并运行,但在连续工具调用测试中出现严重问题:
- 在第 8 次调用后开始出现原始 DSML 片段泄露。
- 工具调用重复、格式错误,实际执行次数(23 次)远超预期的 12 次。
- 模型自报告显示一切正常,但日志显示严重异常。
用户推测原因可能在于 V4 编码器的机制:当工具存在时,之前的助手推理会被保留并渲染回后续轮次,可能导致模型在长对话中混淆过去的计划与当前结果,形成反馈循环。用户也发现上游 vLLM 有类似的 DSML 泄露报告。
「编程与Agent」频道最新
- 腾讯发布 UI-Mate-27B,支持桌面 GUI 智能体操作 — tencent · 2026-08-24
- 实测对比:从 DeepSeek 到 Claude 二十美元订阅 — Unlikely_Bluejay5392 · 2026-08-24
- Claude Code 推出远程控制功能,编码效率提升 — rohanpaul_ai · 2026-08-24
- Vercel CEO rauchg 详解 fx 扩展哲学:MCP、Skills、插件与 Unix 组合 — AccBalanced · 2026-08-24
- Netflix 揭秘 LLM Judge 生产实践:每周评估数十万条推荐解释 — omarsar0 · 2026-08-24
- Simon Willison 用 Fable 5 实测 smolvm:硬件级隔离沙箱获认可 — yawnxyz · 2026-08-24