DeepSeek V4 Pro 被指在 Agentic Coding 中易早停

karminski3 · x · 2026-08-13

开发者实测发现,刚发布的 DeepSeek-V4-Pro-0813 在 reasoningeffort=max 模式下存在明显缺陷。

在总计 50 轮的长程 Agentic Coding 任务测试中,模型在 3 次测试里有 2 次均在 42-43 轮左右提前停止,未能用尽机会。其表现甚至不如 GLM-5.1。作者推测该问题可能源于强化学习阶段的奖励机制设计不当,或是上下文窗口的注意力衰减。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →