DeepSeek V4 Pro 被指在 Agentic Coding 中易早停
karminski3 · x · 2026-08-13
开发者实测发现,刚发布的 DeepSeek-V4-Pro-0813 在 reasoningeffort=max 模式下存在明显缺陷。
在总计 50 轮的长程 Agentic Coding 任务测试中,模型在 3 次测试里有 2 次均在 42-43 轮左右提前停止,未能用尽机会。其表现甚至不如 GLM-5.1。作者推测该问题可能源于强化学习阶段的奖励机制设计不当,或是上下文窗口的注意力衰减。
「编程与Agent」频道最新
- 用亚洲式反馈调教AI:你是B-gent吗? — zebird0 · 2026-08-13
- 深度长文:模型终将吞噬整个工程框架 — pzakin · 2026-08-13
- LangChain创始人演示构建社交媒体AI智能体 — hwchase17 · 2026-08-13
- TinyFish 登陆 ChatGPT:为智能体提供联网搜索与网页抓取能力 — EAccelerate_42 · 2026-08-13
- 企业 AI 智能体缺乏持久记忆?「企业大脑」补齐缺失层 — DavidLinthicum · 2026-08-13
- 4GB显存硬刚本地Agent:开发者分享极低算力实践 — ComplexHuman26 · 2026-08-13