DeepSeek V4-Pro停止控制问题独立于脚手架,1亿token测试证实换提示词无效
karminski3 · x · 2026-08-16
博主karminski3针对DeepSeek-V4-Pro-0813的“停止控制问题”进行了18次独立长程Agentic Coding测试,每次最多50次tool calls,组合3种脚手架、2种停止提示,重复3次,总计花费1亿token。结论:换脚手架或提示词无法解决停止控制问题,该问题与过拟合是独立问题。测试中模型仅3次主动调用finish,4次完成任务后仍继续运行,大量运行未完成验证。
所属事件:DeepSeek V4-Pro实测曝光推理强度与控制问题(2 条相关)→
「编程与Agent」频道最新
- Collaborator:无限画布的 Agent 开发环境 — tom_doerr · 2026-08-16
- 开发者实测 Hermes 双 Agent 架构:桌面端与 VPS 协同工作 — Teknium · 2026-08-16
- 放弃昂贵的 AI 审查,自定义 Linter 成安全协作解 — Elijah_Meeks · 2026-08-16
- 为何编码 Agent 爱写任务字幕?技术方案揭秘 — keunwoochoi · 2026-08-16
- GitHub Copilot 弃用自家模型,引发生态锁定争议 — amu4biz · 2026-08-16
- 抛弃本地环境,全靠 Agent 远程写代码的体验 — Register Spill (Thorsten Ball) · 2026-08-16