哈佛-MIT 论文:让 agent「提前规划」的提示词反而让决策更差
dair_ai · x · 2026-10-06
一项哈佛-MIT 研究检验了给 agent 添加「提前规划」「考虑对手」类提示词是否真有用,结论出人意料:
- 在拍卖与匹配市场实验中(这些场景存在已知最优策略,可对每次选择精确打分),这类规划提示词整体让 agent 表现更差
- 改变界面比改提示词有效:采用升价拍卖(每次只呈现一个安全选项)在四个模型家族上都显著降低出价错误; plainly 描述收益结构、解释为什么真实出价是安全的也有帮助
- agent 嘴上说的计划与其最终选择并不一致:改善出价的干预并未提升计划文本的推理质量,有些提示词改善了计划却不改善出价
作者的核心结论:评估 scaffold 应看它产出的决策,而不是它生成的推理文本。
「编程与Agent」频道最新
- Gemini CLI 遥测新增自定义 OTLP Headers,支持鉴权上报到 Grafana 等平台 — jesussamuel-byte · 2026-10-06
- Opus 5.5+Hermes 竞品定位分析工作流:四步产出可测的定位角度 — VibeMarketer_ · 2026-10-06
- Stripe 前高管征集:SaaS 平台如何嵌入 Agent 代购支付流 — jeff_weinstein · 2026-10-06
- DevRel 正在变味:越来越多团队并入产品或转向 PM/DevEx — gethackteam · 2026-10-06
- 4 名人类加 4 个 AI Agent 共用 Microsoft Planner 看板协调整个创业公司 — DJAI9LAB · 2026-10-06
- HyperFrames 发布面向 Agent 的视频编辑器,描述即可生成时间线 — toolstelegraph · 2026-10-06