Anthropic 提醒:「反复检查工作」式提示已成反模式,推文作者自查出 125 条冗余指令
Frequent-Ad-836 · reddit · 2026-09-10
Anthropic 发布了一篇关于降低成本、提升性能的平台博客,其中观点颇具冲击力:旧模型时代用来「催促」模型尽力工作的指令,如今反而帮了倒忙。
核心论点
- 旧模型只做你明确交代的事,所以需要「double-check your work」「be maximally thorough」这类鞭策;当前模型本身就会主动多做,叠加这些指令等于让它干两遍活——成本更高,答案更差。
- 博客中的实例:「be maximally thorough」让模型在知识库里做了几十次不必要的检索;「double-check your work」让它重做已完成的工作;自相矛盾的规则(一处允许、另一处禁止)甚至导致四笔本应退掉的退款从未发出。
边界要分清
- 这不是让你删光所有规则。要删的是「鞭策类」话术,而硬约束(如「不要连按两次发布按钮」)应保留。模型努力程度另有专门参数:调太低会在证据不足时抢答,太高则会在简单问题上空转。
作者读完自查自己的规则文件:66 处 "must"、54 处 "never",共 125 条——从未系统区分过哪些是真约束、哪些是可删的鞭策,并怀疑后者占多数。他向社区提问:运行长期配置的 Claude 用户是否审计过自己的指令集?
「编程与Agent」频道最新
- 实测各 LLM 订阅真实代币价值:Grok Heavy 40 倍 ROI 最高 — thesaraharminta · 2026-09-11
- 把 Claude 当新队友配置,交接集成零会议,QA 96 分钟回报 — max_gladysh · 2026-09-11
- Replit 上线 Routines 自动化功能,还支持设置预算 — amasad · 2026-09-11
- 把 Replit Agent 装进机器人:自主建站并一键发布 — amasad · 2026-09-11
- 开源 OmniGet 支持 1800+ 站点下载课程视频并转写整理 — tom_doerr · 2026-09-11
- 独立开发者用 Fable 造群聊应用:AI 自己加班加了两个'惊喜'功能 — RileyRalmuto · 2026-09-11