Boris Cherny 称 Opus 5 抗注入,Claude Code 重写大部分提示词
ycombinator · x · 2026-07-26
YC Startup School 里 Boris Cherny 这段分享的重点,是 Claude Code / Opus 5 的 agent 设计方法:
- 他提到 Opus 5 似乎对 prompt injection 非常“免疫”,Anthropic 结合了对齐训练、注入分类、以及针对注入相关神经元活动的 mechanistic interpretability 工作。
- 每一代模型的 system prompt 都会重新做一遍经验化重建;到了 Opus 5,Claude Code 的 system prompt 大约删掉了 80%。
- 他认为前沿能力很多时候不是被模型本身卡住,而是被产品设计卡住了:模型已经能做,但产品没把它“激发”出来,这就是他所说的 product overhang / hobbling。
- 给 builder 的建议是把模型当成有能力的同事,给更难的任务,少做死板流程,多设 guardrails。
「编程与Agent」频道最新
- 有人让 coding agent 远程操控浏览器,做出营地搜索网页 — yacineMTB · 2026-07-26
- 一位开发者如何改掉对 AI 编码代理的含糊反馈 — rseroter · 2026-07-26
- Karpathy 说,AI 编程的关键是知道何时删掉 worktree 说不 — lemire · 2026-07-26
- 高产工程师分享 AI 编程流:从不读代码,全靠 Agent 写计划执行 — danshipper · 2026-07-26
- 用 Claude Code 做会员软件,他称已赚到 25 万美元 — EXM7777 · 2026-07-26
- 作者称几乎所有模型在 Cursor 里都更好用 — thedealdirector · 2026-07-26