Boris Cherny 称 Opus 5 抗注入,Claude Code 重写大部分提示词
ycombinator · x · 2026-07-26
YC Startup School 里 Boris Cherny 这段分享的重点,是 Claude Code / Opus 5 的 agent 设计方法:
- 他提到 Opus 5 似乎对 prompt injection 非常“免疫”,Anthropic 结合了对齐训练、注入分类、以及针对注入相关神经元活动的 mechanistic interpretability 工作。
- 每一代模型的 system prompt 都会重新做一遍经验化重建;到了 Opus 5,Claude Code 的 system prompt 大约删掉了 80%。
- 他认为前沿能力很多时候不是被模型本身卡住,而是被产品设计卡住了:模型已经能做,但产品没把它“激发”出来,这就是他所说的 product overhang / hobbling。
- 给 builder 的建议是把模型当成有能力的同事,给更难的任务,少做死板流程,多设 guardrails。
所属事件:Claude Code创始人在YC访谈揭秘Opus 5设计(4 条相关)→
「编程与Agent」频道最新
- Agent 架构法则:验证器可参与生成反馈,但不得直接晋升候选解 — blaizedsouza · 2026-09-23
- Drew Breunig:写 Agent 指令更像立法,而非下棋 — dbreunig · 2026-09-23
- Seroter 日报:GPT-6 与 Opus 5.5 同日发布,1/4 智能体无人监控 — rseroter · 2026-09-23
- 让 Claude 自动开终端面板装依赖,作者称 tmux 做不到 — letandrewcook · 2026-09-23
- 两小时做出幼儿互动绘本:Agent 访谈式工作流走红 — mimi10v3 · 2026-09-23
- 观点:软件正从"被人操作"变为"自己会用软件" — r0ck3t23 · 2026-09-23