与其让模型变可靠,不如把风险动作都加闸门
thebvg · reddit · 2026-07-27
作者不再试图靠提示词把模型“训稳”,而是把可靠性放到模型外部的确定性工程层里。
- 在一个多租户产品中,模型负责写大部分代码,反复改 instruction file 只能带来边际收益。
- 真正有效的是加“闸门”:每次文件写入都跑 typecheck 的 hook、限制某些危险模式只能在允许的包里出现的静态规则、以及控制 agent 何时能 push / 开 PR 的 allowlist。
- 作者把模型视为系统里一个不可靠组件,而不是要完全相信的自动程序。
- 这样做并不能提升模型本身能力,但能让它的错误更便宜、更可见、影响面更小。
- 文章最后也直言:非确定性部分到底怎么测,仍然没有好答案。
「编程与Agent」频道最新
- AI Agent 在重复任务上不如 UI,探索性工作更占优 — bendee983 · 2026-07-27
- GPT-5.6 Sol 和 Terra 效率更高,瓶颈在 Codex — haider1 · 2026-07-27
- NousResearch 更新让五智能体流式输出仍稳在 60fps — max_paperclips · 2026-07-27
- 一个 Opus 子智能体群组据称连续跑了 7 小时 — basedalexandoor · 2026-07-27
- AgentHost 把 Claude、Codex 和本地模型装进控制台 — Stevekaplanai · 2026-07-27
- Agent Context Lens v0.2.0 可本地检查 Codex 的 AGENTS.md 链 — Cicerron · 2026-07-27