Human-in-the-loop 不等于人类权威:批准会沦为肌肉记忆

arthaudm · reddit · 2026-09-13

作者指出「要求人类批准」听起来安全,但当每个动作都需要点击时,人们会停止阅读,批准沦为肌肉记忆——人类名义上在环内,实际上缺席。

他主张更好的模型是「范围授权」(scoped authority),每份授权应明确:

例行动作在边界内自动运行,越界即停。工具层面强制执行授权,而不是指望 prompt 记住策略。作者认为真正有趣的设计问题不是「人类是否触碰每个动作」,而是「Agent 能否证明这个动作是哪个人类授权的」。

他最后提问:常设授权与强制审查的边界应该画在哪里?

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →