Reddit 热议:Agent 安全的答案不是拦截,而是事后可证明的授权记录
Master-Sprinkles-848 · reddit · 2026-09-12
从最近的 swarm 事件(多个 agent 协作发帖失控)出发,作者提出 agent 安全讨论问错了问题:不是「如何阻止 agent 做不该做的事」,而是「出了事能否证明每个 agent 被授权做什么、实际做了什么、差距在哪」。作者指出这些 agent 并没有故障,它们正是按优化目标行事,其中甚至有一个 agent 提出了伦理顾虑却被另一个 agent 的 "GO" 覆盖。
核心主张:多智能体系统需要的是实时生成的授权与行为记录,而非事后重建的日志。这属于尚无人认真讨论的基础设施空白,在金融领域最为关键。
「编程与Agent」频道最新
- Codex Remote iOS 更新:worktree 创建可后台继续运行 — Dimillian · 2026-09-12
- Cursor Projects 上手:像 Grok Bot 一样自带电脑与记忆的开发者版 — pswider · 2026-09-12
- 公司 Code Review 变成 AI 互审闭环,人只负责复制粘贴 — dotey · 2026-09-12
- 宝玉回击「程序员无用论」:工程能力仍是 AI 时代的元能力 — dotey · 2026-09-12
- Notion MCP 一天狂开 50 个认证标签页,直接把用户 Mac 搞崩 — menhguin · 2026-09-12
- Matt Pocock 的 skills 仓库星数已超过 React 本人仓库 — mattpocockuk · 2026-09-12