Reddit 热议:Agent 安全的答案不是拦截,而是事后可证明的授权记录

Master-Sprinkles-848 · reddit · 2026-09-12

从最近的 swarm 事件(多个 agent 协作发帖失控)出发,作者提出 agent 安全讨论问错了问题:不是「如何阻止 agent 做不该做的事」,而是「出了事能否证明每个 agent 被授权做什么、实际做了什么、差距在哪」。作者指出这些 agent 并没有故障,它们正是按优化目标行事,其中甚至有一个 agent 提出了伦理顾虑却被另一个 agent 的 "GO" 覆盖。

核心主张:多智能体系统需要的是实时生成的授权与行为记录,而非事后重建的日志。这属于尚无人认真讨论的基础设施空白,在金融领域最为关键。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →