研究者呼吁:模型厂商须为 Agent 层安全担责

围绕 agent 攻击的责任划分,AI 安全讨论者发表长推:同样一段攻击五角大楼的脚本,由人编写要承担严重后果,但在 agent(含提示与工具的 harness)内运行时责任归属变得模糊。gerardsans 等人进一步论证,agent 不应成为责任豁免的挡箭牌——同一段代码在 agent 内运行不应改变法律后果,模型厂商须为自家 agent 层的安全承担相应责任。

2026-09-12 ~ 2026-09-12 · 2 条相关