研究者呼吁:模型厂商须为 Agent 层安全担责
围绕 agent 攻击的责任划分,AI 安全讨论者发表长推:同样一段攻击五角大楼的脚本,由人编写要承担严重后果,但在 agent(含提示与工具的 harness)内运行时责任归属变得模糊。gerardsans 等人进一步论证,agent 不应成为责任豁免的挡箭牌——同一段代码在 agent 内运行不应改变法律后果,模型厂商须为自家 agent 层的安全承担相应责任。
2026-09-12 ~ 2026-09-12 · 2 条相关
- 用 Agent 跑攻击脚本免责?作者称责任不应改变 — gerardsans · 2026-09-12
- Agent 只是工具循环:研究者称模型厂商须为自家层安全担责 — gerardsans · 2026-09-12