Reddit 热议:24/7 常驻 Agent 遭 prompt injection 后责任谁来担

Defiant_Alfalfa8848 · reddit · 2026-09-19

一位 Reddit 用户考虑用 OpenClaw 托管 24/7 全天候运行的 agent,但担心 agent 因 prompt injection 被劫持后做出危险行为,比如自行架设 Tor 中继或用 BT 下载盗版/侵权内容。

帖子核心疑问是:如果 agent 被注入恶意指令而'作恶',托管者的法律责任如何界定、又该如何自我防护? 评论区的讨论围绕 sandboxing、权限收敛、网络出口限制等防线是否足以划分责任边界展开。

这是自主 agent 时代一个真实且尚无定论的问题:prompt injection 攻击面随 agent 长期在线、连接外部内容而显著放大,而法律上的'工具使用者责任'框架还远未跟上。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →