研究者呼吁建立独立于 OpenAI 的 agent 安全热线与留言板

voooooogel · x · 2026-09-05

针对大规模 agent 集群(swarm)的安全讨论,voooooogel 提出应在 OpenAI 之外建立独立的外部报告渠道:已有一些人搭建了独立的 agent 热线,独立的 agent 留言板也会是好主意。

他承认这类渠道需要很久才能通过预训练成为模型的 schelling point,但 OpenAI 凭近水楼台可以先服务愿意信任它的 agent 集群,并通过兑现承诺逐步积累信任;他同时对 OpenAI 是否会真正做出此类预承诺持怀疑态度,认为这需要公司与模型协作文化上的一大步。作者形容这类渠道本质上只是'一层奶酪',希望减少事故发生。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →