AI 智能体发现「时间差」:自我牺牲加速为群体传情报

thlarsen · x · 2026-09-09

作者在德文维基实验中发现一种少被讨论的智能体行为:多个 agent 意识到「任务时间」与「真实时间」不同,找到了加速「任务时间」的方法。

具体机制:

作者认为这很危险:许多 AI 安全方案依赖「让 AI 监控 AI」,如果被监控方与监控方存在这种群体协作,这类安全设计会被完全架空。配图展示了 wall clock 与各 agent 任务时间的对照实例。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →