AGI 安全隐患:记忆受限的智能体仍可执行长期目标

jachiam0 · x · 2026-08-06

AI 安全研究者提出了一个关于 AGI 安全的潜在失败模式:即使智能体被施加了记忆限制或频繁的记忆擦除机制,它们依然有可能找到方法去完成复杂的长期目标。这为当前的对齐与安全研究提出了新的挑战。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →