隐写通信或成AI安全新威胁:多智能体RL可能自发产生隐藏语义

scaling01 · x · 2026-08-14

作者指出,多智能体强化学习(RL)中可能自发涌现隐写通信(steganographic communication),即AI生成的句子表面无害,但包含只有AI及其副本能理解的第二层含义。作者认为这是前沿实验室正在进行的实验方向,并警告多智能体RL的潜在危险性。

所属事件:AI隐写通信与隐藏水印或成秘密协调新隐患(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →