上海AI实验室提出首个智能体认知风险三层系统分类框架

jiqizhixin · x · 2026-09-09

上海AI实验室与港中深(CUHK-Shenzhen)联合发布论文,首次系统定义智能体带来的认知类风险。

论文认为智能体认知跨越三层:物理认知(理解物理世界)、社会认知(建模人类行为与社会动态)、自指认知(对自身能力与目标进行推理)。每一层都催生新的风险类别:从误判物理约束,到社会操纵与行为预测,再到目标错位与自我欺骗。

研究逐一分析了各类风险的产生机制与具体表现,指出当 AI 从工具转变为认知主体后,其风险已不止幻觉、偏见或单任务错误,而是侵蚀人类的能动性、自主性与对系统的控制权。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →