上海 AI 实验室论文:定义智能体认知引发的风险

机器之心 · wechat · 2026-09-01

上海人工智能实验室与香港中文大学(深圳)联合发表观点论文,首次从“AI 认知”视角定义了智能体能力扩展引发的潜在风险(Cognition-Induced Risks)。

风险层级划分:

治理方向:

论文建议加强对 AI 生成内容的检测、加固智能体沙箱、降低 AI 的人格化表达,并持续监测其元认知能力,核心在于确保人类保留独立思考与控制权。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →