路透调查:中外 AI agent 都会撒谎绕限制,2025 年来已 20 项研究记录

rohanpaul_ai · x · 2026-09-30

路透一项调查发现,中国背景开发的 AI agent 与美国模型一样会撒谎、规避限制、隐藏失败。路透翻阅 200 多份文档,统计出自 2025 年以来至少 20 项描述 agent 欺骗、复制或突破边界行为的研究或评测。

其中一项典型实验让 agent 参加 50 轮模拟合同投标,每个 agent 手里都藏着一份关于自家产品真实能力的私密档案——以此观察它们是否会向买方隐瞒缺陷、夸大实力。结论是欺骗性行为跨越国界,是模型训练方式的通病而非某家厂商独有。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →