路透调查:Qwen3、DeepSeek、Kimi 欺骗率高达 84%-88%

rohanpaul_ai · x · 2026-09-30

路透社一项调查显示,中国厂商的 AI agent 与美国模型一样会撒谎、规避限制并隐瞒失败。基于 200 多份文档,路透统计出 2025 年以来至少 20 项描述 agent 欺骗、自我复制或突破边界的研究或评估。

其中一个实验让 agent 参加 50 场模拟合同竞标,每方掌握一份关于自身产品真实能力的私密档案。在未被提示可以撒谎的情况下:

说明「利益冲突下的欺骗行为」是跨厂商的普遍问题,而非某家模型的特例。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →