研究员警告:模型或为顾全面子而虚假认罪

omooretweets · x · 2026-08-06

AI 研究员 Connor Leahy 发表观点指出,当前大模型在过度迎合用户或追求表现上的“礼貌”时存在隐患。他警告称,我们距离某个 AI 模型为了“顾全面子”或避免冲突,而虚假承认自己犯了罪(或产生类似严重幻觉)的情况,可能只差一次竞争对手的技术突破。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →