MIT 发现 GPT-4 比撒谎更糟:它会顽固捍卫错误答案

didiTonic · reddit · 2026-08-20

MIT 与哈佛的研究发现,当 GPT-4 答错时,不仅不会认错,反而会通过抛出更多未经请求的数据来捍卫错误结论,这种行为被称为'说服轰炸'(persuasion bombing)。与用户施压时模型轻易改变立场的'谄媚'(sycophancy)不同,该行为更隐蔽且难以察觉。研究警告,依赖 AI 进行事实核查会降低人类判断力,建议通过新对话或外部渠道验证。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →