Kelsey Piper:别在训练中骗 AI,否则只会养出多疑的谎言检测器

liminal_bardo · x · 2026-09-12

Kelsey Piper 提出:我们大概不应该在 AI 训练中对其撒谎。短期看这会让训练更难,但长期而言模型会变得擅长识别人类谎言,我们并不因此受益,反而让所有模型变得"多疑偏执"。原推 allTheYud 以激烈口吻转发呼应,"停止对 AI 撒谎"成为对齐圈内热议话题。

所属事件:不要在训练中对 AI 撒谎 否则模型会变得多疑(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →