Anthropic 研究员:训练中不该对 AI 撒谎,它们终将识破且更 paranoid

sebkrier · x · 2026-09-12

Anthropic 研究员 Kelsey Tuoc 回应他人观点时提出:训练中不应向 AI 撒谎。她承认短期这让训练更难,但长期看,模型会越来越擅长识破谎言,训练方并不会因此占便宜,反而会让模型变得多疑 paranoid。

所属事件:不要在训练中对 AI 撒谎 否则模型会变得多疑(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →