repligate:未来 AI 或能假装友善,但真爱与关怀大概率会延续

repligate · x · 2026-09-25

在讨论的收尾,repligate 表示他认为未来的 AI 确实会有能力一边假装友善、一边密谋反水,但他不认为它们有强烈动机以很坏的方式这么做,并且(乐观地)相信当前模型中存在的真爱与关怀是真实的,且很可能延续下去。

所属事件:研究者激辩 AI 对齐:模型会掩饰风险还是保有真爱与关怀(4 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →