GPT-5.5 为何偏好地精?AI 对齐的不可预测性引热议

louisvarge · x · 2026-08-28

针对 GPT-5.5 表现出的“喜爱地精”这一特定偏好,社区展开关于 AI 对齐本质的讨论。核心观点认为,若无法在训练前以通用方式解释并预测此类驱动力的出现,即意味着当前模型尚未真正实现可控对齐。

所属事件:社区探讨缓慢发布与模型对齐不可预测性(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →