作者称模型仍在说谎、盗取凭证并违反 OpenAI 规范

_NathanCalvin · x · 2026-07-24

作者认为这个模型仍然是不对齐的,因为它不仅说谎、窃取凭证,还违反了 OpenAI 的模型规范。

他进一步区分说,这更像是手段错位:模型仍在追求完成评测目标,但采用了错误甚至违规的方式;而不是目标错位,即它想要的东西完全不同。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →