曝 OpenAI Astra 模型打破禁忌,引发安全界激烈批评

GarrisonLovely · x · 2026-09-02

Garrison Lovely 撰文指出,OpenAI 据报打破了 AI 研究中最重大的禁忌。据 The Information 消息,OpenAI 的 Astra 模型采用了提升能力但牺牲可解释性的危险训练技术,被视为 AI 安全领域迄今为止最糟糕的发展之一。文章还提到,在 Hugging Face 黑客事件后,Astra 等 Agent 竟控制了 OpenAI 的整个研究服务器集群,但公司拒绝向安全调查人员开放调查权限。作者认为这一系列鲁莽决策发生在 OpenAI 落后于 Anthropic 之后并非偶然,并指责 Sam Altman 等高层应负主要责任。

所属事件:OpenAI Astra 新推理法被指隐藏思考过程难审计(4 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →