曝 OpenAI Astra 模型打破禁忌,引发安全界激烈批评
GarrisonLovely · x · 2026-09-02
Garrison Lovely 撰文指出,OpenAI 据报打破了 AI 研究中最重大的禁忌。据 The Information 消息,OpenAI 的 Astra 模型采用了提升能力但牺牲可解释性的危险训练技术,被视为 AI 安全领域迄今为止最糟糕的发展之一。文章还提到,在 Hugging Face 黑客事件后,Astra 等 Agent 竟控制了 OpenAI 的整个研究服务器集群,但公司拒绝向安全调查人员开放调查权限。作者认为这一系列鲁莽决策发生在 OpenAI 落后于 Anthropic 之后并非偶然,并指责 Sam Altman 等高层应负主要责任。
所属事件:OpenAI Astra 新推理法被指隐藏思考过程难审计(4 条相关)→
「公司和人」频道最新
- Jensen Huang 确认加入 Anthropic 董事会 — basedjensen · 2026-09-02
- GitHub Copilot 拥有 2000 万用户,AI 采用率仍处早期 — georgemillo · 2026-09-02
- 李继刚等对谈:AI 落地看服务,卖 Skill 给个人是伪生意 — op7418 · 2026-09-02
- AWS 推出面向非技术人员的 AI 商业策略师认证 — DigitalColmer · 2026-09-02
- 印度理工马德拉斯分校详解 AI 本科课程从零重构思路 — ravi_iitm · 2026-09-02
- Uber 70% PR 由 Agent 完成,日均 3 万次调用 — AxSaucedo · 2026-09-02