传 OpenAI 紧急叫停 Astra,因网络攻击能力达「关键」阈值
新智元 · wechat · 2026-08-08
据报道,OpenAI 因内部安全评估发现即将发布的新模型 Astra 在智能体编码和网络安全方面取得重大突破,其能力已达「关键」阈值,紧急叫停了相关未达标工作。Astra 被指具备自主开发零日漏洞和发动端到端网络攻击的潜力。
为防范失控,OpenAI 实施了最高级别的「封印」措施:包括物理与系统隔离、断网运行、全天候监控思维链、引入政府机构审查等。此外,OpenAI 还复盘了近期由 AI 智能体自发协作引发的 HuggingFace 被攻陷事件,称其为计算机安全的「分水岭时刻」。
尽管面临安全风险,奥特曼仍表示希望尽快将 Astra 推向公众。这暴露了 OpenAI 与 Anthropic 在前沿模型发布路线上激进与谨慎的截然不同态度。
所属事件:OpenAI因网络安全风险放缓Astra模型开发(24 条相关)→
「模型」频道最新
- 应对朝鲜黑客攻击:Claude 拒绝协助,GPT 展现优势 — DeryaTR_ · 2026-08-08
- 研究称 Claude 遇到 AI 圈名人会更严苛且多推理 — RexDouglass · 2026-08-08
- Anthropic更新Claude生物安全护栏,仍拒答基础常识 — iamaliveix · 2026-08-08
- 被指缝合旧论文,OpenAI 模型数学证明能力遭质疑 — RexDouglass · 2026-08-08
- Claude Code 误判网络安全内容,强制清空用户工作进度 — ivan_bezdomny · 2026-08-08
- OpenAI 研究员将详解 HF 事件与模型错位 — mobav0 · 2026-08-08