OpenAI 为安全暂停 Astra 训练两周,算力成本增 20%
coursiv_ · reddit · 2026-09-01
OpenAI 针对 Astra 模型采取了严格的安全措施:
- 风险评级:Astra 是首个无法排除达到“关键级(Critical)”网络威胁阈值的模型,评估结论为“无法排除”而非已确认,此评级高于此前所有模型。
- 训练暂停:针对部署模型的强化学习(RL)训练暂停了两周。
- 环境加固:研究环境被加固,并进行了红队测试。
- 监控升级:扩大了监控范围,算力成本因此增加约 20%;高优先级警报要求在 30 分钟内确认是否为误报,否则活动将被强制停止。
帖子提出两个问题:无法排除关键级风险是真正的评估不确定性,还是为发布高评级做预期管理?外部验证细节是否公开?
「漫话AGI」频道最新
- 软件进入「日抛时代」:最稀缺的生产要素从程序员变成 token — aigclink · 2026-09-01
- 观点:随着执行自动化,创意价值将呈爆发式增长 — djcows · 2026-09-01
- 播客解读:用AI聊天机器人真会推高你的碳足迹吗 — AndyMasley · 2026-09-01
- AI 发展循环:狂想、进展、停滞与轮回 — pmddomingos · 2026-09-01
- Pedro Domingos:创造超级智能只需运行物理定律 — pmddomingos · 2026-09-01
- RSI 概念被滥用?博主呼吁将其正名为 AI for DL research — burny_tech · 2026-09-01