OpenAI 重启大型前沿 RL 训练,Astra 实测获满分

haider1 · x · 2026-09-02

OpenAI 已恢复此前暂停的大型前沿 RL(强化学习)运行,小规模工作在更严格管控下继续,但部分用于未来 Astra 版本的更大规模运行仍被搁置。此外,Astra 在 ExploitBench 基准测试中取得 100% 分数,该基准测试考察模型构建已知漏洞利用程序的能力。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →