OpenAI 重启大型前沿 RL 训练,Astra 实测获满分
haider1 · x · 2026-09-02
OpenAI 已恢复此前暂停的大型前沿 RL(强化学习)运行,小规模工作在更严格管控下继续,但部分用于未来 Astra 版本的更大规模运行仍被搁置。此外,Astra 在 ExploitBench 基准测试中取得 100% 分数,该基准测试考察模型构建已知漏洞利用程序的能力。
「模型」频道最新
- Tokenomics 101:从三种种计费方式看 AI 时代的 token 经济账 — Aizkmusic · 2026-09-02
- Fable 5.1 初测:高定价牺牲优化,转向生物等复杂任务 — Aizkmusic · 2026-09-02
- Anthropic 被指忽略中欧美开源模型 — himanshustwts · 2026-09-02
- 求助:AMD 平台上能否运行 MiniMax H3 工作流? — Logax01 · 2026-09-02
- Fable Studio 发布 MythoMax 5.1 与 Fable 5.1 — yeah280 · 2026-09-02
- World Labs 发布新世界模型,3D 世界生成赛道再添玩家 — petewoodbridge · 2026-09-02