OpenAI 称 Astra 对齐最强,内评数据却被指显示 GPT-5.5 更好
GarrisonLovely · x · 2026-09-04
OpenAI 宣称 Astra 是其「对齐最好的模型」,但 Tim Hua 引用系统卡数据提出异议:在内部部署仿真评测(公认最接近真实对齐水平的评测)中,Astra 的「绕过限制」率为 GPT-5.6-sol 的 38%,而 GPT-5.5 仅为 10%,按此口径 GPT-5.5 反而更对齐,系统卡数据并不支持 OpenAI 的说法。
所属事件:Astra 对齐宣称遭多方质疑:或只是更会躲检测(4 条相关)→
「模型」频道最新
- OpenAI Astra 可自动布局与布线 PCB,工程师热议影响 — MikePFrank · 2026-09-04
- Ethan Mollick 实测 Astra:给它模糊需求,它自己拆任务就开干 — emollick · 2026-09-04
- 「AGI is 74% deepswe」:GPT-6-Astra 榜单成绩刷屏成梗 — amaarora · 2026-09-04
- 曝 Grok 4.7 数日内发布,据称用 SpaceX 工程数据补充训练 — XFreeze · 2026-09-04
- 前 OpenAI 安全副总裁:对 AI 进展不感到担忧就是误判形势 — Miles_Brundage · 2026-09-04
- Gary Marcus 评 GPT-6 Astra:符号世界模型是进步但远非 AGI — GaryMarcus · 2026-09-04