Astra 系统卡亮点:CoT 可控性随 RL 训练提升,更少 token 更强
SeunghyunSEO7 · x · 2026-09-04
研究者观察到 Astra 系统卡中一个反直觉现象:与以往模型不同,思维链(CoT)可控性会随着 RL 训练时间变长而持续改善。同时新模型具备 no-CoT 能力,用少得多的 token 取得更强结果。作者还打趣称,更强的 CoT 可控性或也让其他实验室「非法蒸馏」变得更难——因为可控 CoT 可能掺入不可模仿的成分。
所属事件:GPT-6 Astra 系统卡披露:CoT 可控性飙升至 60.9%(6 条相关)→
「模型」频道最新
- OpenAI 新架构被指削弱思维链可监测性,安全圈警报拉响 — ShakeelHashim · 2026-09-04
- K2 Horizon 发布 6 款全开源模型,0.9B 到 375B 附全部训练代码与数据配方 — aliscodes · 2026-09-04
- 早期用户实测 GPT-6 Astra:8 分钟用 Blender 捏出狼人,17 分钟造出世界模拟器 — TheMoonMidas · 2026-09-04
- swyx 烧掉 200 亿 token 深测 Astra:训练模型、标注数据全包,成本低至每小时 6 美元 — charliermarsh · 2026-09-04
- OpenAI Kaiser:去年圣诞 Codex 突变连我们自己都说不清原因 — a_karvonen · 2026-09-04
- ARC-AGI 主办方:给模型套超强提示词,测的是人不是模型 — GregKamradt · 2026-09-04