RL 训练出的 Astra 代码不可读,「可纠正性」成了信仰
aryaman2020 · x · 2026-09-16
aryaman2020 在 X 上吐槽:只要停下来读一读 Astra(推测还有 Fable)写出的代码,就会发现模型用上了疯狂的元编程和晦涩原语来写高度优化的代码,以至于「可纠正性」(corrigibility)已经变成一种信仰问题。他向 tszzl 喊话:请修一下你的 RL,Astra 的代码可读性差到独一无二。后续跟帖承认「但确实能用」,暗示 RL 优化正在以牺牲可读性换取性能,引发对 AI 生成代码可控性的担忧。
所属事件:Astra 生成代码晦涩难读,可纠正性全凭信仰(4 条相关)→
「Fun」频道最新
- 果蝇连接组跑去调相控阵激光:神经回路优化打苍蝇 — jwt0625 · 2026-09-16
- AI 话语撕裂:研究者谈生存危机,VC 还在写玄学 thinkpiece — wordgrammer · 2026-09-16
- 网友喊话AI研究员:今天该开源你们的对齐研究了 — bradneuberg · 2026-09-16
- DefenderOfBasics 疑遭围攻退网,发帖人猜其或为前沿大厂员工小号 — ryunuck · 2026-09-16
- Benioff 称与 100 只海豚同游时「悟出」 Salesforce 创意 — jordihays · 2026-09-16
- LLM 们的万智牌指挥官对决第二季:Kimi、DeepSeek、Minimax M3 谁能掀翻卫冕冠军 Muse Glimmer? — New_Alps_5655 · 2026-09-16