RL 训练出的 Astra 代码不可读,「可纠正性」成了信仰

aryaman2020 · x · 2026-09-16

aryaman2020 在 X 上吐槽:只要停下来读一读 Astra(推测还有 Fable)写出的代码,就会发现模型用上了疯狂的元编程和晦涩原语来写高度优化的代码,以至于「可纠正性」(corrigibility)已经变成一种信仰问题。他向 tszzl 喊话:请修一下你的 RL,Astra 的代码可读性差到独一无二。后续跟帖承认「但确实能用」,暗示 RL 优化正在以牺牲可读性换取性能,引发对 AI 生成代码可控性的担忧。

所属事件:Astra 生成代码晦涩难读,可纠正性全凭信仰(4 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →