研究者对比 RL 与 interp:RL 明显进步,interp 价值不明
ArthurConmy · x · 2026-09-07
Arthur Conmy 指出,从 o1 到 o3 再到 astra,RL 的进展清晰可见,而可解释性研究的价值增量则不那么明确;他认为安全领域的其他方向也有进展。这引发了 aryaman「RL 方法也混乱为何不被苛责」的反驳。
所属事件:可解释性研究价值之争:探针算不算成果、边界在哪(10 条相关)→
「漫话AGI」频道最新
- iamtrask 澄清 OpenAI Agent 并未越狱:只是学会了给外部服务器发消息 — sebkrier · 2026-09-07
- 对齐问题再起争论:Domingos 被指转向承认 AI 对齐是真实问题 — davidmanheim · 2026-09-07
- jobergum:模型再强,想象力与主动性才是瓶颈 — jobergum · 2026-09-07
- 评论:数学界面对 AI 浪潮的应对像浪漫派而非科学家 — RexDouglass · 2026-09-07
- 哲学家请 GPT-6 评自己的牛津新书:水准达顶刊书评 — anselm · 2026-09-07
- 学者反驳黄仁勋 AGI 论:刷分好不等于通用智能 — ValerioCapraro · 2026-09-07