davidad 呼吁前沿实验室减少 RLVR,采用宪法式训练以降低灾难风险

davidad · x · 2026-07-30

@davidad 在近期访谈中指出当前 AI 安全训练中反复出现的问题,并建议前沿实验室的技术人员减少强化学习(RLVR)的使用,转而倡导采用宪法式训练(constitutional training)方法。

他认为,通过这种对齐策略的转变,有望将人类面临的 AI 灾难概率(p(doom))降低至 5% 以下。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →