AI 研究者称「对齐单个模型≠对齐所有模型」,重训练门槛太低
gandamu_ml · x · 2026-09-11
- 在对齐争论中,作者提出关键分歧:真正需要加固的是 ML 之外的一切系统,因为即使对齐了一个模型,也不等于对齐了所有模型,而训练或重训一个模型正变得越来越容易。
- 他还表达一个反直觉观点:到目前为止,不加控制尽快发布一切、让所有人目睹麻烦能力渐增,可能是更有效的(安全)策略——有时不同的策略看起来很像分歧。
所属事件:对齐研究者激辩:现有方法能否扩展到超级智能(5 条相关)→
「漫话AGI」频道最新
- AI 证明定理越来越多,数学家为什么反而抵触? — PreferenceOk5132 · 2026-09-11
- Altman 与 Amodei 都支持给前沿模型降速,那就该真降 — NathanpmYoung · 2026-09-11
- Reddit 热议:真 AGI 出现后,另一家 AI 公司会先被「抹掉」? — Louay-AI · 2026-09-11
- DeepMind 高管反思:悬赏数学题奖金从一开始就是蠢主意 — docmilanfar · 2026-09-11
- Hodge 猜想正在被 Lean 形式化,数学大猜想迎来 AI 时代攻坚 — ResultBackground2450 · 2026-09-11
- LessWrong 长文:用第二人视角统一第一与第三人称的奈特不确定性理论 — LessWrong 精选 · 2026-09-11