对齐研究员 Irving:单一对齐或可自举,无需复杂协调机制
geoffreyirving · x · 2026-10-06
Geoffrey Irving 回应对齐讨论:认为「没有精密决策论协调机制就解决不了对齐」的说法并不必然正确——如果足够强的 single-single 对齐足以自举出足够强的 multi-multi 对齐,那就不需要复杂的决策论协调机制。
「漫话AGI」频道最新
- Tyler Cowen 撰文为有效利他主义辩护:方向正确值得认真对待 — AndyMasley · 2026-10-07
- 两位前 Facebook 程序员转型投资人:机器写代码已胜过我们自己 — adityaag · 2026-10-07
- Ben Goertzel 吐槽诺奖:后奇点时代将换掉这套声誉体系 — bengoertzel · 2026-10-07
- DeepMind 研究员:重点不是制造业岗位,而是能力的个人掌控 — scott_e_reed · 2026-10-07
- 去中心化研究中心发布报告:逐层梳理对抗 AI 集中的替代方案 — sebkrier · 2026-10-07
- 前 OpenAI 研究员:品味像好诗一样难定义,这对人类是好消息 — DimitrisPapail · 2026-10-07