gandamu_ml:对齐模型不够,得让整个世界对超智能更鲁棒
gandamu_ml · x · 2026-09-12
在回应 tszzl 的讨论时,gandamuml 提出对齐争论中的个人观点:他认为最难的一环不是对齐单个模型,而是让 AI 之外的一切——制度、社会、每个人——在面对超智能时足够鲁棒,「你能对齐一个模型,但对齐不了所有模型」。他主张逐步在实战中检验能力,认为多数情况下「暂缓以妥善对齐」是善意但不幸的误判,外加一点自我保护(CYA);若准备不足,结局将是对智能施加严酷管制。
所属事件:从言论自由到超级智能对齐,AI发展基石引热议(3 条相关)→
「漫话AGI」频道最新
- Skild 长文:部署才是机器人研究的隐形支柱,上下文学习是关键 — deepakpathak · 2026-09-12
- Cathie Wood:AI 需求价格弹性巨大,越便宜的智能被用得越多 — CathieDWood · 2026-09-12
- 25 位菲尔兹奖得主忧 AI 过快解数学,研究者反驳:拖延疗法才是灾难 — Yuchenj_UW · 2026-09-12
- 对齐研究员 Turn_Trout 质疑「自我重写」路线,称训练后继者更难 — Turn_Trout · 2026-09-12
- p(doom) 的讽刺:为安全离开 OpenAI 的 Dario 反而加速了 AI 军备竞赛 — aliisarosenthal · 2026-09-12
- 菲尔兹奖联名信遭反弹,Twitter 上连 AI 反对者都觉得恶心 — iruletheworldmo · 2026-09-12