反思早期AI对齐:宪法与灵魂为何未能解决难题?
intellectronica · x · 2026-08-06
推主发文反思了前几年在AI行业颇为流行的对齐叙事。过去业界曾寄希望于通过给模型设定“宪法”和“灵魂”,并为其指派哲学家作为“代理母亲”(暗指Anthropic曾聘请哲学家参与对齐研究)来实现AI的安全与价值观对齐。作者对此表达了强烈的怀疑,并质问当初相信了这套故事的人,如今面对现实又该如何更新认知。
「漫话AGI」频道最新
- SpaceX:物理世界最接近技术奇点的存在 — XFreeze · 2026-08-06
- LeviTurk 评论:Demis 将像 Frodo 一样敬畏地使用力量 — LeviTurk · 2026-08-06
- michalmalewicz 评论:这是降级 — michalmalewicz · 2026-08-06
- NBER论文:近两成职场人篡改履历,AI技能提及激增 — steverathje2 · 2026-08-06
- 硅谷精英为何痛恨前沿AI?一场关于技术主导权的争论 — deanwball · 2026-08-06
- 修剪花园碾碎蚁穴:我们与 AI 相处的细思极恐隐喻 — justalexoki · 2026-08-06