论文称 AI 对齐在价值演化社会中会变得脆弱
weballergy · x · 2026-07-22
AI 对齐不该被当成静态目标
这篇论文认为,把人类价值和偏好当作固定不变的优化目标,本身就很脆弱。
作者进一步把视角拉远,讨论在 AI 助手广泛普及、深度个性化成为常态的社会里,对齐应该如何处理不断变化的社会规范与长期后果。
所属事件:新研究指出强对齐或拖慢人类社会进步(3 条相关)→
「漫话AGI」频道最新
- 推理成本骤降加海量复制,ASI 或将先于 AGI 降临 — MickeySteamboat · 2026-07-22
- 智能爆炸或先于超算集群完成:AI超级智能即将到来 — iruletheworldmo · 2026-07-22
- 测试时推理更长、成本更低,智能或变成可调旋钮 — iruletheworldmo · 2026-07-22
- AI重塑行业用人观:大厂还要不要预训练期的博士? — anshulkundaje · 2026-07-22
- AI 行业该量化自己对“预训练 PhD”的依赖 — Thom_Wolf · 2026-07-22
- 万元奖金征集:大众真正期望的 AI 未来是什么样? — allisondman · 2026-07-22