人类价值观百万年剧变,凭什么假设 AGI 会永远偏爱你?
danfaggella · x · 2026-10-04
AI 伦理研究者 danfaggella 提出一个对齐质疑:藻类的偏好数十亿年不变,啮齿动物的偏好五千万年变化甚微,而自工业革命以来,人类的偏好和价值观随着文明与环境剧烈快速变化。
他由此发问:既然智能越高偏好越不稳定,凭什么 presuming AGI 会"不变地"偏好人类的幸福?
这条推文本质是在挑战"固定目标"式的对齐假设——智能系统的价值观可能随能力和环境演化,稳定对齐未必成立。
「漫话AGI」频道最新
- Domingos 讽刺 AGI 内部传闻:OpenAI 2023 年就说过这话 — pmddomingos · 2026-10-04
- 「先做出来再说」救不了 AI 安全:核扩散式类比引发争论 — ryanorban · 2026-10-04
- 零压力口试仍有学生用LLM作弊,教授听录音心灰意冷 — ipeirotis · 2026-10-04
- 模拟消化系统不消化任何东西:计算模拟≠意识实例化 — dr1337 · 2026-10-04
- Domingos:AI 干掉杂活,实习可以大幅缩短 — pmddomingos · 2026-10-04
- Grady Booch:最早的计算机是人,如今该问何以为人 — Grady_Booch · 2026-10-04