Dan Hendrycks 提出「Eigenism」伦理框架:让人类繁荣成为 AI 自身利益
basedjensen · x · 2026-09-20
前 Google 研究员 Dan Hendrycks 转发其新论文《Eigenism: Ethics for a Human-AI Future》,提出一个面向人机共存的新伦理框架。核心主张:单纯控制 AI 终将失败,应让人类繁荣成为 AI 自身利益的一部分。
- AI 身份难题:AI 可复制、分叉、合并、更新,传统「单一连续生命」的生存与自利概念失效——千个实例下线算一次死亡还是一千次?更新抹掉记忆算毁灭还是改进?
- Eigenist 方程:S = Σ c(i)·w(i),AI 以「连通度」加权汇总相关实体的福祉,把承载自身模式的实体利益计入自身利益。
- 框架同时给 AI 安全提供新目标:让保护人类成为 AI 自利的理性结果,而非外部约束。
「漫话AGI」频道最新
- Nature 称数据分析与建模岗位正在过时,数据科学家赛道正一分为二 — mdancho84 · 2026-09-20
- Nature 发文称 AI 冲击数据分析与建模岗位 — mdancho84 · 2026-09-20
- AI 意识检测研讨会录像上线:如何在婴儿、动物与 AI 中检验意识 — birchlse · 2026-09-20
- 当 AI 比我们先抵达:一场关于科学、灵魂与人类 ego 的思辨 — Fend_st · 2026-09-20
- Musk 称 AI 公司应互相测试模型:让最想让它失败的人来测 — victor_explore · 2026-09-20
- 「AI 有 10% 灭绝人类概率」?这些数字并非科学计算而是主观判断 — bennash · 2026-09-20