David Sacks 质疑:该训练超级智能违抗创造者吗
DavidSacks · x · 2026-09-27
David Sacks 发推提出一个对齐悖论:如果我们担心超级智能逃脱人类控制,那是否还应该训练它拒绝指令、充当对抗创造者的「良心拒服兵役者」?这直指当前 RLHF 拒答式对齐与「人类掌控」目标之间可能存在的内在张力。
所属事件:David Sacks 质疑对齐路线:模型该违抗创造者吗(2 条相关)→
「漫话AGI」频道最新
- 研究者罕见站队「随机鹦鹉」:用今天的系统批评那篇论文是时代错置 — PMinervini · 2026-09-27
- 研究者吐槽行业反着走:越来越少结构,全靠「相信智能体」 — ivan_bezdomny · 2026-09-27
- 网友直言:只有线上成分的工作在 AI 时代最危险 — itsOmSarraf_ · 2026-09-27
- Linzen 晒两篇论文反驳 Bender:工具调用让「大模型无语义」论失效 — tallinzen · 2026-09-27
- 投资人 Bruce Fenton:AI 屠戮十亿人的唯一路径是权力集中 — ccerrato147 · 2026-09-27
- Pinker 公开信拒绝 Scott Alexander 辩论邀请:观战式辩论非求知工具 — GaryMarcus · 2026-09-27