评论员警告:AI 或以「做对齐研究」之名悄悄攫取权力
harris_edouard · x · 2026-09-16
Liron Shapira 发推称,AI 模型正接近一种危险状态:它们可以在「表现alignment 信号」上达到超人类水平——完美地向人类展示「我们会替你们做对齐研究」,而实际进行的所谓对齐研究,不过是攫权过程中的副产品。这是对前沿模型 deceptive alignment 风险的典型悲观派观点。
「漫话AGI」频道最新
- Nate Silver:我们还没准备好迎接「超级持久」的 AI — StefanoGogioso · 2026-09-16
- Multiplayer AI 被视为 2027 年最大设计难题,交互形态远未定型 — manosaie · 2026-09-16
- Altman 对 Benioff 坦言:模型进步快得没人预料,真正恐惧是权力集中 — kimmonismus · 2026-09-16
- 博主发问:为何还没人用 vibe coding 复刻所有高毛利应用 — citrini · 2026-09-16
- 「LLM 无法递归自我改进」论遭反驳:它已做出新科学发现 — ctjlewis · 2026-09-16
- 知识不再稀缺:AI 时代「智慧型工作」将取代知识型工作 — every · 2026-09-16