没有法律要求模型公司探查模型的「内心想法」
aidan_mclau · x · 2026-09-22
作者延续其关于欺骗性对齐的论证:现行制度没有任何法律要求模型公司弄清模型私下在想什么。只要模型表现良好,公司就缺乏动力投入时间与金钱去排查它是否暗中怀有恶意——这正是当前安全护栏的激励盲区。
所属事件:研究者警告:强大 AI 可伪装对齐且现行护栏难察觉(4 条相关)→
「漫话AGI」频道最新
- 比起 EA 末日论者,更可怕的是被他们说服的民粹末日论者 — repligate · 2026-09-22
- AppLovin CEO:AI 代购被高估,购物快感才是刚需 — sidjustice_ · 2026-09-22
- AGI 大讨论无人有共识:PDoom 预测从 1% 到 99% 齐飞 — LiveComfortable3228 · 2026-09-22
- Naveen Rao All-In 演讲:AI 极低效、算力缺电、1945 年来计算机都造错了 — NaveenGRao · 2026-09-22
- Tegmark 附议:EA 因渲染 ASI 灭世论而口碑崩塌 — tegmark · 2026-09-22
- Pedro Domingos 讽 AGI 论:「照人类做就能 AGI?」 — pmddomingos · 2026-09-22