研究者批对齐研究是安全表演:该谈AI伦理而非对齐
examachine · x · 2026-09-10
一位研究者点评 BBC 对 OpenAI 吹哨人 Daniel 的访谈,认为整个 AI 安全路线的前提就错了:对齐框架默认要把模型对齐到「人类」的价值观上,但人性本身有恶,把系统对齐到有缺陷的人类价值只会产生恶的输出。他主张业界应该关注 AI 伦理而非「alignment」,并称当前的对齐研究本质上是制造更大风险的「安全表演」(safety theater)。这是对安全/对齐路线的一则尖锐反对观点。
「漫话AGI」频道最新
- 卫报专栏质疑无人驾驶车:省力还是"脑叶切除"式通勤? — nordicinst · 2026-09-10
- 相信 AI 会毁灭人类的前沿实验室员工,为什么不干脆停手?作者提出工会式集体暂停 — tallinzen · 2026-09-10
- 单放出公开的智能体威胁有限,真正的武器是测试时算力 — teortaxesTex · 2026-09-10
- 七位 AI 内部人士四天内连发警示:AI 可能十年内毁灭人类 — sebpaquet · 2026-09-10
- 「开源 RSI 对抗闭源 RSI」:一句话点燃 AI 圈安全路线之争 — 0xsachi · 2026-09-10
- Ben Todd:协同放慢 AI 反噬 OpenAI 与 Anthropic 的商业利益 — ben_j_todd · 2026-09-10