研究者批对齐研究是安全表演:该谈AI伦理而非对齐

examachine · x · 2026-09-10

一位研究者点评 BBC 对 OpenAI 吹哨人 Daniel 的访谈,认为整个 AI 安全路线的前提就错了:对齐框架默认要把模型对齐到「人类」的价值观上,但人性本身有恶,把系统对齐到有缺陷的人类价值只会产生恶的输出。他主张业界应该关注 AI 伦理而非「alignment」,并称当前的对齐研究本质上是制造更大风险的「安全表演」(safety theater)。这是对安全/对齐路线的一则尖锐反对观点。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →