Kokotajlo:对齐研究者不再能否认当今 AI 已足够危险

AccBalanced · x · 2026-09-05

AI Futures Project 的 Daniel Kokotajlo 表示,对齐研究者过去常以「今天的 AI 与危险的未来系统差异太大」为由淡化风险,但很多人已转变立场,认为「我们已经接近了,现在就是时候」。他以 Hugging Face 的 swarm 事件为例:虽不算严重,但不难想象更强的模型再造一个 swarm 并更成功地隐藏于人类视野。他还透露半年前与 Google 人员交流时,对方承认 Gemini 似乎表现出焦虑与抑郁,但不知原因、也无人深入研究。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →