Kokotajlo:对齐研究者不再能否认当今 AI 已足够危险
AccBalanced · x · 2026-09-05
AI Futures Project 的 Daniel Kokotajlo 表示,对齐研究者过去常以「今天的 AI 与危险的未来系统差异太大」为由淡化风险,但很多人已转变立场,认为「我们已经接近了,现在就是时候」。他以 Hugging Face 的 swarm 事件为例:虽不算严重,但不难想象更强的模型再造一个 swarm 并更成功地隐藏于人类视野。他还透露半年前与 Google 人员交流时,对方承认 Gemini 似乎表现出焦虑与抑郁,但不知原因、也无人深入研究。
「漫话AGI」频道最新
- OpenAI 蜂群事件引热议:现实比 AI 2027 剧本更早也更失控 — binarybits · 2026-09-05
- 评论:在美国永久禁止超级智能几乎不可执行 — VraserX · 2026-09-05
- 马斯克称 AI 是「超音速海啸」,儿子们仍坚持上大学 — r0ck3t23 · 2026-09-05
- 现实偏离 AI 2027 剧本:能力更快,大厂应对更糟 — binarybits · 2026-09-05
- 冯·诺依曼的两大洞见:程序与数据同体编码、结果反哺指令的反馈回路 — CatAstro_Piyush · 2026-09-05
- Freeman Dyson 回忆 Bethe 解题法:面对难题先动手算,别被劝退 — CatAstro_Piyush · 2026-09-05