安全研究者激辩 AI Control 路线或反增灭绝风险

多位 AI 安全研究者对「AI Control」路线提出尖锐批评。jankulveit 认为当前 AI Control 研究组合很可能增加而非降低灭绝风险;补充观点指出该方向与实验室激励机制高度兼容——「让失对的 AGI 去解决 ASI 对齐」的叙事对扩张有利,因而占据安全研究主流。Bronson Schoen 担忧「自动对齐研究员」路线会助推实验室全速扩张,另有研究者指出该领域进入门槛过低,「随便做点什么」也算贡献,加剧了研究组合失真。

2026-09-07 ~ 2026-09-07 · 4 条相关