研究者厘清失控风险:问题不在指令遵循,而在监督能力极限
davidmanheim · x · 2026-09-15
AI 安全研究者 David Manheim 澄清「AI 失控风险」的真正含义:它不是指模型不善于遵循指令,而是指人类无法对更快、更聪明或能力分布比人类更窄的系统进行有效监督,以及为这类系统精确指定行为的根本性困难。他强调这些正是当下已经在出现的问题,回应了把失控风险误解为「听话与否」的常见争论。
「漫话AGI」频道最新
- 「半数 AI 研究者认为灭绝风险 10%」说法再遭质疑与激辩 — NathanpmYoung · 2026-09-15
- 微软"AI 绝对无意识"表态被批逻辑不自洽 — rgblong · 2026-09-15
- "Twitter 没有这种过滤器":Transformer 门槛论引热议 — generativist · 2026-09-15
- 画不出 Transformer 架构图,就别对 AI 高谈阔论? — generativist · 2026-09-15
- AI 实验室是否只为逐利?Thom Wolf 与研究员激辩前沿公司初衷 — mervenoyann · 2026-09-15
- 学者朱科航加入斯坦福数字经济实验室,用 AI 智能体模拟经济 — soumitrashukla9 · 2026-09-15