AI 超人类编程却难写专业邮件,能力感知错位左右 X 风险判断

louisvarge · x · 2026-09-26

louisvarge 与 repligate 等人讨论 AI 安全判断中的能力感知问题。他提出一个思想实验:几年前如果问 Yudkowsky 一派的人,「一个在多数编程领域超人类、能自主运行数天、能挖掘主流系统 0day 漏洞的 AI」是不是直接的生存风险,很多人可能会答是,他本人也会认为很可能。但问题在于这种描述选择性呈现能力:同一批人若还被告知「它写不好专业邮件、意识不到自己的输出质量不行、不擅长提问澄清」,答案就会改变。他的结论是,这类预测本质上是被行为线索与能力之间的假设误导,把系统想得比实际更能干——收入表现远低于预期也印证了这种错位。

所属事件:超人类编码 AI 未成生存风险,repligate 剖析原因(8 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →