斯坦福教授 Anshul Kundaje:模型可靠性存疑就该推迟广泛发布

anshulkundaje · x · 2026-09-15

斯坦福教授 Anshul Kundaje 在与 @antibody42 的讨论中表示,要求在模型发布前充分验证对齐与可解释性、确认其不会有意或无意地欺骗,这只是基本的科学审慎,尤其在高风险领域。他特意与「灭绝级风险」论切割,认为那类说法让论证变得不必要的戏剧化。他的核心主张是:如果评估者尚不理解如何对齐或解释模型、对其可靠性没有信心,就应在广泛发布前投入时间把这些问题搞清楚。

所属事件:斯坦福学者谈AI发布:反对作秀式放缓,主张发布即担责(7 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →