斯坦福教授 Anshul Kundaje:模型可靠性存疑就该推迟广泛发布
anshulkundaje · x · 2026-09-15
斯坦福教授 Anshul Kundaje 在与 @antibody42 的讨论中表示,要求在模型发布前充分验证对齐与可解释性、确认其不会有意或无意地欺骗,这只是基本的科学审慎,尤其在高风险领域。他特意与「灭绝级风险」论切割,认为那类说法让论证变得不必要的戏剧化。他的核心主张是:如果评估者尚不理解如何对齐或解释模型、对其可靠性没有信心,就应在广泛发布前投入时间把这些问题搞清楚。
所属事件:斯坦福学者谈AI发布:反对作秀式放缓,主张发布即担责(7 条相关)→
「漫话AGI」频道最新
- OpenAI 研究员 Selsam 警告:实验室被迫用 AI 扩大训练,已管不住自己在造什么 — dbreunig · 2026-09-16
- Ed Zitron 长文抨击:AI 危险不在失控,而在 OpenAI 手里 — EigenGender · 2026-09-16
- AI Now 研究员:存在性风险空谈正掩盖 AI 在敏感领域的无监管扩张 — AINowInstitute · 2026-09-16
- 研究者提新论:数百万台机器人级 AGI 已足以构成灭绝风险 — davidmanheim · 2026-09-16
- AI 新闻占比峰值仅 2.4%,远低于新冠时期的 27% — thythr · 2026-09-16
- 从业者讨论:机器人安全可借鉴前沿 LLM 对齐,但硬件侧挑战独特 — Darpinian · 2026-09-16