DeepMind 高管发文:必须刻意保住思维链的可监控性

ancadianadragan · x · 2026-09-17

Google DeepMind 的 Rohin Shah(AGI 安全与对齐总监)与 Anca Dragan(AI 安全与行为副总裁)在 DeepMind Institute 成立之际联合发文,主张应主动保护推理模型的思维链(CoT)透明度。

作者强调可监控的 CoT 并非解决对齐问题的全部,但是必须守住的一扇窗。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →