我们读不懂的 AI 语言:Rob Miles 讲解 Neuralese

mycall · reddit · 2026-09-11

科普频道与安全研究者 Rob Miles 合作制作视频,探讨「Neuralese」——模型内部不可解释的神经网络原生表征。视频讨论了可解释性研究的意义、模型可能形成人类无法直接阅读的内部语言带来的对齐与透明度挑战,以及当前解读模型内部状态的技术进展。

所属事件:Rob Miles 讲解 AI 内部不可读的神经语(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →