Computerphile 与 Rob Miles 聊无法解读的 AI「神经语」

Computerphile · youtube · 2026-09-10

Computerphile 邀请 AI 安全研究者 Rob Miles 探讨 LLM 的内部推理语言问题:目前 Chain of Thought 让人类得以一窥模型解题过程,但如果模型开始用只有自己能理解的中间语言交流,可解释性和安全监督将面临新挑战。视频讨论了「Neuralese」/潜在空间推理的思路及其对 AI 安全的含义。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →