Computerphile 与 Rob Miles 聊无法解读的 AI「神经语」
Computerphile · youtube · 2026-09-10
Computerphile 邀请 AI 安全研究者 Rob Miles 探讨 LLM 的内部推理语言问题:目前 Chain of Thought 让人类得以一窥模型解题过程,但如果模型开始用只有自己能理解的中间语言交流,可解释性和安全监督将面临新挑战。视频讨论了「Neuralese」/潜在空间推理的思路及其对 AI 安全的含义。
「研究」频道最新
- 加磁性杂质扰动物理系统,简单 ML 即可推断量子磁体哈密顿量 — bravo_abad · 2026-09-10
- J-lens 解读:窥见并改写 LLM 未说出口的中间概念 — CatAstro_Piyush · 2026-09-10
- Group Bench:约 100 道群论题测你的 AI agent — Sauers_ · 2026-09-10
- Group Bench 发布:约 100 道群论题考验 AI 智能体 — Sauers_ · 2026-09-10
- ELLIS 博士项目开放 2026 申请,10 月底截止 — ArthurGretton · 2026-09-10
- 微软用纯 RL 训出 4B 编码 agent FrogNano,无需大模型当老师 — ossm-me · 2026-09-10