Goodfire 首席科学家谈可解释性:进展扎实且前景令人乐观
leedsharkey · x · 2026-09-04
Goodfire AI 转发其首席科学家(前 DeepMind 研究员 Neel Nanda)在 MLST 播客访谈的片段:他对可解释性研究持乐观态度,原因一是该领域开始取得实质性进展,二是他能想象出「难以置信的加速」前景。完整讨论见 MLStreet Talk 最新一期节目。
「安全」频道最新
- Reddit 热议桑德斯禁超智法案:违规最高判 20 年监禁 — the320x200 · 2026-09-04
- 美议员拟立法禁止超级智能,民调显示多数美国人支持暂停 AI — DavidSKrueger · 2026-09-04
- 无监管下前沿模型风险取决于开发者能力与风险意识错配 — S_OhEigeartaigh · 2026-09-04
- 隐私压力测试:让 ChatGPT 告诉你它掌握了你多少信息 — ifioknkem · 2026-09-04
- 删除前先排序:找出 ChatGPT 记忆里最敏感的信息 — ifioknkem · 2026-09-04
- ChatGPT 在悄悄建你的档案,15 条提示词查清并删除数据 — ifioknkem · 2026-09-04