ICML 可解释性讲座追问机制可解释性究竟为了什么
ericjmichaud_ · x · 2026-07-25
- Eric J. Michaud 说,他在今年 ICML 机制可解释性 workshop 的闪电演讲,最终变成了一场更高层次、也更个人化的思考。
- 他已经把这次分享整理成博客文章。
- 配图里的幻灯片显示,这个报告主要在回答:可解释性到底是为了什么,并把目标分成两层:
- 描述一个网络学到了什么算法;
- 解释为什么网络会学到这个算法。
- 他还把可解释性和“数据结构、世界结构以及人类思维结构之间的关系”联系起来,明显不是一般科普式随笔。
「研究」频道最新
- RL 持续提升 Agent 想象力模型,Photon-1 性能反超 Gemini — ycombinator · 2026-07-25
- 有人想从一张照片生成不变姿势的侧面和背面图用于 3D 建模 — LoudPoem9492 · 2026-07-25
- 陶哲轩幻灯片称 AI 时代论文更要重视阐述而非只拼证明 — AlexKontorovich · 2026-07-25
- Lean 形式化验证 Gowers 团队的锐利 product-free 定理 — satnam6502 · 2026-07-25
- 审计发现前沿模型文档谈多视角,却没人明确写 pluralism — evijit · 2026-07-25
- HoPE 提出不随时间衰减的位置编码,增强长上下文能力 — burny_tech · 2026-07-25