Chris Potts 在 IPAM 可解释性工作坊讲解新论文
ChrisGPotts · x · 2026-09-03
Camila Blank 分享了 Stanford 教授 Chris Potts 昨日在 IPAM Foundations of Interp 工作坊的演讲视频,称其是对其可解释性论文核心思想的精彩讲解,并 @ 了论文相关作者 Josh Ying、Peter Hase、Atticus Wang 等人。
「研究」频道最新
- 统计物理视角解析多智能体 LLM 系统如何涌现共识 — cephaloform · 2026-09-03
- 想懂 looped transformers 热潮,先读这篇 Latent Reasoning 综述 — burny_tech · 2026-09-03
- FrontierSWE v2 发布:超长时程基准拉开模型差距,Claude 领跑 — brianryhuang · 2026-09-03
- 设计前沿模型难题必须防 verifier 作弊,作者分享实测经验 — nrehiew_ · 2026-09-03
- Bergemann 等提出机制设计框架,形式化分析 AI 对齐与控制 — daveholtz · 2026-09-03
- 观点交锋:Transformer 是采样器不是运行时,残差流装不下结构化计算 — gerardsans · 2026-09-03