PyTorch 负责人 ezyang:SAC 可细化到单条残差相加粒度
ezyang · x · 2026-09-26
ezyang(PyTorch 核心维护者)分享一个小观察:惯例上稀疏自编码器(SAC,sparse autoencoder)是按 transformer block 粒度应用的,但很多 SAC 策略最终总是保存残差相加(residual add)的结果——由于这些残差输出是 attn/mlp 的唯一输入,因此可以对每个残差相加单独训练 SAC。
所属事件:PyTorch 核心开发者:SAC 粒度可细化到单条残差相加(2 条相关)→
「研究」频道最新
- Claude 无监督跑数天,粒子物理散射振幅计算首破九圈纪录 — AnthropicAI · 2026-09-26
- 「grep 就够了」与「BM25 就够了」两篇论文先后中稿 — lintool · 2026-09-26
- Greenblatt 发文警告:潜空间推理架构将大幅推高对齐风险 — anmarasovic · 2026-09-26
- Huszár 团队发 TLA+ 实战教程:形式化验证非银弹,正用 AI 补齐 — fhuszar · 2026-09-26
- 双层优化利用无标注数据,破解分子性质预测 OOD 泛化难题 — CatAstro_Piyush · 2026-09-26
- 用 Blender 造 1 万+样本,世界模型首次系统性训练客体永久性 — _akhaliq · 2026-09-26