ICLR 2026 论文:带可证保证的自动化电路发现
CatAstro_Piyush · x · 2026-08-19
这篇 ICLR 2026 论文《Formal Mechanistic Interpretability》将形式化验证引入机械可解释性。作者提出了一套自动化算法,为发现的电路提供可证保证,包括输入域鲁棒性、鲁棒修补和最小性。实验表明,这些算法能产生比标准方法鲁棒性更强的电路。
「研究」频道最新
- Muon 优化器将 nanoGPT 训练缩至 1.23 分钟 — dianarycai · 2026-08-19
- MarinDNA 1B 模型性能匹敌 Evo 2 40B,算力省 1980 倍 — anshulkundaje · 2026-08-19
- Nori 表格大模型:无训练回归,合成数据预训练 — rohanpaul_ai · 2026-08-19
- Synthefy 发布 Nori V1:开源表格基础模型,号称替代 XGBoost — rohanpaul_ai · 2026-08-19
- MIT 研究员:预注册可平衡数据探索与虚假结果风险 — RobbWiller · 2026-08-19
- MIT 等机构推出公共 AI 观测台,审计真实 AI 使用情况 — ShayneRedford · 2026-08-19