IIT 德里 4 篇 NeurIPS 2026 主会论文:多语言可解释性与蒸馏新方法
Tanmoy_Chak · x · 2026-09-27
IIT 德里 Tanmoy Chakraborty 团队宣布 4 篇论文全部入选 NeurIPS 2026 主会,覆盖多语言 LLM 可解释性、知识蒸馏与个性化:
- 多语言可解释性:The Fractured Interlingua——用 ROME/MEMIT 等方法在英语中编辑知识后,印地语/乌尔都语/中文约 90% 所需更新的方向是英语更新够不到的;论文证明约 96% 的目标残差方差是语言私有的,仅对齐表示空间只能打开"键空间"门而打不开"值空间"门。
- 知识蒸馏:CaRE-KD——逐 token 门控在 Forward/Reverse KL 间切换(依据师生置信度),并用 BALD 规则在"教师不确定、学生自信"时跳过更新;8 组师生对、11 个基准上相对 Skewed-KL 等方法有一致但温和的增益,计算开销较高。
- 个性化:通过交互感知的表示修正恢复持续演化的用户偏好状态。
「研究」频道最新
- 未学过自然语言的「新型心智」写 GPU kernel:28% 通过率、提速最高 66 倍 — repligate · 2026-09-27
- ENGRAM 内存架构或重塑数据中心 DRAM/HBM 配比,省下数十亿美元 — AccBalanced · 2026-09-27
- 从像素到视觉 token:一文讲清 LLM 如何「看」图像 — makaros622 · 2026-09-27
- Spatial-Interactor:让 VLM 像婴儿一样通过交互学会空间推理 — arankomatsuzaki · 2026-09-27
- DeepMind 研究员析 AI 未撼动物理学:真突破需人类知识凸包外洞见 — DaniloJRezende · 2026-09-27
- WTF 框架微调流模型,奖励对齐训练算力最高省 280 倍 — yeewhye · 2026-09-27