实验室 NeurIPS 发三篇论文:CoT 忠实度指标近乎失效
megamor2 · x · 2026-09-28
作者所在实验室在 NeurIPS2026 发表三篇论文:
- 忠实度元评估:提出首个带 ground truth 的 CoT 忠实度指标 benchmark,发现现有指标要么接近随机、要么计算成本高到不可用。
- LLM 信念形成:将 HOT-3 意识指标结合可解释性工具应用于 LLM,在信念形成与行动选择上发现出人意料的模式,提示信念引导的 agency 与元认知监控迹象。
- MoE 路由几何:发现稀疏 MoE 中 router 学到的结构与其专家的几何耦合,揭示路由器"理解"专家布局的方式。
「研究」频道最新
- Schmidhuber 2008 年论文:好奇心即压缩进度算法 — anselm · 2026-09-28
- LLM 是随机鹦鹉吗?博主重提形式与意义经典论文 — lambdaviking · 2026-09-28
- 学生团队复盘安全事件响应 agent Aegis:记忆是设计决策而非开关 — pranitha95 · 2026-09-28
- 测试 AI 材料推荐时,故意合成一个预测表现差的材料 — bravo_abad · 2026-09-28
- Tau Robotics Delta-0:人形机器人开始自己生成训练经验数据 — CyberRobooo · 2026-09-28
- gnomAD MCP 服务器发布:统一查询三大版本基因变异数据库 — modelcontextprotocol · 2026-09-28