COLM 2026 论文质疑:LLM 内省能力主张证据不足
tallinzen · x · 2026-09-09
一篇被 COLM 2026 接收的论文(由 @shashwats19 领衔,与 @ravfogel、@tallinzen 合作)对「LLM 能否内省」这一近期热门结论提出质疑。
- 近期有研究声称 LLM 能察觉自己的「思维」被篡改并报告其内容,即具备内省能力;
- 该团队仔细检验后认为,按公认的内省定义所隐含的证据标准,这些近期工作并未满足其举证义务,下结论为时过早;
- 论文的核心贡献是形式化了常用内省定义所要求的证据负担,并据此评估已有实验设计。
结论:对「LLM 已具备内省能力」的说法应持保留态度。
「模型」频道最新
- K2 Horizon 开源六个规模模型,0.9B 版 AIME 拿 48.5 分 — kimmonismus · 2026-09-09
- IFM 开源 K2 Horizon 全家桶:6 个尺寸、每模型 20T tokens、连 reward-hacking 审计都公开 — kimmonismus · 2026-09-09
- IFM K2 Horizon 全家桶:0.9B到375B六款模型一套工具链 — kimmonismus · 2026-09-09
- IFM K2 Horizon:六款模型组成舰队,训练全程可检视 — kimmonismus · 2026-09-09
- 开发者上线聚合站,汇集 OpenAI 纳维-斯托克斯证明各方表态 — NathanpmYoung · 2026-09-09
- kalomaze 澄清:AI公司并非直接拿用户记录训练,靠的是诊断 — kalomaze · 2026-09-09