NYU研究质疑Anthropic结论:LLM内省证据不足

tallinzen · x · 2026-10-03

Anthropic 此前发表论文称 LLM 具备内省(introspection)能力,能识别并报告自身内部状态。但 NYU 数据科学中心(CDS)的 PhD 学生 Shashwat Singh、副教授 Tal Linzen 与Faculty Fellow Shauli Ravfogel 的新研究认为,现有证据并不足以支持这一结论。该论文将在会议海报环节展示,团队还在 NYU CDS 博客上发布了通俗解读文章。

所属事件:NYU 团队将发文质疑 Anthropic 的 LLM 内省能力结论(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →