NYU研究质疑Anthropic结论:LLM内省证据不足
tallinzen · x · 2026-10-03
Anthropic 此前发表论文称 LLM 具备内省(introspection)能力,能识别并报告自身内部状态。但 NYU 数据科学中心(CDS)的 PhD 学生 Shashwat Singh、副教授 Tal Linzen 与Faculty Fellow Shauli Ravfogel 的新研究认为,现有证据并不足以支持这一结论。该论文将在会议海报环节展示,团队还在 NYU CDS 博客上发布了通俗解读文章。
所属事件:NYU 团队将发文质疑 Anthropic 的 LLM 内省能力结论(3 条相关)→
「模型」频道最新
- Spotlight 架构引热议:注意力记忆能力配线性成本遭质疑 — teortaxesTex · 2026-10-03
- 用 Opus 5.5 一句话生成写实战斗机游戏,效果惊人 — TAbrodi · 2026-10-03
- Perplexity 连发七个开源项目:SoTA 决策模型、端侧 PII 分类器与安全工具 — AravSrinivas · 2026-10-03
- 幻觉到底在改善还是触顶?Reddit 热帖追问 AI 可靠性天花板 — maedhros256 · 2026-10-03
- VSA 方案号称可注入 DeepSeek 系模型,10 万 token 推理提升 9.5 分 — teortaxesTex · 2026-10-03
- 微软开源 FrogNano-4B:为穷人卡用户打造的仓库级编程 Agent 模型 — jacek2023 · 2026-10-03