机制可解释性新论:LLM 是多声部系统,理解须重新定义

burny_tech · x · 2026-10-02

研究员 Pierre Beckmann 发布一个 11 推线程,提出机制可解释性研究显示 LLM 是「多声部(polyphonic)系统」——类似陪审团,多个内部组件就同一问题并行工作,每个组件贡献部分证据而非单一整体做决定。

这带来一个核心问题:如何判断这样的系统是否「理解」、进而能否被信任?作者主张用单一意识体的标准衡量 LLM 是错的,并提出一种新的「理解」概念来回答这一信任问题。

线程用机制可解释性的内部电路/特征分析作为证据基础,属于对 AI 理解与可解释性的理论性讨论。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →