Simplex 新研究:LLM 激活中的信念几何呈「套叠锥形」结构

fatihdin4en · x · 2026-09-11

Simplex 团队在 LessWrong 发布关于 LLM 内部表征的新工作(非各态历经/nonergodic 视角):训练数据由众多来源混合而成,研究探讨此时激活应呈现什么结构,发现数据上的信念几何会形成「套叠锥形」(telescoping cones),且 transformer 确实表征了这种结构。

作者特别邀请社区讨论,认为这项工作对关注模型内部机制(model internals)理解的人尤其有价值。

所属事件:Simplex 研究:LLM 激活中存在「伸缩锥」信念几何结构(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →