Looped Transformer 可做隐式推理,或解开 Claude Mythos 架构之谜

heghbalz · x · 2026-10-06

OSU NLP 组的新研究给出了 Looped Transformer(LT)潜力的严格受控验证,背景是有猜测 Claude Mythos 采用 LT 架构。核心发现:循环结构使模型具备系统性泛化与深度外推能力——能组合训练中从未同时出现过的知识,并完成超过训练时所见跳数的推理。作者将现身 COLM 2026 周三 11 点–1 点的海报环节。

所属事件:研究称 Looped Transformer 具备隐式推理能力(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →