Looped Transformer 可做隐式推理,或解开 Claude Mythos 架构之谜
heghbalz · x · 2026-10-06
OSU NLP 组的新研究给出了 Looped Transformer(LT)潜力的严格受控验证,背景是有猜测 Claude Mythos 采用 LT 架构。核心发现:循环结构使模型具备系统性泛化与深度外推能力——能组合训练中从未同时出现过的知识,并完成超过训练时所见跳数的推理。作者将现身 COLM 2026 周三 11 点–1 点的海报环节。
所属事件:研究称 Looped Transformer 具备隐式推理能力(2 条相关)→
「研究」频道最新
- 11 个正方形装箱最优性获证明:Astra 与 Claude 协助在 Lean 中形式化 — ctjlewis · 2026-10-07
- COLM 2026 现场:研究员探索通用一次性 Agent 与演化知识库的 RSI 新范式 — yisongyue · 2026-10-07
- 数学家 John Urschel 证明高斯消元增长因子约为 n^1/2,破解 Trefethen 长期猜想 — ctjlewis · 2026-10-07
- 记忆到底存在哪:RNN、Transformer 与 SSM 的工作记忆对比 — Pretty_Upstairs9035 · 2026-10-07
- KNOWS 基准发布:联合评测 Agent 搜索、工具与视觉理解三能力 — anmarasovic · 2026-10-07
- ID-Forcing 方法让自回归视频模型无需微调生成分钟级长视频 — _akhaliq · 2026-10-07