推理模型学习困难?Tilde 研究团队发起 One Layer Deeper 竞赛

AashaySachdeva · x · 2026-08-23

Tilde 研究团队发布博客,探讨当前推理模型通过生成更多 token 来扩展顺序计算的限制。这种方法强制某些中间计算通过生成的 token 而非完全在模型的潜在状态内更新,可能人为地串行化本可以并行执行的计算。博客提出替代架构可以通过增加潜在深度来扩展计算,但这类模型往往更难训练。团队宣布发起 "One Layer Deeper" 竞赛(截至 2026 年 8 月 31 日),研究架构、目标和优化器是否可以共同设计来学习更深的串行计算,并训练中见过的推理深度之外进行有意义的推断。竞赛将使用重复模块平方作为公开任务。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →