Ilya 押注 TTT 架构:模型测试时动态更新权重

burny_tech · x · 2026-08-14

推文探讨了测试时训练作为大模型新演进方向的价值。有观点认为,Ilya 正在大力推动 TTT 范式,使模型能在推理阶段动态更新部分权重,从而实现持续学习,解决模型跨会话遗忘上下文的问题。

此外,社区也补充了 TTT 的历史脉络:这一概念早期被称为“动态评估”,曾在 RNN/LSTM 时代被使用,甚至早期的 SoTA 压缩算法(如 PAQ-8)也包含类似的权重更新机制。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →