测试时学习综述:LLM 无需重训如何从交互中持续进化
hyunw_kim · x · 2026-08-24
这篇综述探讨了测试时学习(Test-Time Learning)如何让部署的模型通过持续的读写循环将经验转化为自适应状态,从而随时间推移改善未来的行为,而无需重新训练。
「研究」频道最新
- RL 不止微调 SFT:更长预训练带来更陡峭的 RL 扩展曲线 — gleech · 2026-08-24
- 能取代 LLM?光子计算与储备计算逃逸 O(n²) 困境 — navnt5 · 2026-08-24
- 开源 Pelican SVG 环境,量化评估模型画图能力 — SergioPaniego · 2026-08-24
- 开源透明度新标准:Ling-3.0 公开多阶段 Checkpoint — creditme7 · 2026-08-24
- 17 岁独立预训练模型的少年论文入选 ICML — HanchungLee · 2026-08-24
- 中科紫东太初发布AutoProject:科研智能体从执行Task升级到承接Project — 量子位 · 2026-08-24