字节新论文:保留尝试历史优于摘要记忆
字节跳动发布新论文,提出测试时优化方法Chain-of-Experience,研究Agent迭代求解时如何处理历史尝试。与直觉相反,实验发现在上下文中保留完整凌乱的尝试历史和反馈信号,比将其压缩为简洁摘要记忆更有效,反而更省成本,并在数学、编程等任务上使LLM推理性能提升4.2%。
2026-08-31 ~ 2026-08-31 · 3 条相关
- 字节跳动新论文:保留尝试历史优于摘要记忆 — rohanpaul_ai · 2026-08-31
- 字节论文:保留尝试历史胜过总结,LLM 推理提升 4.2% — rohanpaul_ai · 2026-08-31
- 字节CoE论文:保留完整尝试历史反而比压缩更省钱 — AGI Hunt · 2026-08-31