新方法 Chain-of-Experience 实现持续 LLM 改进
UCSC-VLAA · hf · 2026-08-21
提出 Chain-of-Experience (CoE) 框架,通过迭代测试时反馈循环来持续改进大语言模型。该方法在成本更低、Token 效率更高的情况下,优于零样本基线。
「研究」频道最新
- 研究揭示 ASR 模型存在“针对基准优化”问题 — HumeAI · 2026-08-21
- SWE-bench Science 发布:测评智能体修复科学软件能力 — OpenMOSS-Team · 2026-08-21
- 斯坦福论文:用测试时回归统一注意力与状态空间模型 — burkov · 2026-08-21
- Qwen3.8-27B 优化实录:速度飙升至 153 tok/s — TrifleHopeful5418 · 2026-08-21
- SONIC 新版机器人 checkpoint 开源,腕部精细操作精度大增 — zhengyiluo · 2026-08-21
- 中港团队开源 Libra,智能体训练吞吐提升 3 倍 — jiqizhixin · 2026-08-21