美团DiagEvo:用层级错误记忆引导LLM自我进化
meituan-longcat · hf · 2026-09-02
美团 LongCat 团队发布 DiagEvo,通过层级化错误原因记忆与双重置信度过滤,从模型内部失败历史中推导训练方向,实现诊断引导的自我进化,表现优于依赖外部资源的基线方法。
「研究」频道最新
- Loop 推出供应链 AI 基准评测 AuditBench — daniellewis · 2026-09-02
- 3B 模型 TwIL 在形式推理上击败 120B 开源模型 — Socially-great8275 · 2026-09-02
- 用 Q-learning 训练 GDevelop 平台游戏 AI — tristanbob · 2026-09-02
- 谷歌开源 MAPL-EMIT:卫星监测甲烷泄漏准确率 84% — DynamicWebPaige · 2026-09-02
- 研究称 ChatGPT 致全网写作方差下降超 20% — maier_ak · 2026-09-02
- AI 润色正在抹杀语言个性,影响社会诊断 — maier_ak · 2026-09-02