MIT 研究:通过正反样本训练提升模型规划能力

mdancho84 · x · 2026-08-27

MIT 研究人员通过使用正确和错误的计划及其解释来训练 LLM,这是提升模型规划能力的基础步骤。结合后续的外部验证机制,该方法旨在解决模型仅做模式匹配的问题。

所属事件:MIT 新方法让 LLM 学会逻辑推理,规划准确率 28% 升至 94%(5 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →