强化学习驱动ATHENA掌握何时调用工具的元认知能力

marinkazitnik · x · 2026-07-07

研究表明,治疗推理中"在得出结论前知道该找什么证据"的能力是可以通过学习习得的。在庞大真实工具集上进行的强化学习是实现这一能力的可行路径。ATHENA的结果显示,这种元认知式的工具调用能力能将模型与"从记忆中自信作答"的模型区分开来,类似于好医生与自信猜测者之间的本质差别。

所属事件:开源医疗AI智能体ATHENA发布:推理准确率超GPT-5(8 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →