KDD 论文揭示 Agent 痛点:多工具长文研究分析易崩溃

0xsachi · x · 2026-08-04

Sentient 研究人员的论文《CryptoAnalystBench: Failures in Multi-Tool Long-Form LLM Analysis》被 KDD 2026 接收。文章指出,当前 AI Agent 虽然能很好地获取数据并查明事实,但在将这些信息综合成真正的长篇研究报告时往往会失败崩溃。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →