论文写作 Agent 爆 token 又编数据,作者复盘四项关键修复

Altruistic-Video-849 · reddit · 2026-09-20

背景

作者搭建了七步 LangGraph 工作流,撰写带引用的研究论文,并接入 Groq、OpenAlex 与 Crossref 实测。假数据测试全过,真实运行却暴露四类问题:

剩余短板与开放问题

引用已在代码层对照 Crossref 校验,主题与论题由人审批后才起草。但作者坦承未测量:论文质量本身,以及每个句子是否忠实于来源——目前只靠一个 LLM 审稿人判断,这不算证据。他正在考虑句级蕴含检查,并向社区征集:如何不用"再问一个 LLM"来验证论断与引用来源的一致性?

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →