想用 LLM wiki 消化 10 万篇 IBS 论文,作者求 editorial policy 经验

gintrux · reddit · 2026-09-21

一位 Reddit 用户发起讨论:如何让 AI 从超过 10 万篇 IBS(肠易激综合征)论文中挖掘可能被忽视的干预手段,组合出多角度「干预鸡尾酒」。核心难点是没有任何 agent 能把全部论文塞进单一上下文,需要把文献合成为压缩的知识表示(所谓 LLM wiki),供下游低成本检索与关联发现。

他指出 Wiki 摄取过程中充满编辑决策(新建页面、改写、重命名、记录关系等),因此需要明确的 editorial policy,否则只能寄希望于模型自身智能。作者还给出了一条完整流水线:从 PubMed 导出列表、下载开放获取 PDF(必要时借助盗版书库)、无限 OCR 转 Markdown、每批 25 篇并行——每篇一个 agent 在独立 worktree 中摄取,批末由 reconciliation agent 汇总 diff 合并到 main。他在求购他人的 editorial policy 实践经验。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →