想用 LLM wiki 消化 10 万篇 IBS 论文,作者求 editorial policy 经验
gintrux · reddit · 2026-09-21
一位 Reddit 用户发起讨论:如何让 AI 从超过 10 万篇 IBS(肠易激综合征)论文中挖掘可能被忽视的干预手段,组合出多角度「干预鸡尾酒」。核心难点是没有任何 agent 能把全部论文塞进单一上下文,需要把文献合成为压缩的知识表示(所谓 LLM wiki),供下游低成本检索与关联发现。
他指出 Wiki 摄取过程中充满编辑决策(新建页面、改写、重命名、记录关系等),因此需要明确的 editorial policy,否则只能寄希望于模型自身智能。作者还给出了一条完整流水线:从 PubMed 导出列表、下载开放获取 PDF(必要时借助盗版书库)、无限 OCR 转 Markdown、每批 25 篇并行——每篇一个 agent 在独立 worktree 中摄取,批末由 reconciliation agent 汇总 diff 合并到 main。他在求购他人的 editorial policy 实践经验。
「编程与Agent」频道最新
- Kimi 推出 Code Desktop:多 Agent 并行的编程桌面客户端 — KimiDevs · 2026-09-21
- Rodin 生成 3D 乐器,GPT-6 四步做出可交互演奏网站 — CurieuxExplorer · 2026-09-21
- AI Agent 管理或成下一代 IAM:身份、权限、记忆缺一不可 — ingliguori · 2026-09-21
- Gergely Orosz 调研百余家科技公司:大厂普遍弃用 Scrum — blaizedsouza · 2026-09-21
- 开源工具 Cobro:指哪改哪,让 Claude Code 直改页面元素 — boonblade · 2026-09-21
- AutoClip 开源智能高光剪辑工具,一周冲上近 8000 星 — zhouxiaoka · 2026-09-21