个人研究 Agent 强制引用来源,再用 LLM 裁判剔除不合格引用
FreakFrakFrok · reddit · 2026-10-07
一位开发者构建了个人研究 Agent:只从用户指定的来源(新闻站、咨询公司、公司官网、YouTube 频道)检索并回答,每个答案必须附引用,再由第二个 LLM 充当裁判逐条核对引用是否真正支持论断,支持弱则重试并剔除不成立的引用。
架构上有几个值得注意的设计:
- 基于队列的 LLM 任务:Web 应用只负责入队,worker 跑本地模型处理(SKIP LOCKED、多副本),便宜且私密,代价是没有 token 流式输出,只能轮询状态。
- 用「spaces」做记忆:用户把笔记、视频、文档存入 space,Agent 之后与订阅源一起检索。
作者公开征集破解测试:找错误引用、该说「不知道」却硬答的场景、队列轮询是否太慢等,深度测试者额外获得 15,000 credits。
「编程与Agent」频道最新
- 用 Hermes 搭 AI 销售陪练:语音买家施压砍价并逐次打分 — tomcrawshaw01 · 2026-10-07
- Ampersand 推企业 agent 集成层,服务 11x 与 Square 对接 Salesforce — hey_abusiddik · 2026-10-07
- Garry Tan 晒并行线程编程工作流:Capy 跨线程协调被称 SOTA — garrytan · 2026-10-07
- CUAWright 论文:只用终端命令,computer-use agent 胜过 GUI 方案 — ysu_nlp · 2026-10-07
- 受够 Wispr Flow 订阅费,开发者开源 Linux 语音输入工具 AutoType — premakin · 2026-10-07
- 开源 Oil UI Skill 把 AI 界面设计推到极限,已揽 772 星 — algo_diver · 2026-10-07