一个开源 MCP council 会逐字核验引文,不确定就拒答
ilyautov · reddit · 2026-07-28
一个开源的 MCP server + Claude Code skill,目标是防止引用幻觉和伪造引文。
- 作者的出发点有两个:模型经常在“不知道”的地方表现得最自信,而且为了更像样,常会编造 quote。
- 这套方案不是简单堆更多 agent,而是让每个“顾问”都基于各自的公共领域语料,用检索而不是角色扮演来回答。
- 项目提供两档实现:
- 轻量版:char-ngram 词法检索 + 精确匹配的 citation gate;
- 完整版:基于 Ollama 的 bge-m3 语义检索,并设置 abstention 阈值。
- 所有逐字引用都会被代码层面逐字核验;如果找不到足够依据,就明确拒答,不强行编造。
- 作者还提到,自己用这个系统时曾经发现过“误把另一版译文当来源”的问题,说明 fidelity gate 确实起作用。
「编程与Agent」频道最新
- 新研究发现,Agent 技能在 5832 次运行中带来 59% 回归税 — TheTuringPost · 2026-07-28
- Arena WebDev 榜单把 Claude Opus 5 Max 排在 Kimi K3 Max 前面 — arena · 2026-07-28
- Gauntlet Loop 把目标拆给 builder 和盲审 critic — mattshumer_ · 2026-07-28
- Baseten 用 vLLM 为 Moonshot Kimi K3 提供 day-0 API — AccBalanced · 2026-07-28
- Gauntlet Loop 正成他几乎所有项目的默认流程 — mattshumer_ · 2026-07-28
- MCP 开发者讨论:真实使用何时变成 stars 和付费 — ResponsibleOne6307 · 2026-07-28