多智能体群蜂几乎无用:切块让 1-2B 小模型召回率从 0.3 升至 0.57

deadatreides1 · reddit · 2026-10-05

作者在 GTX 1660 SUPER 6GB 上做了一组预注册实验:六个 1-2B 小模型组成「苏联设计院式」swarm,处理长上下文抽取任务(每任务 18 条记录挑出符合条件的),并用脚本把输入切成 3 块、每块独立投票、用代码校验 id 剔除幻觉。

关键发现:

实用建议:别把一堆文档一次性喂给小模型;切块跑、用代码而不是另一个模型来校验(作者称 model-as-judge 比想象的更差)。局限:仅 1-2B 模型、单一任务族、40 个任务,更大模型收益预计缩水。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →