利用小模型子智能体优化上下文工程与 RAG 成本

samsamy7 · reddit · 2026-08-25

作者提议使用 3B 或更小的小模型作为“子智能体”处理上下文工程,代替主智能体进行低效的文件检索或 RAG 向量库查询。这种小模型可在本地快速运行,提取关键数据后传回主智能体,从而大幅降低 Token 消耗和成本。作者询问业界是否已有类似实践及其可行性。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →