用本地 Gemma 搭规划-执行-审查四 Agent 网络研究流水线
HlddenDreck · reddit · 2026-09-03
一位开发者在 Reddit 分享其用本地模型构建的网络研究 agentic workflow,并询问他人经验:
- 模型分工:Gemma-4-31B-IT-QAT(120k 上下文,unsloth 量化)负责规划、审查与编排;Gemma-4-12B-IT-QAT(256k 上下文)负责执行,小模型跑小任务避免上下文压缩。
- 工程实现:基于 opencode 写了 4 个 agent。流程为:Orchestrator 接收请求 → Planner 先做几次 web search 甄选信源并写计划 → 计划拆分为批次(batch),Orchestrator 逐批调用 Executor → 合并后由 Critic 检查信源,发现缺漏则回到 Planner 生成修复计划,最多循环 3 次。
- 效果与问题:顺利时比全用 31B 模型更快(正常任务 8-10 分钟),但稳定性不足——同一任务结果可复现性差,有时耗时膨胀到 1 小时。作者征求同类工作流的成功经验。
这是一个典型的「大模型规划 + 小模型执行 + 批次拆分控上下文」的本地 agent 架构实践,其稳定性问题与迭代修复设计对做本地研究 agent 的开发者有参考价值。
「编程与Agent」频道最新
- 不会写代码的农民只用手机:零信任方法论在 Termux 里管数十万行 AI 代码 — amadale · 2026-09-03
- 多智能体调试痛点:逐 agent 日志难还原决策链,需要统一 trace 视图 — mageblex · 2026-09-03
- OpenAI CUA 示例应用新增 JS/Python 两套计算机操作环境镜像 — ChrisGPT · 2026-09-03
- 2 小时纯 vibe coding 复刻 Opera Neon:本地异构算力驱动的 agentic 浏览器 — comperr · 2026-09-03
- ComfyUI 插件把 MiniMax H3 编码缓存到磁盘:命中仅 1.12 秒、内存省 14GB — Any_Fee5299 · 2026-09-03
- 开源编码 Agent Pi 破 10 万 GitHub Star,v2 即将发布 — gklambauer · 2026-09-03