本地模型能否当云端编排的子代理
neeeser · reddit · 2026-07-21
这个帖子在问:能不能把本地模型当子代理,由云端前沿模型来统一编排。
- 作者最近在用 Fable 和 Codex,但频繁撞到使用额度限制。
- 之前的做法是让 Fable 去调用 Codex 当子代理,用两个系统分摊负载。
- 现在他想改成:在 4090 上跑一个本地 Qwen3.6-27B,专门当便宜的“干活工人”,而高层推理和调度仍交给前沿模型。
- 他想知道这种分工在 Claude Code 或 Codex 里怎么做得可靠,以及大家都在用什么 harness / 插件 / 本地模型,去处理代码库探索、窄任务实现、研究等琐碎工作。
「编程与Agent」频道最新
- Coding agents 正走向 AI 写、AI 审、人工批的流程 — aftahi_ai · 2026-07-22
- oMLX 0.5.2 增加菜单栏统计和低比特解码内核 — awnihannun · 2026-07-22
- GitHub 机器人审到上限,PR 还要等 39 分钟 — DanielLockyer · 2026-07-22
- Codex Remote 的 Max 推理强度疑似只在移动端开放 — GabGarrett · 2026-07-22
- 有人用 MCP 做了个 demo,主张商店应把价格和购物车开放给 AI — gelembjuk · 2026-07-22
- 开源 AI SDK provider 让 Vercel 应用接入本地 Codex 订阅 — lgrammel · 2026-07-22