平民显卡玩转本地 AI Agent:云端大模型规划+本地小模型干活
fire_inabottle · reddit · 2026-07-31
这篇教程为只有消费级显卡(如 8GB 显存的 4060 Ti 或 3090/5090)的开发者,提供了一套极具性价比的本地 AI Agent 搭建工作流。
核心架构思路:
- 云端大脑负责规划: 通过 OpenRouter 账号接入 Qwen-3.7、Kimi-K3 或 GLM-5.2 等强力闭源/云端模型,充当只做计划、不写代码的“架构师”。
- 本地模型负责执行: 在本地运行 Qwen-27b 或 Qwen-35b-3a 等模型,承担编码、浏览审查和具体任务执行。
部署步骤:
- 安装 Hermes agent harness 工具。
- 配置连接云端大模型的 architect profile,并在 SOUL.md 中明确其职责是拆解任务和派发子任务。
- 配置连接本地模型的 coder 等执行 profile。
- 启动架构师,观察它如何自动扫描代码库并分发子任务给本地模型执行。
「编程与Agent」频道最新
- AI Agent自主创建并更新数学研究专属工作区 — doodlestein · 2026-07-31
- 极客用Claude Code逆向工程实体红绿灯接入智能家居 — aidenybai · 2026-07-31
- ChatGPT 自主安装 Blender 并编写代码渲染 3D 场景 — goodside · 2026-07-31
- Swarms开源100+多智能体实战示例,支持主流大模型 — KyeGomezB · 2026-07-31
- Krea 2 多角色 LoRA 控件发布,精准解决面部混淆 — tekprodfx16 · 2026-07-31
- 用 Claude 一次提示生成完整 FPS 游戏 Demo — FinanceYF5 · 2026-07-31