27B 本地模型够用后他停掉了 API:Qwen 编码实测与成本账
Training-Respect8066 · reddit · 2026-09-24
Reddit 用户分享用本地部署的 Qwen 编码模型(27B)替代 API 的完整实践:
- 用量要点:模型要大量思考,看着它干活很痛苦,最好的方式是让它无人值守地跑;实测它能独立完成复杂重构并做出合理决策。
- 配置:量化用 Q4KS,上下文量化到 Q80;试过 Swift-Qwen 更快但容易陷入循环,原版 Qwen 很少出现。agent 用 Pi,不开 MCP,只留 bash 加读写编辑工具;编辑工具是最弱一环,模型常因缩进错误重试。沙箱用 Docker,agent 甚至跑在树莓派上。
- 成本:本地算下来 1M 输入 token 约 2.4 美分、输出 70 美分,与 nano-gpt.com 上最便宜的 API 提供商相当。
「编程与Agent」频道最新
- Next.js 预告 9 月 30 日安全更新:一次修复 9 个漏洞 — cramforce · 2026-09-24
- 观点:Agent 时代的核心是学会描述目标而非下达任务 — manosaie · 2026-09-24
- 开源 WorkSwarm:5 人共享一个 Agent 跑 189 轮,SWE-bench Lite 提升至 87% — HeyZoyaKhan · 2026-09-24
- 开发者自建 44 个专有工具,称工具组合让 agent 远超裸模型 — D3VAUX · 2026-09-24
- 开源项目用 AI 逐个逆向解构老游戏,首批已覆盖 7 款 C64 经典 — Vjeux · 2026-09-24
- RTX 3060 12GB 本地跑 27B 三值压缩模型,AI 五小时零手写代码做出整个游戏 — mishig25 · 2026-09-24