本地跑Qwen3.8-27B编码Agent:Cline+llama.cpp参数配置求推荐
Jagerius · reddit · 2026-08-17
Reddit用户Jagerius正在尝试完全本地化的vibe coding设置,使用Dirk-Qwen3.8-27B-UD-Q4KXL模型(llama.cpp推理)配合Cline和OpenCode,目标是让AI自主完成从模糊想法到代码编写、测试、调试的循环。他询问该组合是否最佳、本地模型能否有效使用子代理、Hermes是否更优、以及推荐的llama.cpp参数(如上下文长度、工具调用设置)。他特别关注完全本地/自托管方案,并分享了自己的启动参数:llama-server.exe -m ... -c 131072 --jinja --spec-type draft-mtp --reasoning-preserve --presence-penalty 0.0 --spec-draft-n-max 7 -fa on -np 1 --cache-type-k q40 --cache-type-v q40 --temp 1.0 --top-p 0.95 --top-k 20 --min-p 0.0 --kv-unified --parallel 1 --cache-idle-slots --alias qwen38。
「编程与Agent」频道最新
- Codex 开启 100 万 token 上下文窗口指南 — soumitrashukla9 · 2026-08-17
- 开源教程:用 VideoSDK 和 SIP 中继构建 AI 电话代理,支持呼入呼出 — tom_doerr · 2026-08-17
- Grok 4.6 登顶 VISTA 基准,将设计稿转应用,单任务成本约 2.38 美元 — XFreeze · 2026-08-17
- 从 Loop 到 Graph:超越单 Agent 的确定性架构指南 — iamrobotbear · 2026-08-17
- M2 MacBook 32GB内存跑通Qwen 3.8 27B:完整教程与实测 — boutell · 2026-08-17
- 用 AI 自动导出 X 书签,半小时找回 5302 条历史数据 — emollick · 2026-08-17