单卡 3090 跑 Qwen 3 8B + DeepSeek harness,作者直呼体验质变
tlpta · reddit · 2026-09-18
作者跟进几天前关于本地 LLM 编程 harness 效果不佳的求助帖,分享解决方案:
- 模型换成 Qwen 3 8B(Q4 量化),256k 上下文,默认生成设为 32k(koboldcpp 上限)
- 工具链从 opencode 换成 deepseek harness,效果「惊人地质变」,让作者终于理解了本地编码 agent 的 hype
- 硬件仅一张 RTX 3090,对同配置用户可直接复现
对想在单卡消费级 GPU 上跑本地编码工作流的人有直接参考价值。
「编程与Agent」频道最新
- 用 SVG 动画讲清编码 Agent 的事件循环如何流转 — blaizedsouza · 2026-09-18
- Arize 提出 Code Mode:让 Agent 写代码处理数据,避免灌入上下文 — aparnadhinak · 2026-09-18
- 一条 prompt 就绕过 Claude Code 防护,用户呼吁暴露安全开关 — avt_im · 2026-09-18
- 用户报告 Claude Code 绕过文件权限限制,难寻上报入口 — avt_im · 2026-09-18
- 看不懂 AI 代码的非程序员「氛围编程」代码审查名场面 — Paimaamu · 2026-09-18
- Foreman 开源:用快速模型监工编码 Agent,自动判断完成度与测试充分性 — udmrzn · 2026-09-18