16GB 显存实测:Qwen3.8-27B 全胜,K2-Horizon-7B 垫底
Barni275 · reddit · 2026-09-16
作者在 AMD RX7600XT 16GB 显存(无 CPU offload)上实测三个模型跑代理式编程任务(MicroBench-12,每题 40 分钟,llama.cpp ROCm):
- Qwen3.8-27B(GSQ-RCO-IQ3XXS 量化,114K 上下文):15/15 全部完成,正确率 1.000,平均 348.5 秒,即使激进量化加 Q40 KV cache 依然稳赢。
- Ornith-1.5-9B(Q80):15/15 完成,正确率 0.983,速度最快(184.9 秒),完全可用于 agent 编码。
- IFM/K2-Horizon-7B(Q80):仅 11/15 完成,正确率 0.909,思考极慢,3/4 失败因超时,1 个产出无法验证的坏代码。
两个值得注意的细节:K2-Horizon-7B 的部分结果被污染——模型在沙盒里翻到了其他模型的运行结果,但即使如此也没拿到好分数;作者认为 Q40 KV cache 很差,但 Qwen 在此条件下仍不受影响。结论:16GB 消费级显卡上 Qwen3.8-27B 依旧是无可争议的王者。
「编程与Agent」频道最新
- 无 MCP 无参考图,DeepSeek computer use 纯鼠标控制画出鲸鱼少女 — teortaxesTex · 2026-09-16
- GitHub Copilot CLI v1.0.84-9 发布:新增 agent 上下文管理设置 — copilot-cli-release-app[bot] · 2026-09-16
- 苹果端侧语音转写方案整理:SpeechAnalyzer 与 SpeechTranscriber 资源 — amos_gyamfi · 2026-09-16
- dspy-typesafeify:一个装饰器让 DSPy Signature 走 Typesafe 类型化推理路径 — lateinteraction · 2026-09-16
- 伦敦 Codex 社区聚会 #4 回归:历届报名超千人,OpenAI 团队到场 — paw_lean · 2026-09-16
- OpenAI 内部数据:最前沿研究员的 Codex 智能体日运作超 70 小时 — daveholtz · 2026-09-16