实测 Qwen 3.8 配置:n-max 4 速度最快
GodComplecs · reddit · 2026-08-31
在 RTX 3090 上对 Qwen 3.8 UD Q4 KM 模型进行测试,发现 n-max 4 搭配 spec draft min p 0.7 在 harness 工作流中速度最快。配置支持 205k 上下文且开启 Flash Attention。实测显示该设置下测试生成速度达 70 tks,优于此前的 mtp2 配置。
「编程与Agent」频道最新
- GitHub 热门:安全技能路由包,自举进化工具链 — udmrzn · 2026-08-31
- 11 万行 AI 代码不腐化:Mole 作者的六条 Vibe Coding 工程法 — dotey · 2026-08-31
- 未来编程语言将优先为 LLM 设计而非人类 — jfischoff · 2026-08-31
- 多Agent团队协作编程工具实测:Tutti与Paseo谁更强? — Careless_Cress_865 · 2026-08-31
- 新版 Claude Code 启动速度提升 20% — BLUECOW009 · 2026-08-31
- AI 训练时 LFS 暂停会中断训练,将增加配置进度条 — janusch_patas · 2026-08-31