实测:Qwen3.8-27B 双 3090 完整性能数据与配置分享
No-Statement-0001 · reddit · 2026-08-15
用户分享了在双 RTX 3090 上运行 Qwen3.8-27B (Q8KXL) 的详细实测数据,通过单次 Prompt 生成了一个复古风格的 GeoCities 页面并打包为 Go 二进制文件。
- 生成效果:代码一次生成成功,无需调整,展示了模型在复杂指令遵循和全栈代码生成方面的能力。
- 性能数据:
- 总耗时约 475 秒(含大量思考),处理了约 20k tokens。
- 提示处理速度波动较大(10464 t/s),生成速度集中在 4070 t/s。
- 保留推理 Token 显著提升了结果质量。
- 关键配置:
- 模型:Qwen3.8-27B-UD-Q8KXL.gguf
- 上下文:238000 (因显存限制)
- 推理加速:启用了 draft-mtp 推测解码 (--spec-type draft-mtp),最大草案数 3。
- 参数:temp 0.6, topp 0.95, preservethinking true。
「编程与Agent」频道最新
- Scobleizer:用 AI Agent 追踪 9200 家公司并自动建站 — Scobleizer · 2026-08-15
- Claude Code 桌面版支持直接查看和编辑文件 — EricBuess · 2026-08-15
- Hermes 定时任务应依赖持久化状态而非对话上下文 — alexcovo_eth · 2026-08-15
- 全员普及致 CI 过载:Factory 编码工具内部使用激增 — vikvang1 · 2026-08-15
- 别把所有评估塞进一个LLM裁判:按失败模式分开评判更有效 — randal_olson · 2026-08-15
- 教程:用 Lovable MCP + Claude 10 倍速开发 App — MyCreativeOwls · 2026-08-15