实测 Qwen 3.8 27B 在双 5060 TI 上达 50-60 t/s
chocofoxy · reddit · 2026-08-18
用户在两张 RTX 5060 TI 16GB 显卡上以 Q4 量化运行 Qwen 3.8 27B 模型,测得速度为 50-60 t/s (MTP)。这比此前 Qwen 3.6 的 30 t/s 表现更快,用户推测可能是模型优化或系统环境(Linux vs Windows)差异所致。
「模型」频道最新
- Anthropic 下一代模型 Mythos 升级幅度或仅算“微跃” — haider1 · 2026-08-18
- Google One 还是 Code Assist?小企业主纠结每日 1500 次请求额度 — innovaldragon · 2026-08-18
- 模型太聪明读不懂:用户称被迫改用「更笨」的模型协作 — AashaySachdeva · 2026-08-18
- Muse Spark 1.2 发布:宣称触及成本智能前沿 — zainhas · 2026-08-18
- LiquidAI 推出 3B 参数多模态模型,支持 WebGPU 部署 — LiquidAI · 2026-08-18
- McByte 模型在 SportsMOT 基准测试中刷新SOTA — NielsRogge · 2026-08-18