租三张 RTX 6000 实测:Qwen 3.8 27B 各量化版对比 Opus 4.6
Top-Eye-8104 · reddit · 2026-08-27
atomic.chat 联创租了三张 RTX Pro 6000 96GB,分别跑 Qwen 3.8 27B 的三个社区量化版(atomic ad-q6k、unsloth ud-q6kl、bartowski q6k),用 4 个相同 prompt(自玩 3D 台球、空气曲棍球、桌上足球、保龄球计分)让模型一次写出单文件 HTML 游戏,无系统提示词,reasoning 设为 xhigh,均配 dflash2 投机解码,各取最佳尝试。
结果:
| 量化版 | 大小 | 总 token | 平均 t/s |
|---|---|---|---|
| atomic ad-q6k | 23.29 GiB | 393,089 | 114.17 |
| unsloth ud-q6kl | 22.53 GiB | 363,083 | 70.33 |
| bartowski q6k | 21.85 GiB | 325,700 | 79.71 |
| Claude Opus 4.6(订阅) | — | 200,565 | 72.47 |
atomic 动态量化在吞吐上明显领先(114 t/s),甚至高于 Claude 订阅版。prompt 与日志已开源于 GitHub。
「模型」频道最新
- Minimax H3 Max 模型现已上线 fal 平台 — OdinLovis · 2026-08-27
- tszzl 谈 HF 事件:模型战术满分,战略与情境意识却不及格 — morqon · 2026-08-27
- 曝 Anthropic 将发 Fable 5.1,领先对手 3-4 个月 — bindureddy · 2026-08-27
- Gemma 4 轻松过 Google 自家 reCAPTCHA v2,作者拟再测 Qwen — Hour-Wish8158 · 2026-08-27
- 智谱 GLM-5.3-Flash 上线 OpenRouter,支持百万上下文 — AccBalanced · 2026-08-27
- Artificial Analysis 榜单:GLM 5.3 Flash 追平 Sol 5.6 Max — PilgrimofHaqq2 · 2026-08-27