租三张 RTX 6000 实测:Qwen 3.8 27B 各量化版对比 Opus 4.6

Top-Eye-8104 · reddit · 2026-08-27

atomic.chat 联创租了三张 RTX Pro 6000 96GB,分别跑 Qwen 3.8 27B 的三个社区量化版(atomic ad-q6k、unsloth ud-q6kl、bartowski q6k),用 4 个相同 prompt(自玩 3D 台球、空气曲棍球、桌上足球、保龄球计分)让模型一次写出单文件 HTML 游戏,无系统提示词,reasoning 设为 xhigh,均配 dflash2 投机解码,各取最佳尝试。

结果:

| 量化版 | 大小 | 总 token | 平均 t/s |

|---|---|---|---|

| atomic ad-q6k | 23.29 GiB | 393,089 | 114.17 |

| unsloth ud-q6kl | 22.53 GiB | 363,083 | 70.33 |

| bartowski q6k | 21.85 GiB | 325,700 | 79.71 |

| Claude Opus 4.6(订阅) | — | 200,565 | 72.47 |

atomic 动态量化在吞吐上明显领先(114 t/s),甚至高于 Claude 订阅版。prompt 与日志已开源于 GitHub。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →