Qwen 27B dense在RTX 3090上跑出40 tok/s,本地AI的浪漫
danbri · x · 2026-08-14
作者分享在RTX 3090上运行Qwen 27B dense模型的体验:3月时35 tok/s,4月提升至40 tok/s,21GB显存占用,可加载完整262k上下文。强调dense模型所有参数参与计算,性能可预测,且无需联网或订阅。认为这是本地AI的典范。
「模型」频道最新
- OpenAI发布GPT-5.6构建者指南:账单从33美元降至1.33美元 — xiaohu · 2026-08-14
- Minimax H3新用户免费次数消失?注册后直接要求订阅 — insanepelican557 · 2026-08-14
- Grok Bot更新至v0.18.0,快速迭代持续 — XFreeze · 2026-08-14
- Qwen3.8-27B即将发布,开发者直呼肝不动 — karminski3 · 2026-08-14
- antirez 质疑 DeepSeek v4 Flash 基准:DSpark 投机解码致结果不可信 — antirez · 2026-08-14
- 实测Qwen 3.8 Max:规划能力突出,擅长简化复杂架构 — RevealIndividual7567 · 2026-08-14