Qwen 2.5 27B 登陆 RTX 5090,推理速度超 100 tok/s
Hesamation · x · 2026-08-18
实机演示显示,Qwen 2.5(推文中误标为 Qwen 3.8)27B 模型在 NVIDIA RTX 5090 显卡上本地运行,推理速度超过 100 tok/s。这表明半年前的前沿模型性能如今已在消费级硬件上触手可及。
「Infra」频道最新
- AI Token 用量激增 1139%,成本骤降 55% — AccBalanced · 2026-08-18
- BNEF 报告:美电力缺口将致 430 亿瓦芯片闲置 — AccBalanced · 2026-08-18
- 数据中心建设难或致芯片过剩,业内担忧 — AccBalanced · 2026-08-18
- Qwen 3.8 27B FP8 量化效果遭质疑: 性能不如 Q8_0? — lblblllb · 2026-08-18
- 实测发现 Unsloth 版 Qwen 3.8 长上下文会崩坏 — Healthy-Nebula-3603 · 2026-08-18
- 基础设施决定深网潜力:快速构建与测试是关键差异化因素 — chris_j_paxton · 2026-08-18