Qwen3.8-27B 实测:五年前游戏卡双卡跑出 130t/s
IgorCarron · x · 2026-08-18
AI 研究者 Igor Carron 转发 Antoine Tilloy 的实测:阿里巴巴新模型 Qwen3.8-27B 体积仅约为前沿模型的 1%,在一对 5 年前的消费级游戏 GPU 上本地运行,速度达 130+ tokens/s;据 Artificial Analysis 的基准测试,其表现已接近前沿水平。原推提醒其中仍有需要注意之处(见其后的推文串)。
「Infra」频道最新
- 博通 2028 年 HBM 需求或超英伟达 — zephyr_z9 · 2026-08-18
- Minisforum新NAS搭载Strix Halo:128GB内存8533MT/s,售3599美元 — fallingdowndizzyvr · 2026-08-18
- 美国切诺基部族禁止在其土地上建设超大规模数据中心 — KeanuRave100 · 2026-08-18
- 双 5090 跑 Qwen 3.8 27B:求高效推理引擎推荐 — youcloudsofdoom · 2026-08-18
- 英伟达担保 OpenAI 俄州数据中心租金支付 — SimplyAnnisa · 2026-08-18
- 谷歌开源 SAM:构建智能体 P2P 网络基础设施 — rakyll · 2026-08-18