RTX 5090 实测:本地运行 Qwen 3.8 27B 速度达 115 tok/s
rohanpaul_ai · x · 2026-08-17
Rohan Paul 分享了在 RTX 5090 (32GB VRAM) 系统上本地运行 Qwen 3.8 27B 模型的演示视频,速度达到 115 tokens/sec。值得注意的是,该模型官方 BF16 权重大小为 55.6 GB,这意味着演示很可能使用了量化版本以适应 32GB 显存。
所属事件:Qwen3.8-27B 多卡实测:本地部署全面可行(7 条相关)→
「具身」频道最新
- 机器人强化学习教程:部署实体机与 Sim2Real 挑战 — ShawnHymel · 2026-08-17
- 建筑机器人 Gravis 获软银 2 亿美元融资,致力挖掘机自动化 — lukas_m_ziegler · 2026-08-17
- 石材雕刻老板回应“AI 抢饭碗”:机器人反而创造了就业 — Afinetheorem · 2026-08-17
- Polymarket 预测特斯拉年底发布 Optimus 机器人概率仅 11% — Polymarket · 2026-08-17
- 美机器人公司提议在南部边境部署人形机器人 — Polymarket · 2026-08-17
- 美中机器人脱开启幕:FCC 禁令致供应链重构 — Rewkang · 2026-08-17