5t/s 的本地模型算能用吗?Reddit 网友实测 27B 模型
Zombiecidialfreak · reddit · 2026-09-10
Reddit 用户分享在本机跑 Qwen3 27B 的两种方式:3060 12GB + 9070XT 显卡拆分推理可达 20t/s;或用 780m iGPU + 5400MHz DDR5 纯 CPU/核显推理仅 5t/s。作者认为 5t/s 反而更实用——显存/CPU 占用低,系统仍能正常用、甚至能玩游戏,代价只是回答慢 4 倍。评论区讨论本地推理速度的可用性门槛。
「Infra」频道最新
- Keras 推出 ZeroModels:100+ 模型族纯 Keras 3 跨后端运行 — fchollet · 2026-09-10
- Cohere 迁移 Blackwell,多项负载 token 成本与延迟降 30–50% — cohere · 2026-09-10
- 作者用本地 AI 模型免费审校书稿,连无聊段落都揪出来 — walkingriver · 2026-09-10
- 马斯克 Colossus 数据中心遭大规模居民抗议与抵制 — scientificamerican · 2026-09-10
- 分析:华为将推更便宜、专为国产模型调优的 AI 芯片 — 2C_ornot2C · 2026-09-10
- Photon 2.2 发布:优化 Ampere 到 Blackwell 全系 GPU 本地推理 — JFPuget · 2026-09-10