Ahmad Osman 预测,18 个月内单张 RTX 5090 可跑 GLM 5.2 级智能
AI Engineer · youtube · 2026-07-21
Ahmad Osman 在 “Desktop Frontier” 演讲里主张:前沿级智能正在从服务器走向个人硬件,未来竞争重点会从参数规模转向“每参数带来的实际能力”。
- 他预测,大约 18 个月内,GLM 5.2 级别的智能可能就能跑在单张 RTX 5090 上。
- 演讲强调模型效率提升、硬件 footprint 从服务器级转向消费级,这会改变本地 AI 的部署方式。
- Osman 把本地/开源模型上升为“主权 AI”问题:用户应该自己掌控运行模型的计算栈。
- 他还回顾了从 Mistral、Qwen 到 DeepSeek R1 的开源模型演进,并认为 agent 能力和工具调用 正变得越来越重要。
- 最后抛出的问题是:如果模型继续变小、变强,你今天买的 GPU 是否会随着时间升值?
「Infra」频道最新
- 推理服务关键指标盘点:流式速度 TPOT 与可用性如何影响体验 — abhijithneil · 2026-09-11
- PlanetScale 推出分片 Postgres,768 台服务器组成 1PB 单库 — dhruv2038 · 2026-09-11
- 7900 XTX 24GB 能否跑 Qwen,Reddit 征集 ROCm 实测数据 — thenomadexplorerlife · 2026-09-11
- 实测戳破 RTK 省钱神话:token 省了,账单分文未降 — Bartaseth · 2026-09-11
- SF Compute 创始人:现在买算力是「绝对糟糕的体验」 — IgorCarron · 2026-09-11
- 开源 SmolVM:2026 年 Agent 不止用浏览器,而是拥有整台电脑 — aniketmaurya · 2026-09-11