Ahmad Osman 预测,18 个月内单张 RTX 5090 可跑 GLM 5.2 级智能
AI Engineer · youtube · 2026-07-21
Ahmad Osman 在 “Desktop Frontier” 演讲里主张:前沿级智能正在从服务器走向个人硬件,未来竞争重点会从参数规模转向“每参数带来的实际能力”。
- 他预测,大约 18 个月内,GLM 5.2 级别的智能可能就能跑在单张 RTX 5090 上。
- 演讲强调模型效率提升、硬件 footprint 从服务器级转向消费级,这会改变本地 AI 的部署方式。
- Osman 把本地/开源模型上升为“主权 AI”问题:用户应该自己掌控运行模型的计算栈。
- 他还回顾了从 Mistral、Qwen 到 DeepSeek R1 的开源模型演进,并认为 agent 能力和工具调用 正变得越来越重要。
- 最后抛出的问题是:如果模型继续变小、变强,你今天买的 GPU 是否会随着时间升值?
「Infra」频道最新
- Ubuntu 部署惊艳实测:5090 显卡成最易配置的 AI 设备 — _xjdr · 2026-07-27
- 台积电传 2027 年拟提价 5%–10% 应对成本上升 — Beth_Kindig · 2026-07-27
- Anthropic 称 Claude Code 删掉 80% 系统提示词仍不掉分 — krishnan · 2026-07-27
- Dhruv Bhatia 加入 fal,转向视频与世界模型栈 — gorkem · 2026-07-27
- Kimi K3 登陆 Together,预留吞吐成本低 65% — togethercompute · 2026-07-27
- NVIDIA 称 Vera CPU 正加速下一代 CPU 和 GPU 设计 — nordicinst · 2026-07-27