NVIDIA 展示 Qwen 27B 模型输出速度达每秒 2529 tokens
IanAndrewsDC · x · 2026-09-28
NVIDIA 推理负责人 Ian Buck 在 GTC 活动上登台,展示了 Qwen 3.8 27B 模型的推理性能:输出速度达到每秒 2529 tokens。这一数据由现场观众转述并引起 SemiAnalysis、Cerebras 等推理服务商相关人士关注,可用于对比各家推理栈的吞吐能力。
「Infra」频道最新
- 黑客链式利用硬编码密钥拿下 Meta 服务 root 权限并窃取云凭证 — evilsocket · 2026-09-29
- Google Cloud 发布 Valkey 9.1,QPS 较托管 Redis 服务提升 3 倍 — rseroter · 2026-09-29
- Framework 192GB AI 桌面版本周三开启预售,配 AMD Ryzen AI Max+ Pro 495 — gnukeith · 2026-09-29
- OriginTrail DKG V10.0.19 上线:AI Agent 读图更快更省 CPU — melnykowycz · 2026-09-29
- INT21 称两周造 20 个推理引擎,MiMo 解码达 1308 tokens/s — bingxu_ · 2026-09-29
- 用 Amazon Nova Act 做合成监控:告别脆弱 UI 选择器脚本 — AWS ML Blog · 2026-09-28