Mistral AI 推出区域推理服务,首发支持智谱 GLM-5.2
sophiamyang · x · 2026-08-12
Mistral AI 宣布推出欧洲计算单元和区域推理服务,并开始支持第三方模型,首发接入智谱的 GLM-5.2。
实测数据显示,在 Mistral AI 的基础设施上运行 GLM-5.2 达到了约 130 TPS(每秒 Token 数),首字延迟(TTFT)仅为 0.37 秒,速度表现显著优于 OpenRouter 上的多数同类提供商。
所属事件:Mistral推出欧洲算力单元与区域推理服务(2 条相关)→
「Infra」频道最新
- macOS虚拟化突破:Apple Silicon跑大模型速度暴增超10倍 — Scobleizer · 2026-08-12
- 小米与宇树锁死全球快门传感器产能,冲击美国人形机器人量产 — Scobleizer · 2026-08-12
- 逃避地球内卷:太空数据中心正成为 AI 算力新前沿 — DavidLinthicum · 2026-08-12
- 单卡 GH200 跑出 3323 tok/s 极限推理 — MaziyarPanahi · 2026-08-12
- 推理与智能体爆发:AI Token 消耗量半年激增 14 倍 — robleclerc · 2026-08-12
- SGLang 实现本地高效运行 Nemotron 3.5:支持 1M 上下文 — BanghuaZ · 2026-08-12