GLM 5.3 Flash 上线 W&B serverless:1M 上下文带视觉,$0.5/百万输出
wandb · x · 2026-09-09
开发者爆料称 GLM 5.3 Flash 已上线 W&B(Wandb)serverless 推理服务,由 CoreWeave 提供。配置为 1M token 上下文、支持视觉,输出价格 $0.50/百万 token,速度较快。同一作者此前也第一时间发现 DeepSeek V4 已上线该 serverless 推理平台。属第三方发现的开源模型可用性变化,细节以官方为准。
「Infra」频道最新
- 弗州坐拥全球 13% 数据中心,电价反而低于全国均值 — Scobleizer · 2026-09-09
- NVIDIA 提出 Draft Co-Training,加速大规模长上下文 RL 后训练推理 — nvidia · 2026-09-09
- PostgreSQL 19 原生支持属性图,SQL 里直接写图查询 — arpit_bhayani · 2026-09-09
- 「前沿模型为何没加速经济增长」引热议:答案是全球推理算力不够 — zephyr_z9 · 2026-09-09
- KubeCon 中国:Linux 基金会、蚂蚁、华为共话开源 AI 生态 — PyTorch · 2026-09-09
- 播客热议 Broadcom 定制 ASIC 与 2027 供给瓶颈,兼谈 Nvidia 收购 Hugging Face — BenBajarin · 2026-09-09