GLM-5.3-Flash 日处理 100T tokens,竟全靠国产芯片
airesearch12 · x · 2026-08-26
SemiAnalysis 爆料 Ox Alpha 实为智谱 GLM-5.3-Flash。令人惊讶的是,其每天高达 100T tokens 的处理量完全基于中国芯片服务,展示了国产算力底座的大规模调度能力。
「Infra」频道最新
- Turso 接入 AgentID,赋予 AI 独立 OIDC 身份 — glcst · 2026-08-27
- Unsloth 推出 Qwen2.5 优化版,推理速度大幅提升 — thoquz · 2026-08-26
- Foresight CEO:开放科学亟需独立安全算力集群 — allisondman · 2026-08-26
- Qwen3.8-Flash 支持本地运行,125B 模型仅用 75GB 内存 — danielhanchen · 2026-08-26
- CoreWeave 揭秘物理 AI 底层算力栈,支持 Wayve 与日产 — wandb · 2026-08-26
- AWS 教程:让 Bedrock AgentCore 跨账户访问知识库 — AWS ML Blog · 2026-08-26