GLM 5.3 Flash 上线 Phala 平台,支持 GPU TEE 隐私推理
bgmshana · x · 2026-08-29
Z.ai 发布的 GLM 5.3 Flash 模型现已在 Phala 网络上线。这是一个 320B MoE 模型,激活参数 18B,专为高效编码、长视界智能体任务、视觉理解和长上下文推理设计。
部署特性:
- 通过 TDX 认证的 GPU TEE(可信执行环境)提供服务,确保推理过程私密且可验证。
- 支持工具调用和 JSON 模式。
定价:
- 输入:$0.15 / 1M tokens
- 输出:$0.50 / 1M tokens
- 上下文长度:1M tokens
「Infra」频道最新
- 德国警告 AI 算力不足,计划 2030 年算力翻四倍 — Polymarket · 2026-08-29
- WaveZip 推出:号称将芯片仿真存储成本降低 100 倍 — ycombinator · 2026-08-29
- QuixiAI 开源高性能推理服务 SlimServe — QuixiAI · 2026-08-29
- Ollama 新增 Claude 开关:本地模型可直接接入 Claude Desktop — dr_cintas · 2026-08-29
- AI 数据中心遭遇实体阻力,基础设施 backlash 升级 — AccBalanced · 2026-08-29
- 单卡 DGX Spark 运行 Qwen 3.8 MoE 实测方案 — QuixiAI · 2026-08-29