GLM 5.3 登陆 Amazon Bedrock:753B MoE,强化编码与网络安全
AWS ML Blog · rss · 2026-10-06
智谱 Z.ai 的 GLM 5.3 现已上线 Amazon Bedrock,面向符合条件的 enterprise 客户开放托管 API,无需自建推理基础设施。
模型要点:
- 753B 参数的 MoE 模型,主打编码与长程 agent 任务(跨数百文件重构、多小时工作流不丢上下文)
- Z.ai 称编码能力较 GLM 5.2 内部基准提升 50%,并在 DeepSWE、Terminal Bench 3.0、FrontierSWE 上具竞争力
- 发布时在 CyberGym 安全基准取得 84.5 的领先成绩,网络安全能力突出
Bedrock 集成特性:
- 支持 OpenAI 兼容的 Responses / Chat Completions API,以及 Bedrock Invoke / Converse API
- 默认隐式 prompt caching,可用 promptcachebreakpoint 做显式缓存(每段 ≥1024 token),显著降低 agent 工作流的延迟与输入成本
- 提供 US(us.zai.glm-5.3)与 Global(global.zai.glm-5.3)跨区域推理,以及 Flex / Standard / Priority 三档服务层级
文中给出从短时凭证生成到显式缓存的完整 Python 示例,并用开源渗透测试 agent Strix 演示了基于 GLM 5.3 的授权安全测试工作流。
「Infra」频道最新
- 双 RX 7900 XT 跑 Qwen 27B 实测:单流最高 66.5 TPS,离网传 100+ 差多远 — EqualCryptographer67 · 2026-10-06
- 开发者晒 3 万亿 token 用量:9 月烧掉 842B,API 牌价 40.9 万美元订阅仅付 3.4% — doodlestein · 2026-10-06
- 一个 Dot 每天烧 16 亿 token:100 美元订阅跑出月均 54 万美元 API 等价成本 — DarthSilent · 2026-10-06
- Modal 工程师 Charles Frye 系统讲解推理引擎:从调度器到 KV 缓存与投机解码 — AI Engineer · 2026-10-06
- Reflection 新模型以 Apache 2.0 开源,但预训练 MFU 仅约 12% 引质疑 — eliebakouch · 2026-10-06
- Anthropic Cowork 转向云端:推理与 VM 全部上云,告别本地电池消耗 — Simon Willison · 2026-10-06