智谱披露RSI最小闭环:GLM-5.3智能体两周搭起10万国产卡推理服务
智谱创始人、首席科学家唐杰在 X 发长文并转发技术博客,首次披露公司在递归自我改进(RSI)方向的最小闭环成果:由 GLM-5.3 驱动的 InfraAgent,在超过 10 万卡国产 AI 加速器集群上参与搭建了 GLM-5.3-Flash 的生产级推理服务,从模型首次跑通国产加速器到承接全部生产流量不到两周,端到端吞吐量达到基线的 3.2 倍。这是「模型优化自身推理基建」的一次公开展示,也是国产大规模芯片集群上线的标志性案例。
已确认
- GLM-5.3-Flash 的全部生产推理流量现运行在超过 10 万块国产 AI 加速器上,从首次跑通到上线生产用时不到两周
- 端到端吞吐较基线提升 3.2 倍,单 token 成本等优化指标在唐杰博客中有披露(据 @APPSO 转述)
- 大量优化工作由 GLM-5.3 驱动的 Infra Agent 完成,即模型参与了承载自身(系列模型)推理的基建优化,形成 RSI 的最小闭环
- 据 @量子位 详析,该系统技术路线以稠密反馈为核心,被视为 RSI 的雏形;GLM-5.3-Flash 曾以匿名名 Ox-Alpha 上线 OpenRouter 等平台
为什么重要
- 这是国内首次公开的「用自家模型优化自家推理基建并规模上线」案例,验证了 RSI 在真实生产环境中的可行性,而非停留在论文层面
- 10 万卡规模的国产加速器集群承接全部生产流量,对国产算力供应链与推理系统优化能力都是一次实战检验
- 智谱工程师 jietang 一线分享显示,两周内完成从跑通到全量上线的节奏,主要优化由 Infra Agent 承担,人机分工模式对行业有参考价值
2026-09-17 ~ 2026-09-17 · 8 条相关
一手来源
- 智谱披露 GLM 自建推理基础设施,迈向递归自我改进 — likeastar20 ·
- 两周上线:GLM 智能体自建推理基建,端到端吞吐提升 3.2 倍 — jietang ·
- 智谱InfraAgent两周优化推理系统,吞吐提升3.2倍 — APPSO ·
- 【源头】两周上线:GLM 智能体自建推理基建,端到端吞吐提升 3.2 倍 — jietang · 2026-09-17
- 智谱披露RSI最小闭环:GLM-5.3驱动的Agent两周搭好10万卡国产芯片推理服务 — 智东西 · 2026-09-17
- 量子位详析GLM InfraAgent:稠密反馈驱动的RSI雏形 — 量子位 · 2026-09-17
- 智谱用 GLM-5.3 智能体自优化推理系统,10万国产芯片上吞吐提升3.2倍 — SinclairWang1 · 2026-09-17
- 【源头】智谱InfraAgent两周优化推理系统,吞吐提升3.2倍 — APPSO · 2026-09-17
- GLM-5.3 驱动 Infra Agent 自建推理栈,10 万国产卡上性能提升约 3 倍 — Dr_Singularity · 2026-09-17
- 智谱称 GLM 撑起 Infra Agent,在 10 万级国产芯片上优化推理栈获 3 倍提升 — Dr_Singularity · 2026-09-17
- 【源头】智谱披露 GLM 自建推理基础设施,迈向递归自我改进 — likeastar20 · 2026-09-17