浪潮信息推面向智能体的算力底座

机器之心 · wechat · 2026-07-13

浪潮信息在开放计算技术大会上发布了面向智能体时代的一组 AI 基础设施产品,包括**CPU 原生液冷整机柜服务器**和**元脑 SD200 超节点 AI 服务器**。 文章核心观点是:随着 AI 从“单次问答”走向“智能体群智协同”,算力结构正在变化。CPU 不再只是简单调度角色,而是要承担智能体沙箱、流程编排、工具调用等负载;因此数据中心需要更多专门优化的 **CPU 算力底座**,而 GPU 则继续负责大模型推理输出。 在硬件层面,CPU 原生液冷整机柜采用开放 OCM 架构,强调高密度、全链路液冷和更高的机柜功耗上限,面向大规模智能体部署。软件/推理层面,升级后的元脑 SD200 超节点在多项优化后,宣称在 **Kimi K2.6 万亿参数模型**上的单 Token 生成时间降到 **4.77ms**,首 Token 延迟也进一步下降,并已完成对 Kimi、DeepSeek、GLM、MiniMax 等开源大模型的高性能优化。 文章最后将这套方案概括为:**GPU 超节点负责“思考”,CPU 原生液冷整机柜负责“行动”**,共同支撑企业侧智能体和多模融合应用落地。

所属事件:浪潮发布面向智能体时代的AI基础设施(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →