浪潮信息推面向智能体的算力底座
机器之心 · wechat · 2026-07-13
浪潮信息在开放计算技术大会上发布了面向智能体时代的一组 AI 基础设施产品,包括**CPU 原生液冷整机柜服务器**和**元脑 SD200 超节点 AI 服务器**。 文章核心观点是:随着 AI 从“单次问答”走向“智能体群智协同”,算力结构正在变化。CPU 不再只是简单调度角色,而是要承担智能体沙箱、流程编排、工具调用等负载;因此数据中心需要更多专门优化的 **CPU 算力底座**,而 GPU 则继续负责大模型推理输出。 在硬件层面,CPU 原生液冷整机柜采用开放 OCM 架构,强调高密度、全链路液冷和更高的机柜功耗上限,面向大规模智能体部署。软件/推理层面,升级后的元脑 SD200 超节点在多项优化后,宣称在 **Kimi K2.6 万亿参数模型**上的单 Token 生成时间降到 **4.77ms**,首 Token 延迟也进一步下降,并已完成对 Kimi、DeepSeek、GLM、MiniMax 等开源大模型的高性能优化。 文章最后将这套方案概括为:**GPU 超节点负责“思考”,CPU 原生液冷整机柜负责“行动”**,共同支撑企业侧智能体和多模融合应用落地。
所属事件:浪潮发布面向智能体时代的AI基础设施(2 条相关)→
「Infra」频道最新
- 现货内存价飙升 140%,合约重定价开始滞后 — tengyanAI · 2026-07-21
- 有人把 AI 使用方式指向异步长周期实验而非单买算力 — voooooogel · 2026-07-21
- PrismML Bonsai 27B 量化后仅 3.8GB 可手机运行 — tony10000 · 2026-07-21
- 有人主张给模型独立 micro VM,少用 tool calling — joecole · 2026-07-21
- 把数据集打包成顺序 blob,训练吞吐提升 30% — irinarish · 2026-07-21
- 一个 C++20 CPU 原生 strict-W1 训练 runtime 寻求反馈 — Wonderful-Income7415 · 2026-07-21