AI 智能体自我迭代优化 vLLM,DeepSeek 等模型吞吐量提升 16%

yisongyue · x · 2026-08-04

Asari AI 实验室展示了自我改进智能体在底层推理优化方面的突破。其智能体成功优化了 vLLM 推理栈,在 B200 GPU 上运行 DeepSeek v4 Pro 和 GLM 5.2 时,在没有 MTP 的前提下实现了高达 16% 的吞吐量和交互性提升。

前谷歌 CEO Eric Schmidt 转发了该进展并表示,随着极其聪明的智能体被广泛采用,这将大幅改善推理效率并降低数据中心的服务成本。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →