自我进化 Agent 出击:将 vLLM 推理吞吐量提升 16%

yisongyue · x · 2026-07-30

AsariAILabs 展示了其研发的“自我进化 Agent”(self-improving agents)在底层推理优化上的突破。该智能体对完整的 vLLM 推理栈进行了端到端优化。

在 B200 GPU 上运行 DeepSeek v4 Pro 和 GLM 5.2 模型时,Agent 实现了高达 16% 的吞吐量提升,且未使用多 Token 预测(MTP)。更值得关注的是,每一次代码修改都经过了严格验证,并且 Agent 在迭代过程中展现出了越来越快的自我改进速度。

所属事件:AsariAI 自我进化智能体优化 vLLM,提升万亿参数模型吞吐量(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →