KerasHub原生集成vLLM,内置投机解码大幅提升性能

fchollet · x · 2026-08-08

Keras 创始人 François Chollet 宣布,KerasHub 现已原生支持使用 vLLM 来部署模型,从而获得显著的性能提升。

此外,在回复中补充提到,目前所有 KerasHub CausalLMs(因果语言模型)都已经内置了投机解码(Speculative decoding)支持。这意味着开发者可以在不牺牲精度的前提下,大幅加快模型的推理速度。

所属事件:KerasHub原生集成vLLM并内置投机解码(3 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →