T4 上 190 毫秒出图:蒸馏后文生图模型实现逐键实时生成

Gradio · x · 2026-10-01

Gradio 介绍 ML-Intern 蒸馏的 260M 文生图模型:把每张图所需网络前向次数从 100 次压到 4 次,在 T4 GPU 上生成时间不到 190 毫秒,可支持每次按键即时出图。模型可在小型 GPU Space 运行,也可通过 WebGPU 直接在浏览器本地运行。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →