Gradio 蒸馏 Qwen 9B 提示重写器,压到 0.8B 仅 812MB 可跑笔记本
Gradio · x · 2026-09-23
Gradio 发布 Qwen-Image-2.1-PE-T2I-Pocket 系列小模型,把 Qwen-Image 2.1 官方 9B「提示重写器」蒸馏成 2B 和 0.8B 两档学生模型。
- 原版 9B 重写器 bf16 下约 20GB,用 1700 词系统提示、思考约 1600 tokens 才输出;0.8B 版无需系统提示、不思考,直接输出图像模型要的 JSON,约 450 tokens(老师的 28%),GGUF 仅 812MB,笔记本可跑。
- 训练流程由 HuggingChat 里的 ML-Intern 智能体端到端完成:生成 8,797 条请求、覆盖 18 种语言,用 9B 老师打标签,经 TRL 训练两个学生模型,在文本与渲染图像上评估后推送至 Hub;团队只负责批预算和看报告。
权重已开源在 Hugging Face(ML-Intern-lab)。
所属事件:Gradio 开源 Qwen 提示改写器蒸馏版,0.8B 笔记本可跑(3 条相关)→
「编程与Agent」频道最新
- 开源 MCP 服务器实现在 IDE 内管理 GitHub Gist — modelcontextprotocol · 2026-09-23
- Stripe 推出 WebMCP,Agent 完成支付省 42% token — jeff_weinstein · 2026-09-23
- Swarms 市场支持从私有 GitHub 仓库导入并上架售卖智能体 — KyeGomezB · 2026-09-23
- 让 Opus 5 写交接提示词,再用 Opus 5.5 杀掉旧 worker — doodlestein · 2026-09-23
- AssemblyAI HTTP tools 实战:免 WebSocket 部署可预约语音 Agent — AssemblyAI · 2026-09-23
- 与 Opus 5.5 对话一小时,做出 WebGPU 3D 落地页 — kevinkern · 2026-09-23