商汤 SenseNova U1.5-Lite 发布:专家训练+OPD 蒸馏
SandyL925 · reddit · 2026-08-21
商汤发布 SenseNova U1.5-Lite,采用“训练专业化,交付统一化”路线。它针对文本渲染、图像编辑等任务训练专家模型,再通过 OPD(Online Pairwise Distillation)技术蒸馏为单一模型,推理时无需路由或切换。
主要提升:
- 复杂指令遵循: 能同时处理主体数量、空间关系、文本布局等多重约束。
- 文本渲染与密集布局: 支持中英文海报与信息图生成。
- 原生 4K 生成: 保持全局结构稳定。
- 原生编辑能力: 在多参考编辑和局部修改中更好地保持主体身份与未编辑区域。
- 视觉理解增强生成: 利用从理解任务中学到的物体关系、空间结构表征辅助生成。
基准测试: 在 Qwen-Image-Bench 上得分 60.18,ImgEdit 得分 4.59,GEdit-Bench-EN 得分 8.26。模型已在 GitHub 和 Hugging Face 开源。
所属事件:商汤开源 SenseNova U1.5 Lite:8B 统一多模态模型支持原生 4K 生成与编辑(14 条相关)→
「多模态」频道最新
- 求助:如何在 12GB 显存下实现高保真 Img2Img — Devilray31 · 2026-08-21
- 商汤发布 SenseNova U1.5-Lite,强化图文排版 — BeCalmr · 2026-08-21
- Seedance 2.5 实测:动作逼真,画面电影感强 — SimplyAnnisa · 2026-08-21
- 昆仑万维SkyProduction打响AI短剧价格战:视频生成降至0.4元/秒,单部收入破百万美元 — 昆仑万维集团 · 2026-08-21
- Veo 与 Kling 胜出:15 款 AI 视频工具实测对比结论 — Pale_Intern5543 · 2026-08-21
- 博主展示与 Google Gemma 4 玩你画我猜 — tristanbob · 2026-08-21