商汤开源 8B 多模态模型,主打 4K 图像生成与高精度编辑
智东西 · wechat · 2026-08-03
商汤最新开源了轻量级原生统一多模态模型 SenseNova U1.5-Lite-Preview。该模型参数量仅为 8B-MoT,集成了看图、视觉推理、4K 极清生成与高精度图像编辑等全套能力。
模型基于自研的 NEO-Unify 原生统一多模态架构,在图像编辑榜单 GEdit-Bench 的中英文评测中均超越了众多大参数开源及闭源模型。它能够精准执行长篇复杂提示词,支持单图或多图参考素材融合创作,并允许用户通过自然语言或直接圈画指定区域,对画面的特定文字、排版或元素进行精细修改,同时保持非编辑区域绝对稳定。目前模型已在 HuggingFace、GitHub 及魔搭社区全面开源。
所属事件:商汤开源 8B 多模态模型,原生支持 4K 生图与编辑(2 条相关)→
「多模态」频道最新
- 绕过地域限制,开源 MCP 让 Claude 免费调用 Seedance 2.5 — matchaman11 · 2026-08-03
- Motion 发布 Claude 技能:输入链接一键生成视频 — EricBuess · 2026-08-03
- 实测 MiniMax H3 文生视频:生成内容被指过度审查 — DaLyon92x · 2026-08-03
- LoRA 训练实战求助:生成结果与采样图严重不符 — Kryimsson · 2026-08-03
- 海螺AI生成地铁洪水级运镜,单提示词干掉好莱坞剧组 — mhdfaran · 2026-08-03
- MiniMax H3 实测:短提示词无需改写即可出好图 — multimodalart · 2026-08-03