SenseNova U1.5 开源:原生支持 4K 图像生成与编辑
Rist0o0 · reddit · 2026-08-05
商汤科技旗下 SenseNova 发布了 U1.5 图像模型预览版,权重已开源。
- 核心能力:将文生图与图像编辑统一在单一模型中,支持局部修改、图片内文字替换等结构化操作,支持 JSON 等复杂提示词。
- 训练提升:基于 4K 分辨率图像训练,提升了高分辨率下的细节表现,显著改善了中英文密集文字排版效果。
- 开源与局限:采用 Apache 2.0 协议开源。目前人脸生成和极小文字处理仍存在瑕疵,暂无 ComfyUI 节点。
所属事件:商汤开源多模态模型U1.5:主打4K生图与精准编辑(3 条相关)→
「多模态」频道最新
- Seedance 2.5 视频模型上线,支持 30 秒原生生成与多模态参考 — HeyNayeem · 2026-08-05
- Seedance 2.5 上线 Lumina AI:支持单次生成 30 秒视频 — HeyNayeem · 2026-08-05
- Midjourney 实战:用提示词构建极致尺度的城市高定礼服 — tisch_eins · 2026-08-05
- MiniMax H3 模型实测:单提示词生成电影级灾难大片 — CurieuxExplorer · 2026-08-05
- MiniMax H3 模型变体差异解析:FL2V 与 Ref2V — Timesenen · 2026-08-05
- Krea2 换脸 LoRA 实测:ComfyUI 工作流与优化技巧 — cradledust · 2026-08-05