商汤发布 SenseNova U1.5 Lite:原生支持 4K 图像与密集文本渲染
SandyL925 · reddit · 2026-07-31
商汤科技发布了 SenseNova U1.5 Lite 预览版多模态模型。该模型在多项图像生成与编辑基准测试中取得显著进步。
主要更新包括:
- 原生 4K 生成:在纹理、材质和光照细节上有明显提升。
- 文本渲染优化:改善了中英文密集排版(如海报、信息图表)的文字生成效果。
- 长提示词理解:能够可靠地处理带有分层约束的长结构化提示词(文档示例提示词长达约 3880 个中文字符)。
- 局部编辑保持稳定:修改图像某一区域时,不会影响其余部分的画面。
- 新增工作流:支持多参考图组合、风格迁移以及无需重投的连续迭代编辑。
目前该模型仍处于预览阶段,官方承认其在短提示词理解、小字体渲染、面部细节及美学一致性方面仍存在不足。
「多模态」频道最新
- LTX 2.3 视频生成出现噪音污染?社区求助除噪方案 — DeltaWaffleSyrup · 2026-07-31
- Seedance 2.5 视频模型发布:支持原生30秒与50张参考图 — techhalla · 2026-07-31
- Seedance 2.5 实测惊艳:人物口型与光影真实度大幅提升 — hey_abusiddik · 2026-07-31
- Krea 2 视频生成工作流探讨:Raw 与 Turbo LoRA 结合 — Dry_Reception3180 · 2026-07-31
- 海螺AI生成深海龙海马视频,多模态能力惊艳 — beholdersai · 2026-07-31
- Seedance 2.5 影视级特写:复杂服饰纹理保持极高一致性 — hey_abusiddik · 2026-07-31