商汤发布U1Pro多模态创作模型

新智元 · wechat · 2026-07-18

商汤在 WAIC 上发布下一代多模态模型 **SenseNova U1Pro**,主打“看懂、生成、动手”统一在同一个基座里。文章重点展示了它在 **8K 长卷、电影海报、信息图、中文长文本排版、角色设定图** 等任务上的成图效果,强调其更像“会思考的设计师”,而不是一次性抽卡的生图模型。 技术上,U1Pro 采用自研统一架构 **NEO-unify**,把理解、生成和行动放到同一套表征与 Transformer 序列里;创作过程通过类似 **Agentic Generation Loop** 的长程迭代完成。文中还提到: - 训练时引入“指令思维链”和多维奖励,强化构图、文字准确度、设计感与一致性 - 通过更大的 patch 和分级噪声控制,把 **8K 直出** 的上下文与算力压力压下来 - 官方请 200 位美院学生和设计师评审,称当前只有 U1Pro 和 GPT-Image-2 达到“可直接交付客户”的门槛 - 未来目标不只在视觉创作,还包括空间智能、具身大脑、城市规划和建筑设计等方向

所属事件:商汤发布SenseNova U1 Pro原生8K多模态生图模型(6 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →