商汤发布U1Pro多模态创作模型
新智元 · wechat · 2026-07-18
商汤在 WAIC 上发布下一代多模态模型 **SenseNova U1Pro**,主打“看懂、生成、动手”统一在同一个基座里。文章重点展示了它在 **8K 长卷、电影海报、信息图、中文长文本排版、角色设定图** 等任务上的成图效果,强调其更像“会思考的设计师”,而不是一次性抽卡的生图模型。 技术上,U1Pro 采用自研统一架构 **NEO-unify**,把理解、生成和行动放到同一套表征与 Transformer 序列里;创作过程通过类似 **Agentic Generation Loop** 的长程迭代完成。文中还提到: - 训练时引入“指令思维链”和多维奖励,强化构图、文字准确度、设计感与一致性 - 通过更大的 patch 和分级噪声控制,把 **8K 直出** 的上下文与算力压力压下来 - 官方请 200 位美院学生和设计师评审,称当前只有 U1Pro 和 GPT-Image-2 达到“可直接交付客户”的门槛 - 未来目标不只在视觉创作,还包括空间智能、具身大脑、城市规划和建筑设计等方向
所属事件:商汤发布SenseNova U1 Pro原生8K多模态生图模型(6 条相关)→
「模型」频道最新
- GPT-5.5/5.6 被指过度平衡心灵哲学选项 — aran_nayebi · 2026-07-20
- 用世界模型提升语言智能体 — theomitsa · 2026-07-20
- GPT-5.5/5.6 在意识问题上太怀疑 — aran_nayebi · 2026-07-20
- Qwen 3.7 Max、MiniMax M3、OpenAI 5.6 对比 — Saifl · 2026-07-20
- Gemini 总是用错工具 — gaganghotra_ · 2026-07-20
- LLM 可能过度怀疑 — aran_nayebi · 2026-07-20