商汤发布 SenseNova-U1.5:8B 无编码器原生统一多模态模型
Haiwen Diao · hf · 2026-09-11
SenseNova-U1.5 是一个 8B 参数的原生统一多模态模型,无需外部编码器或 VAE 即可完成视觉理解、推理与生成。技术路线包括 patch 重建、精选数据、专家优化与 on-policy 蒸馏,兼顾高保真生成与指令遵循能力。模型已上架 Hugging Face。
「多模态」频道最新
- 雨中舞者穿镜而下:Pixio 生成的视频已难辨真假 — tsi_org · 2026-09-11
- 高德发布 ABot-Earth 0.7:一张卫星图 10 分钟生成 3D 城市,扫街榜全面 AI 化 — 量子位 · 2026-09-11
- Meta Muse 新玩法:一键把任意文章变成播客收听 — alexandr_wang · 2026-09-11
- GPT-6 Astra 做 3D 实战:硬表面走 Blender MCP,有机体靠 TripoAI — majidmanzarpour · 2026-09-11
- 回望扩散模型之前:VQGAN,生成式视觉的奠基之作 — makeitrad1 · 2026-09-11
- 社区开发者做 ComfyUI 节点,为 MiniMax H3 提供 3D 灯光棚重打光 — Emotional_Example_12 · 2026-09-11