商汤开源SenseNova U1信息图模型V2
alifcoder · x · 2026-07-15
商汤科技宣布开源 `SenseNova-U1-8B-MoT-Infographic-V2` 模型。该模型在统一多模态理解与生成的架构上进行了升级,重点解决了视觉美感与文本渲染难以兼顾的问题。 相比 V1 版本,V2 带来了以下核心改进: - **文本渲染**:小号文字渲染更加清晰。 - **排版稳定性**:在处理复杂、密集排版时表现更好。 - **视觉美感**:提升了海报、数据看板和报告的整体美观度。 - **缺陷修复**:减少了不必要的黑色背景伪影。
所属事件:商汤开源SenseNova信息图模型V2(2 条相关)→
「多模态」频道最新
- LTX-2.3 Foley LoRA 给静音视频补出环境音效 — linoy_tsaban · 2026-07-21
- Magnific 这段提示词生成了一幅“未经历人生”超现实漫画 — CurieuxExplorer · 2026-07-21
- Seedance 2.0 用提示词做出 MiniDV 手持录像感视频 — eyishazyer · 2026-07-21
- AI 生成“猫模式”特技,滑板落地像在演杂技 — taherdhanera · 2026-07-21
- OCT-Bench 用 10,076 题测试多模态模型能否读懂视网膜扫描 — Baochen Fu · 2026-07-21
- 12GB 显存也能训练 LTX-2.3 脸+声音 LoRA,但代价不小 — __alpha_____ · 2026-07-21