SenseNova U1.5 Lite 多参考图融合实测小幅胜过 FLUX.2-klein-9b
Kakash1i · reddit · 2026-09-22
作者用五个多参考图融合任务对比了 SenseNova U1.5 Lite 与 FLUX.2-klein-9b-kv。
- 前四个例子中,SenseNova 参考错误更少,能调用更广的输入图元素,色彩更丰富,乱码文字更少
- 分差最大的是最后一张冬季场景:提示要求女性另一只手伸向镜头接/抛雪球,FLUX.2 保持了原本持球的前景手,未建立请求的动作;SenseNova 则把雪球渲染在伸出的手上,对参考图和提示的遵循都更准
- 文内附带了全部测试 prompt(动漫海报、巴黎城市印象编辑海报等)和两个模型的 Hugging Face / GitHub 链接
「多模态」频道最新
- AI 生成「公牛雕塑」以假乱真,网友调侃牛市不再是比喻 — umesh_ai · 2026-09-22
- AI 网红视频升级:30 秒同人设 vlog,像导演而非写提示词 — aftahi_ai · 2026-09-22
- Canva 借 NVIDIA Blackwell 将每 GPU 时视频生成量提升 70% — pbaylies · 2026-09-22
- Viggle H3 Meridian 新玩法:可手动调摄像机角度,图像视频通吃 — linoy_tsaban · 2026-09-22
- 培育神经元启发的软件层宣称让 AI 视频生成提速 5 倍、成本降 80% — The Decoder · 2026-09-22
- AI 生成电影级短片:Glass 外卖骑手的赛博朋克日常 — NoVeterinarian5438 · 2026-09-22