实测 MiniMax 图像一致性:多图分开喂 vs 参考图集差异超预期
vuse2121 · reddit · 2026-09-14
作者用 MiniMax 的图像输入做了一致性测试:把 5 张不同肩上角度的单独图片分别输入,结果角色一致性比传统角色参考图集(character sheet)好得多,差异之大超出预期。
他随后尝试更复杂的组合——正面、45 度、侧面三个基础角度,叠加俯视、平视、仰视三种高度变化——但一旦同时修改提示词,就失去了基线,结果变得混乱。
作者最后提出疑问:多角度输入可能只是过度设计,真正起决定作用的也许只是底图的画质和分辨率,希望社区分享各自的喂图方法。
「多模态」频道最新
- 陶艺课秒变韩剧现场:AI 生成视频戏剧感拉满 — alifcoder · 2026-09-15
- 自动画应用亮相:实时视频模型让涂鸦自己动起来 — umpherj · 2026-09-15
- Jutsu 3D 加 Seedance 出片,网友直呼离谱 — ImmediateRain1309 · 2026-09-15
- 社论风插画提示词走红:适配 GPT Image 的出图咒语 — ramos_casals · 2026-09-15
- Runway 实时视频模型新玩法:边画边动的草图应用 — runwayml · 2026-09-15
- Reddit 网友展示全新风格的 AI 生成动画短片 — Choice_Mongoose7320 · 2026-09-15