实测 MiniMax 图像一致性:多图分开喂 vs 参考图集差异超预期

vuse2121 · reddit · 2026-09-14

作者用 MiniMax 的图像输入做了一致性测试:把 5 张不同肩上角度的单独图片分别输入,结果角色一致性比传统角色参考图集(character sheet)好得多,差异之大超出预期。

他随后尝试更复杂的组合——正面、45 度、侧面三个基础角度,叠加俯视、平视、仰视三种高度变化——但一旦同时修改提示词,就失去了基线,结果变得混乱。

作者最后提出疑问:多角度输入可能只是过度设计,真正起决定作用的也许只是底图的画质和分辨率,希望社区分享各自的喂图方法。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →