实测 Minimax H3:复杂指令下的高一致性视频生成

cneuralnetwork · x · 2026-08-29

作者通过一个极具挑战性的复杂 prompt 实测了 Minimax H3 模型的视频生成能力。该 prompt 要求生成一个 5 秒的无缝写实镜头,涉及复杂的空间逻辑(左右手、镜像反射)、物理互动(球体滚动、撞击)、以及多个元素的严格一致性(文本、数量、体积、阴影)。结果证明模型在处理多模态约束和物理一致性方面表现出色。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →