MiniMax H3 被曝高分辨率下提示词遵循能力显著下降
Bobun · reddit · 2026-08-08
开发者在 4×B300 上部署 MiniMax H3 模型时发现,视频生成的提示词遵循能力受分辨率影响极大。
- 低分辨率表现优:在 352p/416p 下,模型能较好遵循镜头结构、摄像机角度和角色位置。
- 高分辨率翻车:在 768p 下,提示词遵循能力急剧下降,会忽略摄像机角度、改变角色位置等。
- 增加步数无效:增加推理步数仅能略微提升视觉连贯性,无法修复结构性引导或构图问题。
作者推测这可能与 latent 维度变化有关,呼吁社区探讨是否需要针对高分辨率调整 RoPE 或位置编码等设置。
「多模态」频道最新
- 实测 Seedance 2.5 视频生成:被赞今年最大飞跃 — Div_pradeep · 2026-08-08
- Midjourney 实战:用 SREF 代码与光影构建赛博朋克巨物感 — tisch_eins · 2026-08-08
- 实测 MiniMax H3 R2V 角色替换功能翻车 — CtrlAltDefeat- · 2026-08-08
- 开源 Colab 技能:20 秒内生成 5 秒 480p MiniMax 视频 — Commercial_Board9219 · 2026-08-08
- 用 Seedance 2.5 生成「AI创作者的一天」 — SimplyAnnisa · 2026-08-08
- Seedance 2.5实测:照片转奇幻中世纪战斗视频,效果不错但动作可加强 — techhalla · 2026-08-08