Grok Imagine 实测:丝袜类材质遮嘴场景约八成翻车
dropdead90s · reddit · 2026-09-04
作者测试视频生成模型对丝袜/尼龙材质作为面具的一致性表现:用 Grok Imagine 做图生视频(I2V)时,模型约 80% 的情况会在嘴部位置撕开破洞,或直接无视「面具遮住嘴」的提示词。作者发帖询问是否有人做过类似尝试、SD 系模型对这类材质的反应如何。
这反映了当前视频生成模型在遮挡物、材质交互与嘴部区域一致性上的普遍短板。
「多模态」频道最新
- 全球首个开源 AI 电影上线,每个场景由 GitHub 提交生成 — derewah · 2026-09-04
- Suno 推「付费下载」功能被骂:价格堪比 10 首黑胶曲目 — AIandDesign · 2026-09-04
- 单视频生成多视角一致画面:4DAnyone 上线 Gradio,32GB 内显卡可跑 — kornia_foss · 2026-09-04
- Krea 推出创意 Agent 内测:联动 150+ 图像视频模型 — TitusTeatus · 2026-09-04
- MiniMax H3 视频模型跑进 8GB 显存:完整 ComfyUI 工作流开源 — Ecstatic-Use-1353 · 2026-09-04
- 3080 Ti 本地跑 MiniMax H3 视频:6小时免费渲染12集短片 — cocktailpeanut · 2026-09-04