视频生成模型 H3 惊现幽灵音频:提示词被朗读
Vijayi · reddit · 2026-08-26
有用户报告在生成视频(推测为 H3 模型)时遇到随机出现的画外音或朗读提示词内容的“幽灵音频”问题。即使在提示词中未指定有人声,生成的视频中有时会包含直接朗读提示词指令(如镜头方向)或完全无法理解的乱语声音。该用户目前使用的参数是 0.4 引导系数、8 步迭代、内置 LoRA 检查点,时长 10-12 秒。
「多模态」频道最新
- VLM视觉Agent实现攀岩抓点检测与姿态可视化 — jonstephens85 · 2026-08-26
- MiniMax H3 生成 G.I. Joe 角色视频 — darthfurbyyoutube · 2026-08-26
- 实测显示:强 Critic 配合可大幅提升 gpt-image-2 效果 — andreisavu · 2026-08-26
- Hailuo AI 纺织纹理 Logo 动画提示词分享 — aziz4ai · 2026-08-26
- Magnific 展示 T 台视频:高跟鞋节奏精准对齐音乐 — charis_ai · 2026-08-26
- Magnific 发布翼装飞行第一人称视频,沉浸感强 — charis_ai · 2026-08-26