视频生成模型 H3 惊现幽灵音频:提示词被朗读

Vijayi · reddit · 2026-08-26

有用户报告在生成视频(推测为 H3 模型)时遇到随机出现的画外音或朗读提示词内容的“幽灵音频”问题。即使在提示词中未指定有人声,生成的视频中有时会包含直接朗读提示词指令(如镜头方向)或完全无法理解的乱语声音。该用户目前使用的参数是 0.4 引导系数、8 步迭代、内置 LoRA 检查点,时长 10-12 秒。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →