实测多模态模型生成脱口秀:表现自然但仍有瑕疵

Ror_Fly · x · 2026-08-12

一位开发者分享了使用多模态模型生成30秒脱口秀视频的实测体验。优点:角色的举止神态非常自然,会眨眼、停顿并改变语调,对话不再像机器人般生硬。缺点:人物帽子的连贯性容易出错,部分口型对不齐且语音有断层,且生成480p视频的成本依然较高。

所属事件:实测用Claude与Seedance全自动生成长篇脱口秀(3 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →