小米开源 ControlFoley 模型:视频生成音频
apolinariosteps · x · 2026-08-19
小米在 Hugging Face 发布了 ControlFoley,这是一个视频到音频的生成模型。它可以根据视频画面生成匹配的音效,支持可选提示词(prompt)和音频参考引导。目前已在 Hugging Face Spaces 上线演示。
「多模态」频道最新
- MiniMax H3生态一周速览:Fizgig 4.1.2单次训练角色+配音LoRA — optimisticalish · 2026-08-19
- Fabio 遭鹅击:高精度物理喜剧视频生成提示词 — danishkirel · 2026-08-19
- 用 MiniMax H3 做可爱风转场动画,效果讨喜 — gizakdag · 2026-08-19
- 如何用 Minimax H3 生成逼真打斗场景? — FreddyShrimp · 2026-08-19
- 提取首帧做降噪参考,修复视频色彩与细节 — DuHal9000 · 2026-08-19
- MiniMax H3 单次生成超宽画面:一帧塞进两个故事 — SIR_NVAX_A_LOT · 2026-08-19