WorldSonus为世界模型补声:实时空间立体声生成RTF仅0.41

NoizAI · hf · 2026-10-08

NoizAI 提出 WorldSonus,为世界模型生成的交互视频实时合成空间音频,解决三大挑战:

实验显示,WorldSonus 虽为世界模型定制,但在开放域 video-to-audio 基准上也能匹敌或超越最先进的双向模型,声学质量与空间对齐俱佳。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →