Qwen 发布 OmniReasoning 音视频联合推理基准与 30B 模型

Qwen 团队发布 OmniReasoning,指出现有全模态模型的基准、数据与训练方法大多将音频和视觉分开处理,音视频联合推理能力被低估且未被充分激发。该工作提出基准、数据、方法三件套,在音视频联合推理上较 Qwen3-Omni 提升 12.8 点,并推出配套 30B 模型。

2026-10-06 ~ 2026-10-07 · 2 条相关