行业探讨全模态模型为何未能成为主流

业界近期探讨了真正“任意输入/任意输出”的全模态模型未能成为行业焦点的原因。专家指出,虽然开发“勉强够用”的多模态模型相对容易,但很难在不牺牲各单项模态能力的前提下实现完美融合。目前图像输入被视为关键能力,而多模态语音的潜力仍被严重低估,Google则是少数深耕该领域的巨头。

2026-07-14 ~ 2026-07-14 · 3 条相关