行业探讨全模态模型为何未能成为主流
业界近期探讨了真正“任意输入/任意输出”的全模态模型未能成为行业焦点的原因。专家指出,虽然开发“勉强够用”的多模态模型相对容易,但很难在不牺牲各单项模态能力的前提下实现完美融合。目前图像输入被视为关键能力,而多模态语音的潜力仍被严重低估,Google则是少数深耕该领域的巨头。
2026-07-14 ~ 2026-07-14 · 3 条相关
- 多模态模型为何没成主流 — emollick · 2026-07-14
- 多模态语音能力仍被低估 — emollick · 2026-07-14
- 全模态模型为何没火起来 — giffmana · 2026-07-14