阿里发布 Qwen3.8-Omni-Flash:首个面向智能体的全模态模型
johnseach · x · 2026-09-18
Qwen 官方发布 Qwen3.8-Omni-Flash,定位为其首个围绕智能体能力构建的原生全模态模型,输入支持文本、图像、音频、视频,上下文最长 100 万 token,基于 Qwen3.8-Flash-Next 架构。
要点:
- 音视频联合推理 + 跨长工作流编排工具:可自动剪辑 vlog、翻译短视频、生成电影回顾等
- 官方称音视频能力逼近 Gemini 3.8 Flash,在 WildClawBench-MM 与 UniClawBench 上智能体平均性能 +19.5 分
- 支持双/四声道空间音频理解、function calling、结构化输出、隐式缓存等,兼容 DashScope 与 OpenAI 协议
- 定价:输入 $0.15/百万 token,输出 $0.47/百万 token,隐式缓存输入 $0.016/百万 token
建议搭配 Qwen-MM-Plugins 让 agent 框架调用其原生多模态能力。
所属事件:阿里发布 Qwen3.8-Omni-Flash:全模态 Agent 模型降价超 98%(15 条相关)→
「编程与Agent」频道最新
- 小模型做实体解析:成本降 99%,吞吐提升 7 倍且精度几乎不输 — hrishioa · 2026-09-20
- Factory 推出私有化部署版:企业采购 AI 的最大障碍是 VPC — annbordetsky · 2026-09-20
- 12 个真实工作流实测 Jev:1000 封邮件判定仅花 9 美分 — minchoi · 2026-09-20
- Jev 玩法更新:用自然语言给网页做「视觉 lint」 — minchoi · 2026-09-20
- Jev 做 LLM 评测裁判:快 20-200 倍,跑一堆提示不到 0.1 美元 — minchoi · 2026-09-20
- 宝玉用 GPT 6 Astra 把《桃花源记》做成沉浸式网页 — dotey · 2026-09-20