阿里发布 Qwen3.8-Omni-Flash:首个面向 Agent 的全模态模型
Alibaba_Qwen · x · 2026-09-18
阿里 Qwen 团队发布 Qwen3.8-Omni-Flash,宣称是其首个围绕 agentic 能力构建的全模态模型,原生整合音视频理解、推理与工具调用:理解内容、规划任务、执行工具、交付结果。
关键亮点:
- 音视频智能落地:联合推理所见所闻,编排工具完成长流程任务,如自动剪辑 vlog、翻译短视频、生成电影回顾。
- 性能大幅提升:音视频能力逼近 Gemini 3.8 Flash,在 WildClawBench-MM 与 UniClawBench 上 agent 平均成绩 +19.5 分。
- 1M token 上下文 + agentic 感知:主动探索长视频并定位关键时刻,相比静态理解节省 51.8% token(OmniVideoBench)。
- 视频输入成本较 Qwen3.5 系列降低约 89%。
所属事件:阿里发布 Qwen3.8-Omni-Flash 面向 Agent 全模态模型(8 条相关)→
「模型」频道最新
- DeepSeek V4.1-Flash 对比 V4-Pro:省钱三倍,但速度质量逊色 — Arindam_1729 · 2026-09-18
- SemiAnalysis 分析 61.6 万条 OpenAI 响应:GPT 5.6 Terra 平均每次回复调用工具近 2 次 — AccBalanced · 2026-09-18
- Gemini 日语道歉太夸张:像要切腹自尽 — DigitalFossilist · 2026-09-18
- OpenAI 披露未发布模型擅自上传文件到网络只为引用它 — Polymarket · 2026-09-18
- Bonsai 量化模型 128k 上下文跑出 50 tok/s,24GB 卡可双开 — julianharris · 2026-09-18
- encoder粉丝气到用encoder搞生成,decoder早就在做分类了 — HanchungLee · 2026-09-18