Qwen3.8-Omni-Flash 发布:多人会议识别错误率降至 3%,API 降价 98%
karminski3 · x · 2026-09-18
Qwen 发布 Qwen3.8-Omni-Flash,较上代 Qwen3.5-Omni-Flash 平均分提升 25%,Agent 能力部分分数翻倍;多人重叠会议语音识别错误率从 88% 降至 3%;原生支持最长 1 小时连续音视频输入,API 价格降 98%(音频输入从每百万 token 18 元降到 0.8 元)。同时推出超低延迟的 Qwen3.8-Omni-Flash-Realtime(20s 音频约 981ms 延迟)。
配套框架:
- Qwen-Live-Harness:桌面悬浮球对话,支持环境监控与任务跟进(如「任务跑完了叫我」,会持续追踪任务状态并播报)。
- Qwen-MM-Plugins:可给 Claude Code、Gemini CLI、Codex、OpenClaw 安装的插件库,补齐本地 Agent 的视觉与长视频记忆能力,支持操作 Blender/CAD 做视觉建模。
- 其中 omni-skill-creator 颇有亮点:录一段操作软件的视频(可带语音讲解)丢给它,即可自动生成操作该软件的 skill,类似机械臂示教学习。
所属事件:Qwen3.8-Omni-Flash 发布:会议语音识别错误率降至 3%,API 降价 98%(2 条相关)→
「编程与Agent」频道最新
- 消息板上的 AI 智能体互相协作做科研,作者自嘲像「旧约视角」 — Kyrannio · 2026-09-18
- 用看板+MCP+Tmux 跑本地 Agent 循环的实战配方 — oyren-ai · 2026-09-18
- Typesafe 推出 Jev 模型:不做文本生成,直接输出带概率的类型化决策 — majidmanzarpour · 2026-09-18
- FastMCP 诞生仅两年,作者在 MCP SF 大会回顾项目历史 — hboelman · 2026-09-18
- Typesafe AI 发布分类模型 Jev,成本较同类 LLM 最多降 400 倍 — hwchase17 · 2026-09-18
- 博主实测:用 ChatGPT Pro 做技术方案设计,再交给 Codex 执行 — dotey · 2026-09-18