Qwen3.8-Omni-Flash 发布:多人语音识别错误率 88%→3%,音频 API 降价 98%
karminski3 · x · 2026-09-18
Qwen 发布 Qwen3.8-Omni-Flash,并配套发布 Qwen-Live-Harness 与 Qwen-MM-Plugins 两个框架。要点:
- 相比上代 Qwen3.5-Omni-Flash 平均分提升 25%,Agent 能力提升最猛,部分分数翻倍
- 多人重叠会议语音识别错误率从上代的 88% 降到 3%,达到真正可用水平
- 原生支持最长 1 小时连续音视频输入
- API 费用降低 98%:音频输入从每百万 token 18 元降到 0.8 元
- 另发布超低延迟版本 Qwen3.8-Omni-Flash-Realtime
注意事项:Qwen-Live-Harness 官方 GitHub 尚未 push 代码(仓库为空),但 npm 上已有包,作者从 npm 拉取分析;该框架目前仅支持 macOS。
所属事件:Qwen3.8-Omni-Flash 发布:会议语音识别错误率降至 3%,API 降价 98%(2 条相关)→
「模型」频道最新
- 腾讯 Hy4 Preview 位列开源模型第四,最便宜且三项 agent 榜第一 — mariofilhoml · 2026-09-18
- 计数字母暴露短板:GPT-6-Astra 93% 对手惨败 — scaling01 · 2026-09-18
- Typesafe 推出 Jev 模型:不做文本生成,直接输出带概率的类型化决策 — majidmanzarpour · 2026-09-18
- 智谱 AI 自主发现可被 WeWorm 利用的安全漏洞,引关注 — teortaxesTex · 2026-09-18
- 用户实测:保险法律问题 Gemini 一遍答对,ChatGPT 循环诡辩 — Hatrct · 2026-09-18
- Typesafe AI 发布分类模型 Jev,成本较同类 LLM 最多降 400 倍 — hwchase17 · 2026-09-18