Audio8 ASR Infinite 发布:流式语音识别 KV Cache 7×24 常数延迟
_akhaliq · x · 2026-09-30
akhaliq 介绍流式语音识别模型 Audio8 ASR Infinite:
- 原生流式架构,每秒解码 12.5 次
- 滚动 KV Cache 使内存与延迟保持恒定,可支持 7×24 小时不间断运行
- 每个时钟步输出一个文本 token(12.5/8.3/6.25 次决策每秒),在感知粒度与资源开销间权衡
- HuggingChat 的 ML 实习生搭建了 Gradio 工作流,可直接在线试用,模型也已发布
「模型」频道最新
- 美团 LongCat 发布 DeepResearch 系统,多智能体协作产深度报告 — Meituan LongCat Team · 2026-09-30
- 谷歌研究:GPT-5.5 报告 200 份仅 2 份披露埋藏的负面结果 — google · 2026-09-30
- PlaylistEval:百小时视频下前沿评委模型成对准确率仅 75.4% — Shayekh Bin Islam · 2026-09-30
- Google 发布 400M 参数表格基础模型 TabFM,零样本胜过调优 AutoML — google · 2026-09-30
- Codex 升级 $500 档前,先把手头 $200 月度用完 — ctjlewis · 2026-09-30
- 模型宣传口径两极:要么做套壳要么算 15 位小数,中间呢? — Benhamish-WH-Allen · 2026-09-30