开源端侧语音模型 Audio8:ASR/TTS 七个规格,iPhone 离线转写可用
FinanceYF5 · x · 2026-09-16
LeonaYangAGI 宣布开源一套端侧音频模型 Audio8,可运行在手机、PC 等算力和内存受限的设备上,本地推理即可使用:
- ASR(语音识别):0.1B / 0.3B / 0.6B / 3B 四个规格;
- TTS(语音合成):0.1B / 0.3B / 0.6B 三个规格;
- 提供 iPhone 离线转写版本,语音 AI 正从云端向端侧扩展。
对想在本地或移动设备上做语音识别/合成、关注端侧部署的开发者是可直接上手的开源选择。
「Infra」频道最新
- 日立能源将在密西西比州投资 5.28 亿美元建新变压器工厂 — oilmutt · 2026-09-16
- 全美第二大律所购英伟达硬件,微调开源模型自建主权AI栈 — MikeBirdTech · 2026-09-16
- Anthropic 携手 Fluidstack 向德州小城捐 1000 万美元修水网 — MxMnr · 2026-09-16
- Oracle 裁员次日新 CFO 全员会:不喜欢「少花钱多办事」这个说法 — mkheck · 2026-09-16
- OpenAI 透露 Astra 在 Rubin 芯片上自我优化 72 小时推理再翻倍 — bookwormengr · 2026-09-16
- RTX Pro 6000 全面售罄,买家称交货周期已长达 8 个月 — Sentdex · 2026-09-16