Fermion 推出 Phonon-2 端侧语音识别模型,MLX 量化适配 Apple Silicon
FermionResearch · hf · 2026-10-01
FermionResearch 的 Phonon-2 语音识别模型登上 Hugging Face 热门榜。该模型面向 Apple Silicon 端侧部署,基于 parakeet-tdt 架构,通过量化感知训练(quantization-aware training)提供低比特量化版本,主打本地、低资源的语音转文字场景,是 macOS 本地 ASR 的一个值得关注的选项。
所属事件:Phonon-2 开源语音模型以 164MB 超越 Whisper Large(3 条相关)→
「Infra」频道最新
- 零填充让 vLLM 跑 tp=6:6 卡跑 27B 模型实测 50 tok/s — Biomass23 · 2026-10-01
- 为省推理成本,Bittensor Chutes 团队或发现全新模型训练方式 — markjeffrey · 2026-10-01
- Ornith-1.5 配套 DFlash 草稿模型上线,最高 2.54 倍无损加速 — alan_ritter · 2026-10-01
- 经理锁死 Teams 会议记录,员工借 Copilot 从源码里捞回转录 — TheBigCrowbroski · 2026-10-01
- 算力横向对比:Nvidia 仍是性价比最优硬件 — Storge2 · 2026-10-01
- 硅谷大桥上没信号:AI 普惠卡在覆盖不全的互联网 — soumitrashukla9 · 2026-10-01