浏览器端免费语音识别神器:三大模型实现降噪与高精度分离
doodlestein · x · 2026-08-13
一款世界级的多人语音识别工具引发关注,它集成了三个不同的 Transformer 模型,不仅能提供高质量的语音转文字(ASR),还具备强大的降噪和说话人分离(Diarization)能力。
该工具完全免费且开源,所有处理均在本地浏览器中完成,无需上传任何音频数据,保障了隐私安全。实测显示,尽管其运行速度略逊于 CLI 命令行版本,但识别质量极佳,且支持将结果导出为 Markdown 或独立样式的 HTML 文件以便分享。
所属事件:开源纯Rust语音识别工具实现浏览器端本地多人分离(2 条相关)→
「应用」频道最新
- Genspark 发布 AI 硬件与全家桶工具,重塑办公工作流 — VraserX · 2026-08-13
- ForgeCAD 合作助力,该平台正式上线 AI CAD 生成功能 — MarvinTBaumann · 2026-08-13
- 用 Claude 零成本打造浏览器端视频去水印工具 — vinishkapoor · 2026-08-13
- 零成本拍中世纪短片:用 Adobe Firefly 打造全流程 — LudovicCreator · 2026-08-13
- Lottielab 推出 AI 动效编辑器 Burp,预告片不用 After Effects — Vjeux · 2026-08-13
- 别把 Claude 当实习生:8 个高阶提示词技巧 — hey_abusiddik · 2026-08-13