浏览器端免费语音识别神器:三大模型实现降噪与高精度分离

doodlestein · x · 2026-08-13

一款世界级的多人语音识别工具引发关注,它集成了三个不同的 Transformer 模型,不仅能提供高质量的语音转文字(ASR),还具备强大的降噪和说话人分离(Diarization)能力。

该工具完全免费且开源,所有处理均在本地浏览器中完成,无需上传任何音频数据,保障了隐私安全。实测显示,尽管其运行速度略逊于 CLI 命令行版本,但识别质量极佳,且支持将结果导出为 Markdown 或独立样式的 HTML 文件以便分享。

所属事件:开源纯Rust语音识别工具实现浏览器端本地多人分离(2 条相关)→

原文链接 →

「应用」频道最新

更多「应用」频道 AI 资讯 →