Boson AI 推出 Higgs 实时语音模型,支持百种语言
smolix · x · 2026-08-23
Boson AI 由机器学习研究员 Alex Smola 联合创立,正准备发布其首个语音到语音模型 Higgs RealTime,旨在让机器对话更自然。公司此前发布的 Higgs TTS 3 支持超过 100 种语言的表达式对话语音,具备零样本语音克隆和实时情感控制功能。此外,其 Higgs Avatar API 可根据单张静态图片生成实时说话人视频。早期模型 Higgs TTS 2 已在 Hugging Face 开源,训练数据超过 1000 万小时。
「模型」频道最新
- ProgramBench 评测结果:Opus 5 依然领先,0813 为最强开源模型 — teortaxesTex · 2026-08-23
- Qwen3.8-27B 发布一周:社区全方位评测汇总 — Jonathan_Rivera · 2026-08-23
- 用户推测 Opus 5 变啰嗦或为配合水印检测 — cool_architect · 2026-08-23
- 微调 Gemma 4 12B:工具调用能力提升 2.7 倍 — TheOneWhoWil · 2026-08-23
- GPT-5.6-Luna 模型定价曝光,27B 规格仅 $0.20/$1.20 — gabrielchua · 2026-08-23
- AI 模型质量与成本:DeepSeek Flash 与 Gemini 性价比领先 — bindureddy · 2026-08-23