KalpaLabs 发布对话语音模型,推进通用音频架构
ycombinator · x · 2026-07-31
KalpaLabsAI 宣布其对话语音模型进入公开测试阶段,并阐述了通用音频模型(GAMs)的愿景。
这种统一音频模型旨在遵循复杂指令,并具备从上下文示例中学习的能力。
「多模态」频道最新
- Google Earth 引入 Nano Banana 图像生成功能 — anselm · 2026-07-31
- RTX 4060 Ti 实测:LTX 2.3 生成质量为何不如 WAN 2.2? — Daniel_Edw · 2026-07-31
- 创作者使用 Runway Seedance 2.0 生成短片展示 — Lucidjordan79 · 2026-07-31
- 单张 LoRA 能否塞入多个概念?开发者探讨多风格训练技巧 — Lounlysoul007 · 2026-07-31
- Fish Audio 获 5200 万美元融资,发布 S2.1 Pro 语音模型 — thisdudelikesAI · 2026-07-31
- FLUX 3 预览版上线,Nous Research 联合发起短片创作赛 — NousResearch · 2026-07-31