开源语音模型 K2-Raon-Speech 登顶 HF 趋势榜第二名
Kangwook_Lee · x · 2026-08-07
开源语音多模态模型 K2-Raon-Speech 与 Raon-Speech 分别冲上 Hugging Face 多模态 LLM 趋势榜的第 2 名和第 4 名。
目前,Raon-Speech 的网页 Demo 已经上线,支持体验语音对话(Speech Chat)和全双工(Full Duplex)等交互功能,展示了当前开源语音模型的前沿能力。
「多模态」频道最新
- 弃用 Figma:AI 工具栈打造建站新工作流 — MicahBerkley · 2026-08-07
- Reddit 分享用动作捕捉技术制作 AI 音乐视频 — aronpaul70 · 2026-08-07
- PC Gamer 发起讨论:玩家如何看待 AI 生成的游戏音乐? — jordiponsdotme · 2026-08-07
- MiniMax视频模型实测:一键生成带标注的产品展示动画 — LudovicCreator · 2026-08-07
- World Labs 洛杉矶黑客松:64 支团队基于空间模型构建 3D 交互世界 — theworldlabs · 2026-08-07
- RTX 5070 Ti 跑 MiniMax H3 视频生成,非采样开销高达 240 秒 — orlandogourmet66 · 2026-08-07