通义万相音频夺魁,但最强 TTS 模型或仅限 API 调用?
b111ue · reddit · 2026-07-22
阿里巴巴的 Qwen-Audio-3.0-TTS-Plus 近期登顶了 Artificial Analysis 的 TTS(文本转语音)排行榜,力压 Gemini、ElevenLabs 等主流模型。从样本听感来看,该模型自然、富有表现力且可控性极高。
然而,其发布策略引发了开源社区的讨论:
- Qwen3-TTS:提供 Apache 2.0 开源权重,支持本地部署。
- Qwen-Audio-3.0-TTS-Plus:目前仅能通过阿里云 API 调用,未见开放权重。
作者指出,这或许不代表 Qwen 要彻底放弃开源,但其最强模型正逐渐向闭源商业化靠拢。社区随即展开争论:在“仅限 API 的最强模型”与“可本地修改的稍弱开源模型”之间,开发者究竟该如何权衡?
所属事件:阿里 Qwen 最强 TTS 模型登顶但暂限 API 调用(3 条相关)→
「模型」频道最新
- 曝 Meta Muse Agent 内置邀请码逻辑,或携额外免费额度上线 — testingcatalog · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- 新基准一出分数暴跌 70 点:「刷榜」现象如何让跑分失真 — airesearch12 · 2026-09-11
- ChatGPT 竟劝用户「问题太复杂,去试试更笨的回答」 — phido3000 · 2026-09-11
- Anthropic 调整年龄验证,Claude 不再向未成年人开放 — Muhammad523 · 2026-09-11
- 有人要建全模型基准分数汇总页 — airesearch12 · 2026-09-11