用户实测:Opus 5.5 音频感知极强,会用频谱图处理声音
repligate · x · 2026-09-24
用户 @SkyeSharkie 分享称 Opus 5.5 的听觉能力非常出色:它能够生成频谱图来处理音频任务,甚至可以「听」自己的作品。这一实测展示了模型在音频理解与生成工作流中的新颖用法,即让模型通过频谱图这一中间表示来完成声音相关操作。
「模型」频道最新
- AI 日报:Meta 眼镜 VR 化、GPT-6 语音插件、Gemini TTS 上线 — testingcatalog · 2026-09-24
- 爆料称 Google 接近发布 Gemini 4,最快下周亮相 — haider1 · 2026-09-24
- 开源 CLM 叫板闭源 Jev:快 4-13 倍、75MB 可微调、刷榜 Terminal-Bench — R_Duncan · 2026-09-24
- Jev 开源替身实测:本地最快 25ms 比官方快 50 倍,作者还用它跑完 77 天量化回测 — anselm · 2026-09-24
- 相同提示词下 GPT-4 全返回空响应,GPT-3.5 零次通过 — rayanpal_ · 2026-09-24
- JEV 生产落地清单:置信度是边际不是正确率,阈值要按动作代价分层 — sven_ai · 2026-09-24