OpenAI称实时语音模型2.1为迄今最佳
pbbakkum · x · 2026-07-07
OpenAI 的 Patrick Bakkum 表示,gpt-realtime-2.1 是目前其最佳的语音到语音(speech-to-speech)模型,2.1-mini 则是许久以来首个小型音频模型,呼吁用户试用并反馈。
所属事件:OpenAI发布GPT-Realtime-2.1系列实时音频模型(4 条相关)→
「多模态」频道最新
- 有人想训练一个一致性 LoRA,让动漫场景保持统一 — ThirdWorldBoy21 · 2026-07-22
- 手绘手办丢进 Seedance,效果像真的“活过来” — cocktailpeanut · 2026-07-22
- 一个 AI agent 做出的沼泽乡村 MV 在 Reddit 上走红 — LazyKaleidoscope4696 · 2026-07-22
- 实测 Qwen 3 图像生成:地图边界随提问视角变化,自带中文标签 — NirantK · 2026-07-22
- 独立开发者把对着屏幕吐槽,做成了本地 MCP 报 bug 工具 — phdptsd · 2026-07-22
- Google 演示称 Gemma 4 可在 6 秒内识别车损视频 — soumitrashukla9 · 2026-07-22