OpenAI发布实时音频模型2.1与mini版
pbbakkum · x · 2026-07-07
OpenAI 发布两款音频模型。gpt-realtime-2.1 是对 realtime-2 的增量更新,显著改善了通话中对电话号码、邮箱等字母数字细节的处理能力;gpt-realtime-2.1-mini 为小型版本,且仍保留推理能力。
所属事件:OpenAI发布GPT-Realtime-2.1系列实时音频模型(4 条相关)→
「多模态」频道最新
- 有人想训练一个一致性 LoRA,让动漫场景保持统一 — ThirdWorldBoy21 · 2026-07-22
- 手绘手办丢进 Seedance,效果像真的“活过来” — cocktailpeanut · 2026-07-22
- 一个 AI agent 做出的沼泽乡村 MV 在 Reddit 上走红 — LazyKaleidoscope4696 · 2026-07-22
- 实测 Qwen 3 图像生成:地图边界随提问视角变化,自带中文标签 — NirantK · 2026-07-22
- 独立开发者把对着屏幕吐槽,做成了本地 MCP 报 bug 工具 — phdptsd · 2026-07-22
- Google 演示称 Gemma 4 可在 6 秒内识别车损视频 — soumitrashukla9 · 2026-07-22