Google 发布 Gemini 3.8 Live 与 3.5 Transcribe 音频模型,开放实时语音应用开发
gaganghotra_ · x · 2026-09-16
Google AI Studio 官宣发布新的 Gemini 音频模型:Gemini 3.8 Live 与 3.5 Transcribe,已通过 Gemini API 和 Google AI Studio 提供给开发者,用于构建更智能的实时对话语音应用。
所属事件:谷歌发布 Gemini 3.8 Live 双模型,语音 Agent 登顶质量榜(21 条相关)→
「多模态」频道最新
- Cartwheel MCP 接入 Unreal Engine,动画工作流打通 — andrew_n_carr · 2026-09-16
- 开源音乐模型 YuE2 翻唱 Megadeth 金属曲,改成爵士摇摆风 — PensionNew1814 · 2026-09-16
- ComfyUI 音乐工具包 3.0:用 YuE2 加 ABC 乐谱做自动翻唱 — Vivid_Promise1700 · 2026-09-16
- 用 Kling 3.0 和 Astra-6,一人保持同一人狗角色拍完整部 AI 短片 — Loretaro · 2026-09-16
- MiniMax H3 上线 Together AI:33B 全模态模型可生成 2K 带声视频 — togethercompute · 2026-09-16
- 用 MeshyAI 生成绑定动画 3D 怪物,替换恐怖游戏里的平面幽灵 — abandonedmuse · 2026-09-16