Google 发布 Gemini 3.5 Transcribe,主打精准听写与去噪
GoogleAI · x · 2026-08-27
Google 发布 Gemini 3.5 Transcribe 模型,专注于高精度语音转录和智能听写。
- 核心特性:解决传统听写中的背景噪音干扰、拼写错误及“嗯/啊”语气词填充问题,实现更自然的输入体验。
- 可用平台:已集成至 macOS 版 Gemini App 和 Android Gboard;开发者可通过 Google AI Studio、Antigravity 及 Gemini Enterprise Agent Platform(公测)调用。
- 未来计划:即将登陆 Google Chrome 和 Gemini Enterprise for Customer Experience。
所属事件:谷歌发布 Gemini 3.5 Transcribe 语音转文本模型(15 条相关)→
「多模态」频道最新
- 构建多模态智能体:从 LLM 到落地 Agent 的 7 步路线图 — MaryamMiradi · 2026-08-27
- Descript 揭秘专用模型:零shot语音修复与唇形同步 — descript · 2026-08-27
- Runway 接入 Meta Muse 图像模型,多模态能力再升级 — runwayml · 2026-08-27
- Seedance 2.5 对比 2.0 实测:同提示词下氛围感明显更强 — piotrbinkowski · 2026-08-27
- 主网首个链上自编码器「remanence」即将发售 — bushibuilds · 2026-08-27
- Wan 视频去模糊技巧:低去噪 KSampler 二次采样 — o0ANARKY0o · 2026-08-27