Google 发布 Gemini 3.5 Transcribe:支持 85+ 语言与智能后处理
GoogleDeepMind · x · 2026-08-27
Google DeepMind 发布了最新的语音转文本模型 Gemini 3.5 Transcribe。主要特性包括:
- 更强理解力:能准确识别电话号码、邮政编码、订单 ID,即使在嘈杂环境下也能保持高准确率。
- 智能后处理:自动去除填充词(如 um, ah)并修正自我修正,自动格式化文本。
- 自定义词汇:识别独特的名称和产品标题。
- 多语言支持:自动检测并转录 85+ 种语言的语音。
目前已集成到 Gemini app (macOS) 和 Gboard (Android) 中,开发者可通过 Google AI Studio 使用。
所属事件:谷歌发布 Gemini 3.5 Transcribe 语音转文本模型(17 条相关)→
「模型」频道最新
- 实测:Codex 用量几乎无限,远比 Fable 划算 — panickssery · 2026-08-27
- 用户纠正关于 Qwen3.8-27B 模型排名的误传信息 — Real-C- · 2026-08-27
- 爆料称 Sonnet 和 Opus 模型即将发布 — ChrisGPT · 2026-08-27
- AMD R9700 单卡跑 Qwen3.8-27B 达 227 tok/s,无损加速新纪录 — samsja19 · 2026-08-27
- 爆料:Anthropic 拟先发 Fable 5.1,Astra 仍未就位 — haider1 · 2026-08-27
- Deepseek V4 Flash 刷新纪录:单流解码达 420 tok/s — HankYeomans · 2026-08-27