Google 发布 Gemini 3.5 Transcribe 实时语音转写模型
GeminiApp · x · 2026-09-09
Google 官方宣布推出 Gemini 3.5 Transcribe,一款面向精准、智能实时语音转写的 speech-to-text 模型。
- 模型已集成进 macOS 版 Gemini 应用,可结合用户语音与屏幕上下文协同工作
- 支持用自然语言完成本地文件总结、规划与研究等任务,还可用语音指令生成图像
- 定位为「实时转写 + 智能理解」的组合,而非单纯的听写工具
所属事件:Google 推出 Gemini 3.5 Transcribe 实时转写并登陆 macOS(2 条相关)→
「多模态」频道最新
- 网友晒 ChatGPT Images 2.5 新模型画作,称刚发布即实测 — DeryaTR_ · 2026-09-09
- GPT Image 2.5 推出 Sketch 功能,设计微调效率大增 — lukaszkaiser · 2026-09-09
- ComfyUI 更新引入 Sol Attention,生图提速效果实机演示 — DemolitionMan32 · 2026-09-09
- Redditor 用 ComfyUI+MiniMax H3 打造低分辨率风格的星际迷航短剧 — Perfect-Campaign9551 · 2026-09-09
- Image 2.5 展示出色文字渲染能力引关注 — NickPassig · 2026-09-09
- GPT-Image-2.5 现身 ChatGPT,噪声伪影测试结果好坏参半 — mark_k · 2026-09-09