Google DeepMind发布手语翻译模型SL2T,登陆Pixel 11
heiga_zen · x · 2026-08-13
Google DeepMind 与 Android 团队联合推出了手语翻译模型「SL2T」,并正式搭载于 Pixel 11 的 Gboard 和 Live Transcribe 中。该功能允许用户直接通过手语向设备输入文字。
手语不仅是手势,还涉及面部表情和上半身动作的协同。SL2T 实现了高精度捕捉这些要素并将其直接翻译为文本的突破。项目在开发过程中深度联合了聋哑人工程师与社区,并采用了仅处理骨骼地标而不保留相机影像的隐私保护设计,支持单手持机状态下的手语输入。
所属事件:DeepMind发布SL2T手语转文本模型,Pixel 11首发(14 条相关)→
「多模态」频道最新
- 音乐人分享 AI 混音案例,行业仍忌惮首发争议 — jordiponsdotme · 2026-08-13
- AI音乐入侵榜单:卫报揭秘“一键生成”背后的产业隐忧 — nordicinst · 2026-08-13
- Stable Audio 3 Medium 获音乐生成评测第二名 — jordiponsdotme · 2026-08-13
- 开源浏览器端3D模型查看器Online3DViewer — tom_doerr · 2026-08-13
- Minimax H3 面部修复工作流:解决远景人物崩坏 — listopalafoto · 2026-08-13
- Minimax Music 3 音乐模型即将开源,样例已曝光 — rerri · 2026-08-13