DeepMind 发布 SL2T 手语转文本模型,支持设备端追踪

TorturedPoet30 · reddit · 2026-08-12

DeepMind 发布了名为 SL2T 的手语转文本模型,允许听障用户直接对着手机打手语进行输入,而非传统的键盘打字。

该模型能够实时读取手部、身体和面部动作并将其转换为英文文本。为适应真实使用场景,系统支持单手打手语(如另一只手拿着手机时)。隐私方面,姿态追踪在本地设备端进行,而翻译计算则在服务器端完成。DeepMind 表示该模型在学术基准上达到了 SOTA 水平,并在听障社区的深度参与下开发,未来计划扩展支持更多种类的手语。

所属事件:DeepMind发布SL2T手语转文本模型,Pixel 11首发(9 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →