DeepMind 发布 SL2T 手语转文本模型,支持设备端追踪
TorturedPoet30 · reddit · 2026-08-12
DeepMind 发布了名为 SL2T 的手语转文本模型,允许听障用户直接对着手机打手语进行输入,而非传统的键盘打字。
该模型能够实时读取手部、身体和面部动作并将其转换为英文文本。为适应真实使用场景,系统支持单手打手语(如另一只手拿着手机时)。隐私方面,姿态追踪在本地设备端进行,而翻译计算则在服务器端完成。DeepMind 表示该模型在学术基准上达到了 SOTA 水平,并在听障社区的深度参与下开发,未来计划扩展支持更多种类的手语。
所属事件:DeepMind发布SL2T手语转文本模型,Pixel 11首发(9 条相关)→
「模型」频道最新
- 分析师炮轰 Gemini 体验极差:Google 正失去 SOTA 护城河 — firstadopter · 2026-08-12
- 实测 Gemma 4 QAT:KV Cache 量化表现大幅提升 — Anbeeld · 2026-08-12
- 新数学基准OEIS Open:Opus 4.8解决30%未解猜想 — xeophon · 2026-08-12
- xAI 上线 Grok 4.6 模型 API — legit_api · 2026-08-12
- DeepSeek 结合本地 3B 视觉模型,打造无云端依赖的 Agent 浏览组合 — helloiamleonie · 2026-08-12
- DeepSeek V4 Pro 正式上线,中国大模型后训练能力迎检验 — zephyr_z9 · 2026-08-12