Google DeepMind(@GoogleDeepMind)

SL2T is state-of-the-art on academic benchmarks, plus it's optimized for real-world use like one-han...

8.5内容质量

TL;DR · AI 摘要

Google DeepMind推出的SL2T模型在学术基准上表现优异,并优化了实际使用场景,如单手操作手机时的手语识别。

核心要点

  • SL2T模型在Pixel 11设备上实现手语实时转文本功能
  • 采用设备端姿态追踪+云端翻译的隐私保护架构
  • 支持单手操作手机时的美国手语输入

结构提纲

按章节快速跳转。

  1. SL2T模型在学术基准测试中达到SOTA水平

  2. 首次在Pixel 11设备实现手语实时转文本功能

  3. 采用设备端姿态追踪与云端翻译分离架构

  4. 支持单手操作手机时的自然手语输入交互

  5. 已集成至GboardLive Transcribe应用

思维导图

用一张图看清主题之间的关系。

查看大纲文本(无障碍 / 无 JS 友好)
  • SL2T手语识别系统
    • 技术特性
      • 学术SOTA表现
      • 设备端姿态追踪
    • 应用方案
      • Pixel 11集成
      • Gboard/Live Transcribe支持
    • 隐私设计
      • 本地处理敏感数据

金句 / Highlights

值得收藏与分享的关键句。

#SL2T#手语识别#Android#隐私计算
打开原文

Google DeepMind on X: "SL2T 在学术基准测试中处于领先地位,同时针对现实场景进行了优化,例如单手持手机时进行手语输入。为保护隐私,它在设备端追踪身体姿态,而我们的服务器会将这些数据转换为文本。https://t.co/6AkxT6mO3D" / X

Google DeepMind

@GoogleDeepMind

11h

SL2T 是我们的突破性手语转文字模型,正在为

@

Android

上的听障用户推出新功能。从 Pixel 11 的美式手语转英语开始,用户可以直接通过 Gboard 和 Live Transcribe 进行手语输入,而无需打字。

$

00:00

/$

76

160

1.1K

91K /