AAI News Hub
模型Wed, August 12, 2026·4d ago2 家媒体交叉佐证

Google DeepMind 推出手语转文本模型

DeepMind 的 SL2T 为面向失聪和听障用户的新手语功能提供支持。

为什么重要

手语仍是一个棘手的多模态 AI 难题,因为系统必须在连续动作、视觉线索和离散文本之间建立连接。该领域正从孤立的识别任务,转向更广泛的翻译、生成和基于姿态建模的流程。

核心要点

  • 1.DeepMind 推出了用于手语转文本功能的 SL2T。
  • 2.研究人员正在探索统一的手语翻译与生成模型。
  • 3.基于姿态的数据集和轻量级 Transformer 旨在提升鲁棒性,并覆盖代表性不足的语言。

Google DeepMind 推出了手语转文本模型 SL2T,用于支撑面向失聪和听障用户的新手语功能。此次发布正值手语 AI 研究活跃推进之际,相关方向包括统一的手语翻译与生成框架、借助 LLM 的无 gloss 翻译、基于姿态的多语言数据集,以及面向代表性不足语言的轻量级识别模型。

今天就能用

在将 SL2T 这类手语转文本工具用于无障碍工作流之前,应先由母语手语者进行谨慎评估。

来源与原始报道

本简报汇总并链接到以下媒体的报道。

觉得这篇简报有用?下一篇直接送到你的邮箱。

更多 模型