谷歌推出SL2T模型,助力手语识别
近日,谷歌DeepMind推出了名为SL2T的手语到文本转换AI模型,旨在帮助全球约7000万聋人或听力障碍者更好地使用智能手机和互联网服务。该模型已集成在Pixel 11手机的Gboard和Live Transcribe应用中,支持将美国手语(ASL)翻译成英文文本。SL2T基于超过10万小时的手语数据训练而成,并且能够识别多种手语中的共同结构模式,从而超越了早期的手语模型。此外,该模型采用了一种名为MediaPipe Holistic的计算机视觉技术来保护用户隐私。通过直接将手势序列转换为文本,SL2T更好地捕捉到了非手动表达和空间语法结构的特点,提高了翻译质量和用户体验。谷歌表示,未来计划扩展该模型以支持更多手语,并开发生成手语的AI模型。
