每天分享科技热点!

打开网易新闻 查看精彩图片

据外媒Android Authority报道,谷歌正在Gboard中开发一项名为"Sign-to-Text"的手语输入功能,用户通过手机前置摄像头拍摄手语手势,Gboard将识别并转换为文字,该功能在Gboard beta 17.8.3.939743344版本的代码中被发现,但目前尚无法实际运行。

打开网易新闻 查看精彩图片

据了解,Sign-to-Text采用混合本地/云端架构,手机端负责处理视频流并提取原始手势数据,随后将手势数据发送至谷歌云端进行语义解析和文字生成,出于隐私保护考量,视频画面本身不会上传至云端。

打开网易新闻 查看精彩图片

该功能的底层技术来自Google DeepMind的SignGemma模型,SignGemma于Google I/O 2025大会上首次亮相,属于谷歌开源Gemma系列模型,主要面向美国手语(ASL)的翻译任务,原计划2025年底公开发布,目前仍在测试阶段。英国手语AI公司Signapse的CEO Sally Chalk表示,"确保服务于聋人社区的技术与聋人社区共同开发"至关重要。

打开网易新闻 查看精彩图片

不过,Sign-to-Text仍存在诸多不确定因素,代码中出现了"光线不足,请移至更明亮的位置"等提示信息,说明该功能对拍摄环境有一定要求,此外,谷歌是否会支持英国手语(BSL)及其他地区手语变体,目前暂无相关信息。

打开网易新闻 查看精彩图片