La compañía Google DeepMind dio un paso decisivo en accesibilidad al presentar SL2T, un modelo masivo de inteligencia artificial capaz de traducir la lengua de señas a texto directamente en teléfonos y otros equipos. Esta innovación debuta formalmente en teclados Gboard y la app Transcripción en Vivo para los dispositivos Pixel 11.
Esta solución permite a las personas sordas o con discapacidad auditiva usar señas en cualquier aplicación donde antes debían escribir manualmente. El sistema facilita realizar búsquedas en la web, redactar mensajes de texto, interactuar con el asistente Gemini e incluso mantener conversaciones fluidas mediante respuestas gestuales convertidas al instante.
A diferencia de los idiomas hablados, las lenguas de señas cuentan con gramáticas e identidades propias, lo que exigió desarrollar un aprendizaje automático verdaderamente multilingüe. Según información publicada por Google DeepMind:
"Dictar en lengua de señas es más rápido, más natural y más agradable que escribir en inglés" para los usuarios evaluadores.
Para garantizar la privacidad, la herramienta no procesa el vídeo en bruto en servidores externos, sino que utiliza un modelo interno que detecta sólo los puntos clave del cuerpo. El algoritmo fue entrenado con más de 100.000 horas de datos en 50 lenguas de señas, alcanzando un hito técnico sin precedentes en rendimiento.
El desarrollo contó desde sus inicios con la participación activa de profesionales sordos como Sam Sepah, junto a organizaciones globales agrupadas en un comité especializado. Desde el equipo de desarrollo de Google destacaron que "creemos en construir con la comunidad sorda, no solo para ella", asegurando un diseño inclusivo y ético.
Aunque el lanzamiento inicial abarca la Lengua de Señas Americana hacia el inglés, la empresa tecnológica proyecta expandir la herramienta a más idiomas y dispositivos. La meta final apunta a lograr la paridad total entre las lenguas habladas y gestuales en los entornos digitales cotidianos.