
Qué es SignGemma y a quién se dirige
Google DeepMind presenta SignGemma como "our most capable model for translating sign language into spoken text", según su propio anuncio. El modelo se integrará en Gemma, la familia de modelos abiertos de la compañía, y estará disponible "later this year", sin que DeepMind haya precisado una fecha concreta ni cifras de inversión.
La compañía dirige el modelo a developers, creators, and the Deaf and Hard of Hearing community. Por ahora se encuentra en fase de pruebas, orientada a desarrolladores e investigadores además de la comunidad sorda o con pérdida auditiva, de acuerdo con la cobertura periodística del anuncio.
Alcance técnico: de ASL a otras lenguas de signos
El modelo está optimizado sobre todo para traducir ASL (lengua de signos americana) a inglés, aunque su diseño permitiría, según Google DeepMind, aprender y traducir otras lenguas de signos más adelante. Eso convierte el lanzamiento actual en un primer paso dentro de un proyecto de alcance más amplio.
Sobre la tecnología subyacente hay menos certeza: coberturas periodísticas atribuyen a Google que el sistema se basa en Gemini Nano y se ejecuta on-device (es decir, en el propio dispositivo del usuario, sin depender de servidores externos), y que se entrenó con más de 10.000 horas de vídeo en ASL anotado junto con transcripciones en inglés. Ninguno de estos dos detalles figura en el comunicado oficial breve de la compañía.