HERRAMIENTAS
Google impulsa herramientas de IA que entienden las lenguas más allá de la traducción de texto
Google detalla un avance desde la traducción literal hacia sistemas que comprenden habla, tono y cambio de idioma en tiempo real. Con Gemini 3.5 para traducción y transcripción, modelos ligeros que funcionan en el dispositivo y nuevas alianzas de datos abiertos, la compañía busca incluir cientos de lenguas, mejorar accesibilidad y respetar la pronunciación local.
Qué ha ocurrido
Google explica que sus tecnologías ya operan en más de 300 lenguas y que, más allá de traducir texto, está entrenando modelos que entienden el habla tal y como se usa: tono, pausas y cambios de idioma. Destacan Gemini 3.5 Live Translate (70 lenguas y más de 2.000 pares) y Gemini 3.5 Transcribe, junto a mejoras de edición por voz en Gboard. La compañía impulsa la Iniciativa de las 1.000 Lenguas con el Universal Speech Model (12 millones de horas de audio) y proyectos de datos abiertos como WAXAL, Project Vaani y Amplify. Presenta además Language Explorer para visualizar LinguaMeta, y trabaja en accesibilidad con SL2T (señal a texto) en Gboard y Live Transcribe en Pixel 11, empezando por ASL a inglés. Para entornos sin conectividad, lanza TranslateGemma (traducción en 55 lenguas, en dispositivo) y apoya el asistente AVA de Viamo para teléfonos básicos, que ya ha respondido más de 2 millones de preguntas. También colabora para mejorar pronunciaciones locales, como con expertos maoríes en Maps.
Qué significa para creadores
Si tienes acceso a estas funciones, puedes acelerar flujos de trabajo multilingües: traducción de voz en tiempo real con matices emocionales, transcripciones más limpias incluso con ruido o jerga, y correcciones rápidas desde Gboard. TranslateGemma permite traducir sin conexión, útil al grabar en movilidad. Las iniciativas de datos y pronunciación fomentan localizaciones más respetuosas con cada comunidad. SL2T apunta a contenidos más inclusivos para personas que usan lengua de señas, y proyectos como AVA muestran vías para llegar a audiencias con teléfonos básicos en mercados con baja conectividad. En conjunto, estas herramientas abren la puerta a ampliar alcance y calidad de subtítulos, doblajes y experiencias de audio en múltiples idiomas.
Fuente y contexto
La información procede del blog de Google (15 de septiembre de 2026): «AI for everyone in every language». Google resume avances de investigación y producto basados en Gemini y en colaboraciones locales para cubrir más lenguas (incluidas poco representadas), operar sin conexión y mejorar accesibilidad y pronunciación. La empresa sitúa estas capacidades en su ecosistema, que conecta a miles de millones de usuarios.
