Google lanza Gemini 3.5 Live Translate: traducción de voz en tiempo real en más de 70 idiomas que conserva tu voz
El nuevo modelo speech-to-speech de Google traduce conversaciones de forma continua en más de 70 idiomas preservando el tono, el ritmo y el timbre del hablante. Ya se despliega globalmente en Android e iOS, con cada salida marcada por SynthID.
Google ha lanzado Gemini 3.5 Live Translate, un modelo speech-to-speech dedicado que traduce conversaciones habladas en tiempo real en más de 70 idiomas, y ya está desplegándose globalmente en Android e iOS.
El salto técnico importa más que la cifra de idiomas. Los sistemas de traducción anteriores esperaban a que el hablante terminara la frase para devolver una lectura plana y sintetizada. Gemini 3.5 Live Translate procesa el habla según fluye, manteniéndose apenas unos segundos por detrás del hablante. Y conserva la entonación, el ritmo y el timbre vocal: la voz traducida suena como tú hablando otro idioma, no como un robot resumiendo lo que dijiste.
Android estrena además un truco exclusivo: el modo escucha. Basta con acercarse el teléfono a la oreja, como en una llamada normal, para oír una traducción privada por el auricular — sin auriculares externos ni corrillos incómodos alrededor del altavoz. Para viajeros y para cualquiera que trabaje entre idiomas, es justo el tipo de fricción eliminada que convierte una función en hábito.
Marca de agua por defecto
Cada salida de audio lleva una marca de agua SynthID, un marcador inaudible que identifica el audio como generado por IA. El momento no es casual: el artículo 50 del Reglamento de IA de la UE, que exige etiquetar el contenido sintético, entra en vigor el 2 de agosto de 2026. Google entrega el cumplimiento con dos meses de antelación y convierte una obligación regulatoria en un argumento de confianza. Sus competidores probablemente lleguen al mismo punto en circunstancias menos favorecedoras.
También para desarrolladores
El modelo ya está disponible en vista previa pública a través de la Gemini Live API y Google AI Studio. Grab, Agora y LiveKit ya construyen sobre él: conductores hablando con turistas, videollamadas que se traducen solas. Los usuarios de Google Meet con planes Workspace reciben una vista previa privada este mes, con despliegue amplio a finales de año.
El contexto
Es el segundo lanzamiento de la familia Gemini 3.5 en un mes, tras la disponibilidad general de Flash en el I/O de mayo, y llega mientras el buque insignia Gemini 3.5 Pro — con su contexto de 2 millones de tokens y razonamiento Deep Think — sigue pendiente. Google está entregando la familia pieza a pieza, y las piezas aterrizan en productos de uso diario: Translate, Meet, el propio Android.
La traducción en tiempo real lleva una década apareciendo en demos de keynotes. La diferencia es que ahora se distribuye globalmente, conserva la voz del hablante y los desarrolladores pueden construir sobre ella hoy. Esa combinación no existía la semana pasada.
Fuentes
Lecturas relacionadas
- Modelos de IA Google lanza Gemini 3.6 Flash, 3.5 Flash-Lite y un modelo de ciberseguridad — sigue sin haber 3.5 Pro
- Modelos de IA Gemini 3.5 Pro de Google llega en junio — contexto de 2 millones de tokens y razonamiento Deep Think
- Modelos de IA Google retira todos los modelos Gemini 2.0 y consolida la familia 3.x