Actualidad IA generativa

Google lanza Gemini 3.5 Live Translate para traduccion de voz en tiempo real

Google
9 junio 2026

Qué han lanzado

Google ha lanzado Gemini 3.5 Live Translate como modelo de audio para traduccion de voz en tiempo real.

Qué cambia

La traduccion en vivo pasa a ser mas continua y natural, con soporte para mas de 70 idiomas y despliegue en APIs, Google Meet y Google Translate.

Google presenta Gemini 3.5 Live Translate, un modelo de audio para traducir voz de forma fluida en mas de 70 idiomas.

Google ha lanzado Gemini 3.5 Live Translate, un modelo de audio para traducir voz a voz de forma casi simultánea en más de 70 idiomas.

El sistema detecta automáticamente el idioma y genera una voz traducida que intenta conservar entonación, ritmo y tono del hablante original.

A diferencia de los sistemas por turnos, procesa el audio mientras la persona habla y equilibra la espera necesaria para comprender el contexto con la necesidad de mantenerse a pocos segundos del discurso.

El modelo está disponible en vista previa pública mediante Gemini Live API y Google AI Studio. Google también trabaja con plataformas de comunicación en tiempo real para facilitar su integración en aplicaciones de voz.

Google Meet lo incorpora inicialmente en una vista previa privada para clientes seleccionados de Workspace, con más de 2.000 combinaciones lingüísticas posibles frente al sistema anterior centrado en cinco idiomas y traducción hacia o desde el inglés.

La función también llega a Google Translate en Android e iOS. En Android se añade progresivamente un modo de escucha que reproduce la traducción por el auricular del teléfono, y el audio generado incluye una marca imperceptible SynthID.

Ver más