Herramientas de IA
IA de audioPrincipiante

Gemini 3.5 Live Translate

Modelo de traducción de voz a voz casi en tiempo real de Google, publicado el 9 de junio de 2026. Detecta automáticamente el idioma y genera voz traducida de forma continua en más de 70 idiomas y 2.000 combinaciones lingüísticas, conservando entonación, ritmo y tono.

Gemini 3.5 Live Translate es un modelo de traducción de voz a voz casi en tiempo real de Google, publicado el 9 de junio de 2026. Detecta automáticamente el idioma hablado y genera voz traducida de forma continua en más de 70 idiomas y 2.000 combinaciones. A diferencia de los sistemas que esperan a convertir voz en texto, traducir y sintetizar de nuevo, empieza a traducir antes de que termine la intervención, como un intérprete que sigue la frase. Está diseñado para conservar la entonación, la velocidad y el tono del hablante.

La interpretación automática tradicional puede introducir latencia, perder prosodia y degradarse con ruido. La traducción continua por streaming reduce esas interrupciones y mantiene el flujo de la conversación, incluso en entornos ruidosos. Esto puede resultar útil cuando la forma de hablar —énfasis o ansiedad— aporta información además del texto.

En reuniones de colaboración científica internacional, puede retransmitir en tiempo real debates entre investigadores que hablan distintos idiomas. La detección automática y la conservación del ritmo y la entonación pueden transmitir preguntas, objeciones y señales de riesgo con mayor naturalidad. La integración con plataformas, el acceso API, las regiones y las políticas de datos deben confirmarse oficialmente.

También puede evaluarse como capa de apoyo en entrevistas de pacientes y estudios de campo multilingües. Deben conservarse el audio original y una transcripción o traducción validada por profesionales. La precisión de terminología médica, separación de hablantes y tratamiento de números y medicamentos no está confirmada; no debe usarse sin revisión humana para decisiones clínicas o consentimiento.

💻 Requisitos del sistema

🧠RAM

Consultar los requisitos oficiales

💾Almacenamiento

Consultar los requisitos oficiales

Instalación

4-1. Inicio rápido

La información disponible no confirma un comando de instalación ni el nombre del paquete SDK.

4-2. Instalación detallada

Consulte la documentación oficial de API, autenticación, plataformas admitidas y permisos. No se incluyen nombres de paquetes ni comandos no verificados.

🧬 Casos de uso en biociencias

🔬

Interpretación de reuniones científicas internacionales

Usar detección de más de 70 idiomas y más de 2.000 combinaciones para retransmitir debates casi en tiempo real. Conservar audio original, transcripción y traducción, y revisar nombres propios y cifras.

🧬

Apoyo a entrevistas de pacientes multilingües

La traducción continua ayuda al diálogo antes de que termine cada intervención y conserva entonación, ritmo y tono. Combinarla con intérprete profesional y verificación del original; no usarla sola para decisiones clínicas.

💊

Estudios de campo internacionales en entornos ruidosos

Apoyar entrevistas multilingües en estudios epidemiológicos o ecológicos, vinculando grabación original, traducción y revisión del investigador, y comprobando errores de términos y números.

FAQ

¿Qué es Gemini 3.5 Live Translate?

Gemini 3.5 Live Translate es un modelo de traducción de voz a voz casi en tiempo real de Google, publicado el 9 de junio de 2026. Detecta automáticamente el idioma hablado y genera voz traducida de forma continua en más de 70 idiomas y 2.000 combinaciones. A diferencia de los sistemas que esperan a convertir voz en texto, traducir y sintetizar de nuevo, empieza a traducir antes de que termine la intervención, como un intérprete que sigue la frase. Está diseñado para conservar la entonación, la velocidad y el tono del hablante. La interpretación automática tradicional puede introducir latencia, perder prosodia y degradarse con ruido. La traducción continua por streaming reduce esas interrupciones y mantiene el flujo de la conversación, incluso en entornos ruidosos. Esto puede resultar útil cuando la forma de hablar —énfasis o ansiedad— aporta información además del texto. En reuniones de colaboración científica internacional, puede retransmitir en tiempo real debates entre investigadores que hablan distintos idiomas. La detección automática y la conservación del ritmo y la entonación pueden transmitir preguntas, objeciones y señales de riesgo con mayor naturalidad. La integración con plataformas, el acceso API, las regiones y las políticas de datos deben confirmarse oficialmente. También puede evaluarse como capa de apoyo en entrevistas de pacientes y estudios de campo multilingües. Deben conservarse el audio original y una transcripción o traducción validada por profesionales. La precisión de terminología médica, separación de hablantes y tratamiento de números y medicamentos no está confirmada; no debe usarse sin revisión humana para decisiones clínicas o consentimiento.

¿Cuándo debería usar Gemini 3.5 Live Translate?

Modelo de traducción de voz a voz casi en tiempo real de Google, publicado el 9 de junio de 2026. Detecta automáticamente el idioma y genera voz traducida de forma continua en más de 70 idiomas y 2.000 combinaciones lingüísticas, conservando entonación, ritmo y tono.

¿Cuál es un caso de uso biomédico de Gemini 3.5 Live Translate?

Interpretación de reuniones científicas internacionales: Usar detección de más de 70 idiomas y más de 2.000 combinaciones para retransmitir debates casi en tiempo real. Conservar audio original, transcripción y traducción, y revisar nombres propios y cifras.

📄 Documentación oficial

📝 Notas de actualización

Aún no hay notas de actualización.

🧪 Código de la vida relacionado

Aún no hay publicaciones relacionadas de Código de la vida.