Gemini 3.5 Live Translate
Modelo de traducción de voz a voz casi en tiempo real de Google, publicado el 9 de junio de 2026. Detecta automáticamente el idioma y genera voz traducida de forma continua en más de 70 idiomas y 2.000 combinaciones lingüísticas, conservando entonación, ritmo y tono.
Gemini 3.5 Live Translate es un modelo de traducción de voz a voz casi en tiempo real de Google, publicado el 9 de junio de 2026. Detecta automáticamente el idioma hablado y genera voz traducida de forma continua en más de 70 idiomas y 2.000 combinaciones. A diferencia de los sistemas que esperan a convertir voz en texto, traducir y sintetizar de nuevo, empieza a traducir antes de que termine la intervención, como un intérprete que sigue la frase. Está diseñado para conservar la entonación, la velocidad y el tono del hablante.
La interpretación automática tradicional puede introducir latencia, perder prosodia y degradarse con ruido. La traducción continua por streaming reduce esas interrupciones y mantiene el flujo de la conversación, incluso en entornos ruidosos. Esto puede resultar útil cuando la forma de hablar —énfasis o ansiedad— aporta información además del texto.
En reuniones de colaboración científica internacional, puede retransmitir en tiempo real debates entre investigadores que hablan distintos idiomas. La detección automática y la conservación del ritmo y la entonación pueden transmitir preguntas, objeciones y señales de riesgo con mayor naturalidad. La integración con plataformas, el acceso API, las regiones y las políticas de datos deben confirmarse oficialmente.
También puede evaluarse como capa de apoyo en entrevistas de pacientes y estudios de campo multilingües. Deben conservarse el audio original y una transcripción o traducción validada por profesionales. La precisión de terminología médica, separación de hablantes y tratamiento de números y medicamentos no está confirmada; no debe usarse sin revisión humana para decisiones clínicas o consentimiento.
💻 Requisitos del sistema
Consultar los requisitos oficiales
Consultar los requisitos oficiales
⚡ Instalación
4-1. Inicio rápido
La información disponible no confirma un comando de instalación ni el nombre del paquete SDK.
4-2. Instalación detallada
Consulte la documentación oficial de API, autenticación, plataformas admitidas y permisos. No se incluyen nombres de paquetes ni comandos no verificados.
🧬 Casos de uso en biociencias
Interpretación de reuniones científicas internacionales
Usar detección de más de 70 idiomas y más de 2.000 combinaciones para retransmitir debates casi en tiempo real. Conservar audio original, transcripción y traducción, y revisar nombres propios y cifras.
Apoyo a entrevistas de pacientes multilingües
La traducción continua ayuda al diálogo antes de que termine cada intervención y conserva entonación, ritmo y tono. Combinarla con intérprete profesional y verificación del original; no usarla sola para decisiones clínicas.
Estudios de campo internacionales en entornos ruidosos
Apoyar entrevistas multilingües en estudios epidemiológicos o ecológicos, vinculando grabación original, traducción y revisión del investigador, y comprobando errores de términos y números.
FAQ
¿Qué es Gemini 3.5 Live Translate?
Gemini 3.5 Live Translate es un modelo de traducción de voz a voz casi en tiempo real de Google, publicado el 9 de junio de 2026. Detecta automáticamente el idioma hablado y genera voz traducida de forma continua en más de 70 idiomas y 2.000 combinaciones. A diferencia de los sistemas que esperan a convertir voz en texto, traducir y sintetizar de nuevo, empieza a traducir antes de que termine la intervención, como un intérprete que sigue la frase. Está diseñado para conservar la entonación, la velocidad y el tono del hablante. La interpretación automática tradicional puede introducir latencia, perder prosodia y degradarse con ruido. La traducción continua por streaming reduce esas interrupciones y mantiene el flujo de la conversación, incluso en entornos ruidosos. Esto puede resultar útil cuando la forma de hablar —énfasis o ansiedad— aporta información además del texto. En reuniones de colaboración científica internacional, puede retransmitir en tiempo real debates entre investigadores que hablan distintos idiomas. La detección automática y la conservación del ritmo y la entonación pueden transmitir preguntas, objeciones y señales de riesgo con mayor naturalidad. La integración con plataformas, el acceso API, las regiones y las políticas de datos deben confirmarse oficialmente. También puede evaluarse como capa de apoyo en entrevistas de pacientes y estudios de campo multilingües. Deben conservarse el audio original y una transcripción o traducción validada por profesionales. La precisión de terminología médica, separación de hablantes y tratamiento de números y medicamentos no está confirmada; no debe usarse sin revisión humana para decisiones clínicas o consentimiento.
¿Cuándo debería usar Gemini 3.5 Live Translate?
Modelo de traducción de voz a voz casi en tiempo real de Google, publicado el 9 de junio de 2026. Detecta automáticamente el idioma y genera voz traducida de forma continua en más de 70 idiomas y 2.000 combinaciones lingüísticas, conservando entonación, ritmo y tono.
¿Cuál es un caso de uso biomédico de Gemini 3.5 Live Translate?
Interpretación de reuniones científicas internacionales: Usar detección de más de 70 idiomas y más de 2.000 combinaciones para retransmitir debates casi en tiempo real. Conservar audio original, transcripción y traducción, y revisar nombres propios y cifras.
📝 Notas de actualización
Aún no hay notas de actualización.
🧪 Código de la vida relacionado
Aún no hay publicaciones relacionadas de Código de la vida.