Google anunció Gemini 3.5 Live Translate el 9 de junio como un sistema de traducción de voz continua. La empresa dijo que detecta automáticamente más de 70 idiomas y puede abarcar más de 2.000 combinaciones lingüísticas en una reunión. El producto busca mantener la fluidez de la conversación sin obligar a cada participante a elegir un idioma y esperar una secuencia rígida de turnos separados.

Google señaló que el modelo intenta conservar la entonación, el ritmo y el tono, en lugar de reducir el habla únicamente a palabras. Esas cualidades pueden transmitir significado, sobre todo cuando los interlocutores interrumpen, dudan o subrayan una frase. El anuncio describe el comportamiento previsto, pero no demuestra la misma precisión o naturalidad en todos los pares de idiomas.

La versión preliminar pública se abrió a través de la API de Gemini Live y Google AI Studio. Las integraciones con Google Translate y Google Meet se anunciaron para más adelante, por lo que el acceso a la versión preliminar no equivale a un despliegue completo en los productos para consumidores y empresas de Google. Antes de desarrollar una integración se deben revisar en la documentación vigente los precios, el acceso regional y los identificadores del modelo.

El cambio puede resultar útil en viajes, reuniones, atención al cliente y aprendizaje de idiomas porque la capa de traducción permanece activa mientras las personas hablan. En esos entornos también se hacen visibles sus límites. Los acentos, la mezcla de idiomas, las voces superpuestas y el ruido de fondo pueden afectar a un sistema que funciona bien en una demostración limpia.

El número de idiomas es solo la especificación inicial. Una comparación sólida necesitará las mismas grabaciones, voces y métodos de puntuación, con hablantes nativos que evalúen si se conservan el tono y el sentido. Mientras no exista esa evidencia, las afirmaciones de Google sobre alcance y calidad deben seguir atribuidas a la compañía y no convertirse en un veredicto sobre el mejor traductor.

Qué viene ahora

La próxima evidencia útil será una evaluación multilingüe independiente y la confirmación del despliegue en Google Translate, Meet, las distintas regiones y los planes de precios.

Fuentes

Este archivo retrospectivo sobre el lanzamiento se preparó el 3 de agosto de 2026 a partir del anuncio, la ficha del modelo y la documentación de la API de Google, con información de Ars Technica como contexto. AI News of Today no realizó una prueba multilingüe para este artículo.

Siempre que es posible, enlazamos documentos originales y reportes de primera mano.

  1. Google announcementFuente primaria · 9 de junio de 2026
  2. Google DeepMind audio model cardFuente primaria · 9 de junio de 2026
  3. Gemini API model documentationContexto · 9 de junio de 2026
  4. Ars Technica coverageInformación periodística · 9 de junio de 2026