O Google anunciou o Gemini 3.5 Live Translate em 9 de junho como um sistema de tradução contínua por voz. A empresa disse que ele detecta automaticamente mais de 70 idiomas e pode cobrir mais de 2.000 combinações linguísticas em uma reunião. O produto foi concebido para manter o fluxo da conversa sem exigir que cada pessoa escolha um idioma nem aguarde uma sequência rígida de falas separadas.

O Google afirmou que o modelo procura preservar entonação, ritmo e altura da voz, em vez de reduzir a fala apenas às palavras. Essas características podem carregar significado em uma conversa, especialmente quando os participantes se interrompem, hesitam ou enfatizam uma frase. O anúncio descreve o comportamento pretendido, mas não demonstra precisão ou naturalidade equivalentes em todos os pares de idiomas.

Uma prévia pública foi aberta na Gemini Live API e no Google AI Studio. Integrações com Google Translate e Google Meet foram anunciadas como futuras, portanto o acesso à prévia não deve ser confundido com uma distribuição concluída em todos os produtos do Google para consumidores e empresas. Preços, regiões e identificadores de modelo devem ser conferidos na documentação atual antes de qualquer implementação.

A mudança pode ser útil em viagens, reuniões, atendimento ao cliente e aprendizado de idiomas porque a camada de tradução permanece ativa enquanto as pessoas falam. Essas situações também expõem seus limites com mais facilidade. Sotaques, alternância de idiomas, vozes sobrepostas e ruído de fundo podem afetar um sistema que se sai bem em uma demonstração controlada.

A quantidade de idiomas, portanto, é apenas a especificação inicial. Uma comparação relevante exigirá as mesmas gravações, os mesmos falantes e o mesmo método de pontuação entre os sistemas, com falantes nativos avaliando se tom e sentido foram preservados. Até que esses dados existam, as afirmações de alcance e qualidade do Google devem permanecer atribuídas à empresa, não virar um veredito sobre o melhor tradutor.

O que observar agora

As próximas evidências úteis serão testes multilíngues externos e detalhes confirmados sobre a distribuição no Google Translate, no Meet, nas regiões e nos preços.

Fontes

Este arquivo retrospectivo do lançamento foi preparado em 3 de agosto de 2026 com o anúncio do Google, o cartão do modelo e a documentação da API, além de uma reportagem da Ars Technica para contextualização. A AI News of Today não fez um teste multilíngue para esta matéria.

Sempre que possível, incluímos links para documentos originais e reportagens em primeira mão.

  1. Google announcementFonte primária · 9 de junho de 2026
  2. Google DeepMind audio model cardFonte primária · 9 de junho de 2026
  3. Gemini API model documentationContexto · 9 de junho de 2026
  4. Ars Technica coverageReportagem · 9 de junho de 2026