Google lançou o Gemini 3.5 Live Translate, um modelo de IA focado em tradução de voz para voz em tempo real, com suporte a mais de 70 idiomas. Diferente dos tradutores por turnos, o novo modelo começa a traduzir segundos depois que a pessoa começa a falar.

Create a landscape editorial hero image for this Studio Global article: What is Google's Gemini 3.5 Live Translate model, how does its streaming speech-to-speech translation work across more than 70 languages, an. Article summary: ## What It Is. Topic tags: general, general web, user generated, documentation. Reference image context from search candidates: Reference image 1: visual subject "# Google Launches Gemini 3.5 Live Translate in 70 Languages. Google has launched Gemini 3.5 Live Translate, a new AI powered speech translation model that enables near real time co" source context "Google Launches Gemini 3.5 Live Translate in 70 ..." Reference image 2: visual subject "Google Patches Chrome Zero Day Vulnerability Under Attack" source context "Google Launches Gemini 3.5 Live Translate in 70 ..." Style: premium digital editorial illustration, source-backed research mood, clean compositio
No dia 9 de junho de 2026, o Google liberou para o público seu modelo de tradução de áudio mais avançado até agora: o Gemini 3.5 Live Translate. Este modelo, com o código gemini-3.5-live-translate-preview, foi criado com uma missão principal — fazer tradução de fala para fala em tempo quase real e de maneira fluida. Ele entende mais de 70 idiomas e funciona em mais de 2.000 combinações de línguas, marcando uma grande diferença em relação aos tradutores que exigem pausas longas entre uma fala e outra .
O grande salto é que o novo modelo não espera você terminar uma frase inteira para começar a traduzir. Ele começa a processar e gerar o áudio traduzido em segundos, com o objetivo de deixar a conversa leve e natural, sem aqueles intervalos incômodos. O lançamento veio para coroar uma fase de testes que começou com demonstrações em dezembro de 2025 e foi se refinando com os modelos Gemini 3.1 flash live, no início de 2026 .
A maior inovação do Gemini 3.5 Live Translate é sua arquitetura de transmissão contínua e bidirecional. Isso é bem diferente dos sistemas tradicionais, que funcionam por turnos, e usa várias capacidades combinadas com maestria.
O modelo não espera. Ele transmite o áudio de entrada e, ao mesmo tempo, vai gerando a tradução. O Google explica que ele fica "apenas alguns segundos atrás de cada falante", o que elimina aquelas pausas que podem atrapalhar a conversa .
Você não precisa escolher o idioma manualmente. O modelo identifica na hora qual língua está sendo falada, automaticamente. Isso acontece mesmo em lugares onde vários idiomas estão sendo falados ao mesmo tempo, o que o torna perfeito para conversas dinâmicas do mundo real .
Um ponto crucial para a experiência do usuário é que a voz traduzida não sai com aquele tom robótico. O modelo foi feito para manter a entonação, o ritmo e o tom de voz do falante original. Com isso, a voz traduzida soa muito mais como a pessoa, e não parece um robô sintetizador de voz .
Com suporte a mais de 70 idiomas, o modelo cobre milhares de combinações bidirecionais. Ele foi pensado para conversas de mão dupla, onde cada pessoa pode ouvir a fala da outra traduzida para seu próprio idioma, de forma suave .
Para os desenvolvedores, o acesso é pela API Gemini Live. Ele exige um formato de áudio específico: raw, little-endian, áudio PCM de 16 bits com amostragem de 16kHz. O áudio traduzido que sai do modelo também é PCM bruto de 16 bits, mas com uma taxa de amostragem maior, de 24kHz . A janela de contexto do modelo permite até 128.000 tokens de entrada e 64.000 tokens de saída
.
A jornada do Google até este lançamento foi em fases, começando com o anúncio da família Gemini 3.5 na conferência Google I/O, em maio de 2026 .
gemini-3.1-flash-live-preview em 26 de março de 2026, que fizeram parte desse desenvolvimento gemini-3.5-live-translate-preview foi oficialmente lançado para desenvolvedores pela API Gemini Live e Google AI Studio, e para o público global por meio de atualizações do Google Tradutor para Android e iOS O modelo está sendo liberado em vários produtos do Google, com níveis de acesso diferentes.
É a forma mais simples para os consumidores. O recurso está chegando ao mundo todo pelo aplicativo do Google Tradutor. É só tocar no botão "Tradução ao vivo", no canto inferior esquerdo da tela, enquanto usa fones de ouvido. No Android, o Google também está lançando um "modo escuta" que não precisa das mãos e toca as traduções pelo alto-falante do celular, como se fosse uma ligação comum .
Para os devs, o modelo está disponível em uma prévia pública. Isso permite a integração em aplicativos e serviços de terceiros usando a API Gemini Live com configurações específicas de tradução. O Google AI Studio também oferece um ambiente de testes para criação de protótipos .
Para empresas, o acesso é mais restrito. O Gemini 3.5 Live Translate para o Google Meet chega em uma prévia privada para clientes empresariais selecionados a partir de junho de 2026. Quando disponível, o recurso vai detectar automaticamente o idioma de quem fala e traduzir para o idioma preferido de cada participante, com suporte a mais de 70 idiomas e mais de 2.000 combinações linguísticas durante as reuniões. Uma distribuição mais ampla está prevista para o final de 2026 . A novidade valerá para os planos Google Workspace Business Standard e Plus, Enterprise Standard e Plus, Google AI Pro e Google AI Ultra
.
Plataformas de comunicação em tempo real, como Agora, Fishjam, LiveKit, Pipecat e Vision Agents, já estão trabalhando para integrar a API Gemini Live e levar o modelo de tradução para seus próprios sistemas de mídia .
Um dos testes de mundo real mais interessantes é com a Grab, plataforma de transporte e entregas do Sudeste Asiático. A empresa testa a tecnologia para oferecer tradução de voz em tempo real entre motoristas e passageiros. A Grab gerencia mais de 10 milhões de chamadas de voz por mês, e este projeto encara de frente o desafio de um mercado com uma fragmentação linguística enorme .
A mudança da tradução por turnos para a tradução contínua é uma transformação fundamental na experiência do usuário. Ao integrar o modelo em produtos tão usados como o Google Tradutor e o Meet, e ao abri-lo para todo um ecossistema de desenvolvedores, o Google coloca a tradução de fala em tempo real como um novo padrão para a comunicação global, não mais como um recurso de nicho . O piloto com a Grab ilustra bem essa virada, posicionando a tradução instantânea e com som natural como uma utilidade básica, e não uma novidade
.
Vale destacar que todo áudio gerado por IA pelo modelo recebe uma marca d'água com a tecnologia SynthID do Google. Isso é para garantir que a origem do áudio seja detectável e para evitar usos indevidos – um cuidado essencial enquanto a tecnologia de voz sintética fica cada vez mais convincente .
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Google lançou o Gemini 3.5 Live Translate, um modelo de IA focado em tradução de voz para voz em tempo real, com suporte a mais de 70 idiomas.
Google lançou o Gemini 3.5 Live Translate, um modelo de IA focado em tradução de voz para voz em tempo real, com suporte a mais de 70 idiomas. Diferente dos tradutores por turnos, o novo modelo começa a traduzir segundos depois que a pessoa começa a falar.
A tecnologia já está sendo testada em situações reais. A Grab, empresa de transporte e entregas do Sudeste Asiático, utiliza o Gemini 3.5 em um projeto piloto para traduzir chamadas entre motoristas e passageiros [6][...