O Google anunciou o lançamento do Gemini 3.5 Live Translate, um novo modelo de áudio que permite tradução de voz em tempo real para mais de 70 idiomas. Diferente de sistemas tradicionais que aguardam o fim da fala para responder, o modelo gera áudio continuamente, mantendo-se apenas alguns segundos atrás do interlocutor. A tecnologia preserva entonação, ritmo e tom do falante original, resultando em uma tradução mais natural e fluida.

O modelo já está sendo integrado a produtos como o Google Tradutor (aplicativo Android e iOS) e o Google AI Studio. No Google Meet, a funcionalidade chegará primeiro em versão preliminar para clientes empresariais do Google Workspace ainda este mês, com expansão prevista para o segundo semestre. Para usuários do Google Tradutor, o recurso de tradução ao vivo agora funciona com fones de ouvido e inclui um novo “modo de escuta” que permite ouvir a tradução diretamente pelo fone do aparelho, sem necessidade de headphones.
Desenvolvedores também podem acessar o modelo por meio da Gemini Live API, que já conta com integrações de plataformas como Agora, LiveKit e Pipecat. A empresa de mobilidade Grab está testando a tecnologia para facilitar a comunicação entre motoristas e passageiros em chamadas de voz — são mais de 10 milhões de ligações por mês. A CJ ENM e outras empresas também relataram feedback positivo sobre a qualidade e a baixa latência da tradução.
Todo áudio gerado pelo Gemini 3.5 Live Translate recebe marca d’água digital com a tecnologia SynthID, garantindo rastreabilidade e ajudando a evitar desinformação. Para o público brasileiro, a novidade pode ser especialmente útil em viagens, reuniões multilíngues e no consumo de conteúdo estrangeiro, já que o português está entre os idiomas suportados. O Google reforça que o modelo foi desenvolvido com foco em segurança e responsabilidade, com detalhes disponíveis na ficha técnica do produto.