article

Google lança Gemini 3.8 Live por US$ 1,38 a hora

3 min de leitura

🎬 Assista esta matéria

O Google liberou em 15 de setembro dois novos modelos de áudio em tempo real: o Gemini 3.8 Live e a variante Gemini 3.8 Live Extended Thinking. Os dois entram pela API do Gemini e miram direto o principal produto de voz da OpenAI, o GPT-Live-1.

O diferencial anunciado é preço. O áudio de entrada custa US$ 0,005 por minuto e o de saída, US$ 0,018 por minuto — o que dá cerca de US$ 1,38 por hora de conversa. A OpenAI cobra US$ 0,05 por minuto no GPT-Live-1, o que coloca a hora equivalente em pelo menos US$ 3,00. A versão Extended Thinking, mais cara, sai por volta de US$ 3,50 a hora.

Fala enquanto pensa

A novidade técnica mais citada pelo Google é a capacidade de raciocinar e usar ferramentas sem interromper a conversa. O modelo consegue disparar chamadas de API em segundo plano e continuar falando com o usuário, em vez de deixar o silêncio incômodo que marca a maioria dos assistentes de voz atuais.

Os modelos também detectam e trocam de idioma no meio do diálogo, com suporte declarado a 97 línguas, e processam entrada visual em tempo quase real. Junto com os modelos de conversa, a empresa lançou o Gemini 3.5 Transcribe, voltado a transcrição.

No Speech-to-Speech Leaderboard da Artificial Analysis, a variante Extended Thinking aparece em primeiro lugar com 82,6%, à frente dos modelos de voz mais recentes da OpenAI. O índice mede qualidade de conversação ponta a ponta, sem passar por texto intermediário.

Terceiro lançamento em poucas semanas

O Gemini 3.8 Live chega na sequência do Gemini 3.8 Flash, anunciado dias antes junto de um modelo voltado a cibersegurança para clientes de governo e de grandes empresas. É a terceira leva de modelos Flash do Google em seis semanas, num ritmo que o setor inteiro vem acompanhando: só na primeira quinzena de setembro saíram Claude Fable 5.1, GPT-6 Astra, Gemini 3.8 Flash e DeepSeek V4.1-Flash.

Para quem constrói produto, o efeito prático é a queda do custo de agentes de voz em produção. Call centers, assistentes de atendimento e aplicações de acessibilidade eram até aqui limitados pelo preço por minuto — o principal obstáculo para deixar uma linha de voz aberta o dia inteiro.

O acesso varia conforme o plano contratado na API do Gemini, e o Google não detalhou limites de taxa por camada. A disponibilidade em português não foi listada separadamente, mas o idioma está entre os suportados pelo mecanismo multilíngue anunciado.

Fontes: Google · The Decoder · MarkTechPost

🎙️ Gostou? Receba só o que te interessa, todo dia

Escolha seus temas e receba um briefing diário em áudio e texto, de graça, no WhatsApp ou e-mail.

Montar meu briefing grátis