O Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking são nossos modelos de diálogo ao vivo mais avançados até hoje. Grandes atualizações em inteligência e raciocínio paralelo tornam a colaboração e a execução de tarefas complexas por voz muito mais intuitivas.
Hoje, apresentamos dois novos modelos que trazem avanços no raciocínio quase em tempo real para habilitar agentes de voz com mais eficácia, tornando a conversa com a IA mais intuitiva e inteligente.
- Gemini 3.8 Live: Criado para escala e eficiência de custos, combinando inteligência conversacional com diálogos fluidos e ancoragem visual.
- Gemini 3.8 Live Extended Thinking: Criado para tarefas de alta complexidade, com maior inteligência e raciocínio em múltiplas etapas.
Para desenvolvedores e empresas, esses modelos fornecem os blocos de construção para agentes de voz confiáveis e prontos para produção. Eles também tornam a interação com o Gemini no aplicativo Gemini, no Google Workspace e na Busca mais fluida e colaborativa — ajudando você a resolver tarefas complexas usando apenas a voz.
Experimente conversas mais fluidas e inteligentes
O Gemini 3.8 Live Extended Thinking oferece conclusão de tarefas e inteligência de nível corporativo, conquistando o 1º lugar geral no Índice de Qualidade de Voz para Voz da Artificial Analysis (82,6), e lidera na conclusão de tarefas agênticas com 68,6% no τ-Voice e 35,1% no benchmark τ-Voice-banking da Sierra. Ele também fornece capacidades sólidas de raciocínio, obtendo 97,7% no Big Bench Audio, enquanto mantém um ponto de preço altamente competitivo em comparação com outros modelos de fronteira.
O Gemini 3.8 Live demonstrou alta preferência entre os usuários, garantindo o segundo lugar na Arena de Agentes de Voz. Além desse desempenho, ele permanece altamente econômico — oferecendo a desenvolvedores e empresas um modelo capaz e eficiente, construído para escala.




No EVA-Bench da ServiceNow, um benchmark para avaliar agentes de voz, nossos modelos expandem a Fronteira de Pareto para fluxos de trabalho complexos, equilibrando com sucesso a precisão com a qualidade conversacional.

O Gemini 3.8 Live processa entradas visuais quase em tempo real, enriquecendo as conversas com contexto para respostas mais úteis. Ele detecta automaticamente e alterna entre 97 idiomas suportados durante a conversa. Executa ferramentas e chamadas de API em segundo plano enquanto continua a conversa, permitindo que o modelo reconheça solicitações e mantenha o bate-papo enquanto as tarefas são concluídas nos bastidores.

O Gemini 3.8 Live orienta a integração de funcionários em tempo real, usando contexto visual para responder a perguntas ao vivo.

Assista ao Gemini 3.8 Live jogar xadrez quase em tempo real usando contexto visual, raciocínio e fluxo conversacional natural.
Para tarefas que exigem raciocínio mais profundo, o 3.8 Live Extended Thinking raciocina e fala simultaneamente. Ele oferece maior inteligência para fluxos de trabalho complexos, mantendo um fluxo conversacional ininterrupto — usando pistas verbais iniciais como "Deixe-me verificar isso..." para reconhecer prompts naturalmente, e narração de progresso ao vivo para guiar os usuários através de tarefas em segundo plano de várias etapas conforme elas progridem.

Assista ao Gemini 3.8 Live Extended Thinking transformar rascunhos brutos e feedback de voz em tempo real em componentes React funcionais.

Veja o Gemini 3.8 Live Extended Thinking coordenar reservas de várias etapas e chamadas de funções assíncronas — tudo sem interromper a conversa ao vivo natural.

Assista ao Gemini 3.8 Live criar planos de negócios completos e kits de ferramentas de marketing personalizados instantaneamente através da fala natural.
Em todo o Google Workspace e na Busca, nossos modelos Live oferecem experiências mais intuitivas e colaborativas — especialmente ao enfrentar suas tarefas mais complexas.

Experimente o Gemini 3.8 Live Extended Thinking no Google Workspace com Docs Live, Gmail Live e Keep Live.

Obtenha ajuda passo a passo para solução de problemas em tempo real, impulsionada pelo Gemini 3.8 Live — diretamente dentro do Search Live.
Capacitando o ecossistema de voz para desenvolvedores e empresas
Ao usar a API Gemini Live, plataformas de desenvolvimento como Agora, Fishjam, LiveKit, Pipecat, Vercel e Vision Agents permitem que desenvolvedores construam e implantem interfaces acionadas por voz de alto desempenho com facilidade. Essas plataformas gerenciam a infraestrutura complexa de streaming de mídia em tempo real nos bastidores, permitindo que os desenvolvedores se concentrem inteiramente na criação da experiência do usuário.
Também estamos fazendo parcerias com empresas como Salesforce, Genspark e Lumeris, que estão entusiasmadas com o 3.8 Live e o 3.8 Live Extended Thinking, destacando sua impressionante latência, fluidez e capacidades de chamada de ferramentas.











Garanta transparência com marca d'água SynthID
Todo o áudio gerado por nossos produtos de IA é marcado com SynthID. Esta marca d'água imperceptível é tecida diretamente na saída de áudio, garantindo que o conteúdo gerado por IA permaneça detectável para ajudar a prevenir desinformação. Para detalhes sobre nossa abordagem de segurança e responsabilidade, revise a ficha técnica do modelo.
Comece a usar nossos mais recentes modelos de Áudio Gemini:
O 3.8 Live está sendo lançado a partir de hoje:
- Para desenvolvedores: Na API Gemini via Google AI Studio
- Para empresas: Em prévia privada no Gemini Enterprise e chegando em breve ao Gemini Enterprise for Customer Experience.
- Para todos: No Search Live
O 3.8 Live Extended Thinking está sendo lançado a partir de hoje:
- Para desenvolvedores: Na API Gemini via Google AI Studio
- Para empresas: Em prévia privada no Gemini Enterprise e chegando em breve ao Gemini Enterprise for Customer Experience e para clientes empresariais do Google Workspace.
- Para todos: No Gemini Live e para assinantes do Google AI Pro e Ultra no Workspace no Docs, e para todos os assinantes do Google AI no Gmail e Keep





