Apresentando o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking

121K
1.6K
127
61
339

TL;DR

O Google apresenta o Gemini 3.8 Live e o Extended Thinking, oferecendo IA de voz avançada com raciocínio paralelo, contexto visual em tempo real e execução de tarefas em segundo plano para desenvolvedores e empresas.

O Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking são nossos modelos de diálogo ao vivo mais avançados até hoje. Grandes atualizações em inteligência e raciocínio paralelo tornam a colaboração e a execução de tarefas complexas por voz muito mais intuitivas.

Hoje, apresentamos dois novos modelos que trazem avanços no raciocínio quase em tempo real para habilitar agentes de voz com mais eficácia, tornando a conversa com a IA mais intuitiva e inteligente.

  • Gemini 3.8 Live: Criado para escala e eficiência de custos, combinando inteligência conversacional com diálogos fluidos e ancoragem visual.
  • Gemini 3.8 Live Extended Thinking: Criado para tarefas de alta complexidade, com maior inteligência e raciocínio em várias etapas.

Para desenvolvedores e empresas, esses modelos fornecem os blocos de construção para agentes de voz confiáveis e prontos para produção. Eles também tornam a fala com o Gemini no aplicativo Gemini, no Google Workspace e na Pesquisa mais fluida e colaborativa — ajudando você a resolver tarefas complexas usando apenas sua voz.

Experimente conversas mais fluidas e inteligentes

O Gemini 3.8 Live Extended Thinking oferece conclusão de tarefas e inteligência de nível corporativo, conquistando o 1º lugar geral no Índice de Qualidade de Voz para Voz da Artificial Analysis (82,6), e lidera na conclusão de tarefas agênticas com 68,6% no τ-Voice e 35,1% no benchmark τ-Voice-banking da Sierra. Ele também fornece fortes capacidades de raciocínio, pontuando 97,7% no Big Bench Audio, enquanto mantém um preço altamente competitivo em comparação com outros modelos de fronteira.

O Gemini 3.8 Live mostrou uma alta preferência entre os usuários, garantindo o segundo lugar na Arena de Agentes de Voz. Além desse desempenho, ele permanece altamente econômico — fornecendo a desenvolvedores e empresas um modelo capaz e eficiente, construído para escala.

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

No EVA-Bench da ServiceNow, um benchmark para avaliar agentes de voz, nossos modelos expandem a Fronteira de Pareto para fluxos de trabalho complexos, equilibrando com sucesso a precisão com a qualidade conversacional.

Google AI Studio - inline image

O Gemini 3.8 Live processa entradas visuais quase em tempo real, enriquecendo as conversas com contexto para respostas mais úteis. Ele detecta automaticamente e transita entre 97 idiomas suportados durante a conversa. Executa ferramentas e chamadas de API em segundo plano enquanto continua a conversa, permitindo que o modelo reconheça solicitações e mantenha o bate-papo enquanto as tarefas são concluídas nos bastidores.

Google AI Studio - inline image

O Gemini 3.8 Live orienta a integração de funcionários em tempo real, usando contexto visual para responder a perguntas ao vivo.

Google AI Studio - inline image

Assista ao Gemini 3.8 Live jogar xadrez quase em tempo real usando contexto visual, raciocínio e fluxo conversacional natural.

Para tarefas que exigem um raciocínio mais profundo, o 3.8 Live Extended Thinking raciocina e fala simultaneamente. Ele entrega maior inteligência para fluxos de trabalho complexos, mantendo um fluxo conversacional ininterrupto — usando pistas verbais iniciais como "Deixe-me verificar isso..." para reconhecer prompts naturalmente, e narração de progresso ao vivo para guiar os usuários através de tarefas em segundo plano de várias etapas conforme elas progridem.

Google AI Studio - inline image

Assista ao Gemini 3.8 Live Extended Thinking transformar esboços brutos e feedback de voz em tempo real em componentes React funcionais.

Google AI Studio - inline image

Veja o Gemini 3.8 Live Extended Thinking coordenar reservas de várias etapas e chamadas de funções assíncronas — tudo sem interromper a conversa ao vivo natural.

Google AI Studio - inline image

Assista ao Gemini 3.8 Live criar planos de negócios completos e kits de ferramentas de marketing personalizados instantaneamente através da fala natural.

Em todo o Google Workspace e Pesquisa, nossos modelos Live oferecem experiências mais intuitivas e colaborativas — especialmente ao enfrentar suas tarefas mais complexas.

Google AI Studio - inline image

Experimente o Gemini 3.8 Live Extended Thinking no Google Workspace com Docs Live, Gmail Live e Keep Live.

Google AI Studio - inline image

Obtenha ajuda passo a passo para solução de problemas em tempo real, alimentada pelo Gemini 3.8 Live—diretamente dentro do Search Live.

Capacitando o ecossistema de voz para desenvolvedores e empresas

Ao usar a API Gemini Live, plataformas de desenvolvimento como Agora, Fishjam, LiveKit, Pipecat, Vercel e Vision Agents permitem que desenvolvedores construam e implantem interfaces acionadas por voz de alto desempenho com facilidade. Essas plataformas gerenciam a infraestrutura complexa de streaming de mídia em tempo real nos bastidores, permitindo que os desenvolvedores se concentrem inteiramente na criação da experiência do usuário.

Também estamos fazendo parcerias com empresas como Salesforce, Genspark e Lumeris, que estão entusiasmadas com o 3.8 Live e o 3.8 Live Extended Thinking, destacando sua impressionante latência, fluidez e capacidades de chamada de ferramentas.

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

Garanta transparência com marca d'água SynthID

Todo o áudio gerado por nossos produtos de IA é marcado com SynthID. Esta marca d'água imperceptível é tecida diretamente na saída de áudio, garantindo que o conteúdo gerado por IA permaneça detectável para ajudar a prevenir desinformação. Para detalhes sobre nossa abordagem de segurança e responsabilidade, revise a ficha técnica do modelo.

Comece a usar nossos mais recentes modelos de Áudio Gemini:

O 3.8 Live está sendo lançado a partir de hoje:

O 3.8 Live Extended Thinking está sendo lançado a partir de hoje:

Guardar com um clique

Faça leitura aprofundada de artigos virais com IA no YouMind

Guarde a fonte, faça perguntas específicas, resuma o argumento e transforme um artigo viral em notas reutilizáveis num único espaço de trabalho com IA.

Explorar o YouMind
Para criadores

Transforme o seu Markdown num artigo 𝕏 impecável

Quando publica os seus próprios textos longos, formatar imagens, tabelas e blocos de código para o 𝕏 é uma dor de cabeça. O YouMind transforma um rascunho completo em Markdown num artigo 𝕏 impecável e pronto a publicar.

Experimente Markdown para 𝕏

Mais padrões para decifrar

Artigos virais recentes

Explorar mais artigos virais