Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking son nuestros modelos de diálogo en vivo más avanzados hasta la fecha. Las importantes mejoras en inteligencia y razonamiento paralelo hacen que sea más intuitivo colaborar y ejecutar tareas complejas usando tu voz.
Hoy, presentamos dos nuevos modelos que incorporan avances en el razonamiento casi en tiempo real para habilitar de manera más efectiva los agentes de voz y hacer que conversar con la IA se sienta más intuitivo e inteligente.
- Gemini 3.8 Live: Diseñado para escalabilidad y eficiencia de costos, combina inteligencia conversacional con un diálogo fluido y fundamentación visual (visual grounding).
- Gemini 3.8 Live Extended Thinking: Diseñado para tareas de alta complejidad, con mayor inteligencia y razonamiento en múltiples pasos.
Para desarrolladores y empresas, estos modelos ofrecen los componentes básicos para crear agentes de voz fiables y listos para producción. También hacen que hablar con Gemini a través de la app de Gemini, Google Workspace y Search sea más fluido y colaborativo — ayudándote a abordar tareas complejas usando solo tu voz.
Experimenta conversaciones más fluidas e inteligentes
Gemini 3.8 Live Extended Thinking ofrece finalización de tareas y nivel de inteligencia de grado empresarial, ocupando el puesto #1 general en el Índice de Calidad de Voz a Voz de Artificial Analysis (82.6), y lidera en la finalización de tareas agénticas con un 68.6% en τ-Voice y un 35.1% en el benchmark τ-Voice-banking de Sierra. También proporciona sólidas capacidades de razonamiento, obteniendo una puntuación del 97.7% en Big Bench Audio, mientras mantiene un punto de precio altamente competitivo en comparación con otros modelos de frontera.
Gemini 3.8 Live ha mostrado una alta preferencia entre los usuarios, asegurando el segundo lugar en la Arena de Agentes de Voz. Además de este rendimiento, sigue siendo altamente rentable, proporcionando a desarrolladores y empresas un modelo capaz y eficiente diseñado para escalar.




En EVA-Bench de ServiceNow, un benchmark para evaluar agentes de voz, nuestros modelos empujan la Frontera de Pareto para flujos de trabajo complejos al equilibrar con éxito la precisión con la calidad conversacional.

Gemini 3.8 Live procesa entradas visuales casi en tiempo real, enriqueciendo las conversaciones con contexto para respuestas más útiles. Detecta automáticamente y transiciona entre 97 idiomas soportados durante la conversación. Ejecuta herramientas y llamadas API en segundo plano mientras continúa la conversación, por lo que el modelo puede reconocer las solicitudes y seguir charlando mientras las tareas finalizan en segundo plano.

Gemini 3.8 Live guía la incorporación de empleados en tiempo real, utilizando contexto visual para responder preguntas en vivo.

Mira a Gemini 3.8 Live jugar ajedrez casi en tiempo real utilizando contexto visual, razonamiento y flujo conversacional natural.
Para tareas que requieren un razonamiento más profundo, 3.8 Live Extended Thinking razona y habla simultáneamente. Ofrece una mayor inteligencia para flujos de trabajo complejos mientras mantiene un flujo conversacional ininterrumpido — utilizando señales verbales tempranas como "Déjame revisar eso..." para reconocer las instrucciones de forma natural, y narración de progreso en vivo para guiar a los usuarios a través de tareas en segundo plano de múltiples pasos a medida que avanzan.

Mira a Gemini 3.8 Live Extended Thinking transformar bocetos en bruto y retroalimentación de voz en tiempo real en componentes funcionales de React.

Vea cómo Gemini 3.8 Live Extended Thinking coordina reservas de múltiples pasos y llamadas de funciones asíncronas — todo sin interrumpir la conversación en vivo natural.

Mira a Gemini 3.8 Live construir planes de negocio completos y kits de herramientas de marketing personalizados sobre la marcha mediante el habla natural.
A través de Google Workspace y Search, nuestros modelos Live ofrecen experiencias más intuitivas y colaborativas — especialmente al abordar tus tareas más complejas.

Prueba Gemini 3.8 Live Extended Thinking en Google Workspace con Docs Live, Gmail Live y Keep Live.

Obtén ayuda de solución de problemas paso a paso y en tiempo real impulsada por Gemini 3.8 Live — directamente dentro de Search Live.
Potenciando el ecosistema de voz para desarrolladores y empresas
Al utilizar la API de Gemini Live, plataformas de desarrollo como Agora, Fishjam, LiveKit, Pipecat, Vercel y Vision Agents permiten a los desarrolladores crear e implementar interfaces de alto rendimiento impulsadas por voz con facilidad. Estas plataformas gestionan la infraestructura compleja de transmisión de medios en tiempo real entre bastidores, permitiendo a los desarrolladores centrarse completamente en diseñar la experiencia de usuario.
También estamos asociándonos con empresas como Salesforce, Genspark y Lumeris, que están entusiasmadas con 3.8 Live y 3.8 Live Extended Thinking, destacando su impresionante latencia, fluidez y capacidades de llamada a herramientas.











Garantiza la transparencia con marcas de agua SynthID
Todo el audio generado por nuestros productos de IA está marcado con SynthID. Esta marca de agua imperceptible se teje directamente en la salida de audio, asegurando que el contenido generado por IA permanezca detectable para ayudar a prevenir la desinformación. Para obtener detalles sobre nuestro enfoque de seguridad y responsabilidad, revisa la ficha técnica del modelo (model card).
Comienza a usar nuestros últimos modelos de audio de Gemini:
3.8 Live se lanza a partir de hoy:
- Para desarrolladores: En la API de Gemini a través de Google AI Studio
- Para empresas: En vista previa privada en Gemini Enterprise y próximamente en Gemini Enterprise for Customer Experience
- Para todos: En Search Live
3.8 Live Extended Thinking se lanza a partir de hoy:
- Para desarrolladores: En la API de Gemini a través de Google AI Studio
- Para empresas: En vista previa privada en Gemini Enterprise y próximamente en Gemini Enterprise for Customer Experience y clientes empresariales de Google Workspace.
- Para todos: En Gemini Live y para suscriptores de Google AI Pro y Ultra en Workspace en Docs, y todos los suscriptores de Google AI en Gmail y Keep





