Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking son nuestros modelos de diálogo en vivo más avanzados hasta la fecha. Las importantes mejoras en inteligencia y razonamiento paralelo hacen que sea más intuitivo colaborar y ejecutar tareas complejas usando tu voz.
Hoy presentamos dos nuevos modelos que incorporan avances en el razonamiento casi en tiempo real para habilitar de manera más efectiva los agentes de voz y hacer que conversar con la IA se sienta más intuitivo e inteligente.
- Gemini 3.8 Live: Diseñado para escalar y optimizar costos, combina inteligencia conversacional con un diálogo fluido y comprensión visual del contexto.
- Gemini 3.8 Live Extended Thinking: Diseñado para tareas de alta complejidad, con mayor inteligencia y razonamiento en múltiples pasos.
Para desarrolladores y empresas, estos modelos ofrecen los componentes esenciales para crear agentes de voz confiables y listos para producción. También hacen que hablar con Gemini a través de la app de Gemini, Google Workspace y Search sea más fluido y colaborativo, ayudándote a resolver tareas complejas usando solo tu voz.
Experimenta conversaciones más fluidas e inteligentes
Gemini 3.8 Live Extended Thinking ofrece finalización de tareas e inteligencia de nivel empresarial, ocupando el primer lugar general en el Índice de Calidad de Voz a Voz de Artificial Analysis (82.6), y lidera en la finalización de tareas agénticas con un 68.6% en τ-Voice y un 35.1% en el benchmark τ-Voice-banking de Sierra. También proporciona sólidas capacidades de razonamiento, obteniendo una puntuación del 97.7% en Big Bench Audio, mientras mantiene un precio altamente competitivo en comparación con otros modelos de vanguardia.
Gemini 3.8 Live ha mostrado una alta preferencia entre los usuarios, asegurando el segundo lugar en Speech Agent Arena. Además de este rendimiento, sigue siendo altamente rentable, proporcionando a desarrolladores y empresas un modelo capaz y eficiente diseñado para escalar.




En EVA-Bench de ServiceNow, un benchmark para evaluar agentes de voz, nuestros modelos impulsan la Frontera de Pareto para flujos de trabajo complejos al equilibrar exitosamente la precisión con la calidad conversacional.

Gemini 3.8 Live procesa entradas visuales casi en tiempo real, enriqueciendo las conversaciones con contexto para respuestas más útiles. Detecta automáticamente y transiciona entre 97 idiomas soportados durante la conversación. Ejecuta herramientas y llamadas API en segundo plano mientras continúa la conversación, por lo que el modelo puede reconocer solicitudes y seguir charlando mientras las tareas se completan en segundo plano.

Gemini 3.8 Live guía la incorporación de empleados en tiempo real, utilizando contexto visual para responder preguntas en vivo.

Mira cómo Gemini 3.8 Live juega ajedrez casi en tiempo real utilizando contexto visual, razonamiento y flujo conversacional natural.
Para tareas que requieren un razonamiento más profundo, 3.8 Live Extended Thinking razona y habla simultáneamente. Ofrece mayor inteligencia para flujos de trabajo complejos mientras mantiene un flujo conversacional ininterrumpido, utilizando señales verbales iniciales como "Déjame revisar eso..." para reconocer las indicaciones de forma natural, y narración de progreso en vivo para guiar a los usuarios a través de tareas secundarias de múltiples pasos mientras avanzan.

Mira cómo Gemini 3.8 Live Extended Thinking transforma bocetos en bruto y retroalimentación de voz en tiempo real en componentes funcionales de React.

Vea cómo Gemini 3.8 Live Extended Thinking coordina reservas de múltiples pasos y llamadas de funciones asincrónicas, todo sin interrumpir la conversación natural en vivo.

Mira cómo Gemini 3.8 Live crea planes de negocio completos y kits de herramientas de marketing personalizados sobre la marcha mediante el habla natural.
En toda la suite de Google Workspace y Search, nuestros modelos Live ofrecen experiencias más intuitivas y colaborativas, especialmente al abordar tus tareas más complejas.

Prueba Gemini 3.8 Live Extended Thinking en Google Workspace con Docs Live, Gmail Live y Keep Live.

Obtén ayuda paso a paso para la resolución de problemas en tiempo real impulsada por Gemini 3.8 Live, directamente dentro de Search Live.
Potenciando el ecosistema de voz para desarrolladores y empresas
Al utilizar la API de Gemini Live, plataformas de desarrollo como Agora, Fishjam, LiveKit, Pipecat, Vercel y Vision Agents permiten a los desarrolladores construir e implementar interfaces impulsadas por voz de alto rendimiento con facilidad. Estas plataformas gestionan la infraestructura compleja de transmisión de medios en tiempo real detrás de escena, permitiendo a los desarrolladores enfocarse completamente en diseñar la experiencia de usuario.
También nos estamos asociando con empresas como Salesforce, Genspark y Lumeris, que están emocionadas con 3.8 Live y 3.8 Live Extended Thinking, destacando su impresionante latencia, fluidez y capacidades de llamada de herramientas.











Garantiza la transparencia con marcas de agua SynthID
Todo el audio generado por nuestros productos de IA está marcado con SynthID. Esta marca de agua imperceptible se integra directamente en la salida de audio, asegurando que el contenido generado por IA siga siendo detectable para ayudar a prevenir la desinformación. Para obtener detalles sobre nuestro enfoque de seguridad y responsabilidad, revisa la ficha técnica del modelo.
Comienza a usar nuestros últimos modelos de audio de Gemini:
3.8 Live se lanza a partir de hoy:
- Para desarrolladores: En la API de Gemini a través de Google AI Studio
- Para empresas: En vista previa privada en Gemini Enterprise y próximamente disponible en Gemini Enterprise for Customer Experience
- Para todos: En Search Live
3.8 Live Extended Thinking se lanza a partir de hoy:
- Para desarrolladores: En la API de Gemini a través de Google AI Studio
- Para empresas: En vista previa privada en Gemini Enterprise y próximamente disponible para clientes empresariales de Gemini Enterprise for Customer Experience y Google Workspace.
- Para todos: En Gemini Live y para suscriptores de Google AI Pro y Ultra en Workspace en Docs, y para todos los suscriptores de Google AI en Gmail y Keep





