Presentación de Gemini 3.8 Live y Extended Thinking

@GoogleAIStudio
INGLÉS15 sept 2026
121K
1.6K
127
61
339

TL;DR

Google presenta Gemini 3.8 Live y Extended Thinking, ofreciendo IA de voz avanzada con razonamiento paralelo, contexto visual en tiempo real y ejecución de tareas en segundo plano para desarrolladores y empresas.

Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking son nuestros modelos de diálogo en vivo más avanzados hasta la fecha. Las importantes mejoras en inteligencia y razonamiento paralelo hacen que sea más intuitivo colaborar y ejecutar tareas complejas usando tu voz.

Hoy presentamos dos nuevos modelos que incorporan avances en el razonamiento casi en tiempo real para habilitar de manera más efectiva los agentes de voz y hacer que conversar con la IA se sienta más intuitivo e inteligente.

  • Gemini 3.8 Live: Diseñado para escalar y optimizar costos, combina inteligencia conversacional con un diálogo fluido y comprensión visual del contexto.
  • Gemini 3.8 Live Extended Thinking: Diseñado para tareas de alta complejidad, con mayor inteligencia y razonamiento en múltiples pasos.

Para desarrolladores y empresas, estos modelos ofrecen los componentes esenciales para crear agentes de voz confiables y listos para producción. También hacen que hablar con Gemini a través de la app de Gemini, Google Workspace y Search sea más fluido y colaborativo, ayudándote a resolver tareas complejas usando solo tu voz.

Experimenta conversaciones más fluidas e inteligentes

Gemini 3.8 Live Extended Thinking ofrece finalización de tareas e inteligencia de nivel empresarial, ocupando el primer lugar general en el Índice de Calidad de Voz a Voz de Artificial Analysis (82.6), y lidera en la finalización de tareas agénticas con un 68.6% en τ-Voice y un 35.1% en el benchmark τ-Voice-banking de Sierra. También proporciona sólidas capacidades de razonamiento, obteniendo una puntuación del 97.7% en Big Bench Audio, mientras mantiene un precio altamente competitivo en comparación con otros modelos de vanguardia.

Gemini 3.8 Live ha mostrado una alta preferencia entre los usuarios, asegurando el segundo lugar en Speech Agent Arena. Además de este rendimiento, sigue siendo altamente rentable, proporcionando a desarrolladores y empresas un modelo capaz y eficiente diseñado para escalar.

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

En EVA-Bench de ServiceNow, un benchmark para evaluar agentes de voz, nuestros modelos impulsan la Frontera de Pareto para flujos de trabajo complejos al equilibrar exitosamente la precisión con la calidad conversacional.

Google AI Studio - inline image

Gemini 3.8 Live procesa entradas visuales casi en tiempo real, enriqueciendo las conversaciones con contexto para respuestas más útiles. Detecta automáticamente y transiciona entre 97 idiomas soportados durante la conversación. Ejecuta herramientas y llamadas API en segundo plano mientras continúa la conversación, por lo que el modelo puede reconocer solicitudes y seguir charlando mientras las tareas se completan en segundo plano.

Google AI Studio - inline image

Gemini 3.8 Live guía la incorporación de empleados en tiempo real, utilizando contexto visual para responder preguntas en vivo.

Google AI Studio - inline image

Mira cómo Gemini 3.8 Live juega ajedrez casi en tiempo real utilizando contexto visual, razonamiento y flujo conversacional natural.

Para tareas que requieren un razonamiento más profundo, 3.8 Live Extended Thinking razona y habla simultáneamente. Ofrece mayor inteligencia para flujos de trabajo complejos mientras mantiene un flujo conversacional ininterrumpido, utilizando señales verbales iniciales como "Déjame revisar eso..." para reconocer las indicaciones de forma natural, y narración de progreso en vivo para guiar a los usuarios a través de tareas secundarias de múltiples pasos mientras avanzan.

Google AI Studio - inline image

Mira cómo Gemini 3.8 Live Extended Thinking transforma bocetos en bruto y retroalimentación de voz en tiempo real en componentes funcionales de React.

Google AI Studio - inline image

Vea cómo Gemini 3.8 Live Extended Thinking coordina reservas de múltiples pasos y llamadas de funciones asincrónicas, todo sin interrumpir la conversación natural en vivo.

Google AI Studio - inline image

Mira cómo Gemini 3.8 Live crea planes de negocio completos y kits de herramientas de marketing personalizados sobre la marcha mediante el habla natural.

En toda la suite de Google Workspace y Search, nuestros modelos Live ofrecen experiencias más intuitivas y colaborativas, especialmente al abordar tus tareas más complejas.

Google AI Studio - inline image

Prueba Gemini 3.8 Live Extended Thinking en Google Workspace con Docs Live, Gmail Live y Keep Live.

Google AI Studio - inline image

Obtén ayuda paso a paso para la resolución de problemas en tiempo real impulsada por Gemini 3.8 Live, directamente dentro de Search Live.

Potenciando el ecosistema de voz para desarrolladores y empresas

Al utilizar la API de Gemini Live, plataformas de desarrollo como Agora, Fishjam, LiveKit, Pipecat, Vercel y Vision Agents permiten a los desarrolladores construir e implementar interfaces impulsadas por voz de alto rendimiento con facilidad. Estas plataformas gestionan la infraestructura compleja de transmisión de medios en tiempo real detrás de escena, permitiendo a los desarrolladores enfocarse completamente en diseñar la experiencia de usuario.

También nos estamos asociando con empresas como Salesforce, Genspark y Lumeris, que están emocionadas con 3.8 Live y 3.8 Live Extended Thinking, destacando su impresionante latencia, fluidez y capacidades de llamada de herramientas.

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

Garantiza la transparencia con marcas de agua SynthID

Todo el audio generado por nuestros productos de IA está marcado con SynthID. Esta marca de agua imperceptible se integra directamente en la salida de audio, asegurando que el contenido generado por IA siga siendo detectable para ayudar a prevenir la desinformación. Para obtener detalles sobre nuestro enfoque de seguridad y responsabilidad, revisa la ficha técnica del modelo.

Comienza a usar nuestros últimos modelos de audio de Gemini:

3.8 Live se lanza a partir de hoy:

3.8 Live Extended Thinking se lanza a partir de hoy:

Guardar con un clic

Lee artículos virales en profundidad con IA en YouMind

Guarda la fuente, haz preguntas concretas, resume el argumento y convierte un artículo viral en notas reutilizables en un único espacio de trabajo con IA.

Explora YouMind
Para creadores

Convierte tu Markdown en un artículo de 𝕏 impecable

Cuando publicas tus propios textos largos, dar formato en 𝕏 a imágenes, tablas y bloques de código es un fastidio. YouMind convierte un borrador completo en Markdown en un artículo de 𝕏 impecable y listo para publicar.

Prueba Markdown a 𝕏

Más patrones por descifrar

Artículos virales recientes

Explorar más artículos virales