Presentamos Gemini 3.8 Live y Extended Thinking de 3.8 Live

@GoogleAIStudio
INGLÉS15 sept 2026
121K
1.6K
127
61
339

TL;DR

Google presenta Gemini 3.8 Live y Extended Thinking, ofreciendo IA de voz avanzada con razonamiento paralelo, contexto visual en tiempo real y ejecución de tareas en segundo plano para desarrolladores y empresas.

Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking son nuestros modelos de diálogo en vivo más avanzados hasta la fecha. Las importantes mejoras en inteligencia y razonamiento paralelo hacen que sea más intuitivo colaborar y ejecutar tareas complejas usando tu voz.

Hoy, presentamos dos nuevos modelos que incorporan avances en el razonamiento casi en tiempo real para habilitar de manera más efectiva los agentes de voz y hacer que conversar con la IA se sienta más intuitivo e inteligente.

  • Gemini 3.8 Live: Diseñado para escalabilidad y eficiencia de costos, combina inteligencia conversacional con un diálogo fluido y fundamentación visual (visual grounding).
  • Gemini 3.8 Live Extended Thinking: Diseñado para tareas de alta complejidad, con mayor inteligencia y razonamiento en múltiples pasos.

Para desarrolladores y empresas, estos modelos ofrecen los componentes básicos para crear agentes de voz fiables y listos para producción. También hacen que hablar con Gemini a través de la app de Gemini, Google Workspace y Search sea más fluido y colaborativo — ayudándote a abordar tareas complejas usando solo tu voz.

Experimenta conversaciones más fluidas e inteligentes

Gemini 3.8 Live Extended Thinking ofrece finalización de tareas y nivel de inteligencia de grado empresarial, ocupando el puesto #1 general en el Índice de Calidad de Voz a Voz de Artificial Analysis (82.6), y lidera en la finalización de tareas agénticas con un 68.6% en τ-Voice y un 35.1% en el benchmark τ-Voice-banking de Sierra. También proporciona sólidas capacidades de razonamiento, obteniendo una puntuación del 97.7% en Big Bench Audio, mientras mantiene un punto de precio altamente competitivo en comparación con otros modelos de frontera.

Gemini 3.8 Live ha mostrado una alta preferencia entre los usuarios, asegurando el segundo lugar en la Arena de Agentes de Voz. Además de este rendimiento, sigue siendo altamente rentable, proporcionando a desarrolladores y empresas un modelo capaz y eficiente diseñado para escalar.

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

En EVA-Bench de ServiceNow, un benchmark para evaluar agentes de voz, nuestros modelos empujan la Frontera de Pareto para flujos de trabajo complejos al equilibrar con éxito la precisión con la calidad conversacional.

Google AI Studio - inline image

Gemini 3.8 Live procesa entradas visuales casi en tiempo real, enriqueciendo las conversaciones con contexto para respuestas más útiles. Detecta automáticamente y transiciona entre 97 idiomas soportados durante la conversación. Ejecuta herramientas y llamadas API en segundo plano mientras continúa la conversación, por lo que el modelo puede reconocer las solicitudes y seguir charlando mientras las tareas finalizan en segundo plano.

Google AI Studio - inline image

Gemini 3.8 Live guía la incorporación de empleados en tiempo real, utilizando contexto visual para responder preguntas en vivo.

Google AI Studio - inline image

Mira a Gemini 3.8 Live jugar ajedrez casi en tiempo real utilizando contexto visual, razonamiento y flujo conversacional natural.

Para tareas que requieren un razonamiento más profundo, 3.8 Live Extended Thinking razona y habla simultáneamente. Ofrece una mayor inteligencia para flujos de trabajo complejos mientras mantiene un flujo conversacional ininterrumpido — utilizando señales verbales tempranas como "Déjame revisar eso..." para reconocer las instrucciones de forma natural, y narración de progreso en vivo para guiar a los usuarios a través de tareas en segundo plano de múltiples pasos a medida que avanzan.

Google AI Studio - inline image

Mira a Gemini 3.8 Live Extended Thinking transformar bocetos en bruto y retroalimentación de voz en tiempo real en componentes funcionales de React.

Google AI Studio - inline image

Vea cómo Gemini 3.8 Live Extended Thinking coordina reservas de múltiples pasos y llamadas de funciones asíncronas — todo sin interrumpir la conversación en vivo natural.

Google AI Studio - inline image

Mira a Gemini 3.8 Live construir planes de negocio completos y kits de herramientas de marketing personalizados sobre la marcha mediante el habla natural.

A través de Google Workspace y Search, nuestros modelos Live ofrecen experiencias más intuitivas y colaborativas — especialmente al abordar tus tareas más complejas.

Google AI Studio - inline image

Prueba Gemini 3.8 Live Extended Thinking en Google Workspace con Docs Live, Gmail Live y Keep Live.

Google AI Studio - inline image

Obtén ayuda de solución de problemas paso a paso y en tiempo real impulsada por Gemini 3.8 Live — directamente dentro de Search Live.

Potenciando el ecosistema de voz para desarrolladores y empresas

Al utilizar la API de Gemini Live, plataformas de desarrollo como Agora, Fishjam, LiveKit, Pipecat, Vercel y Vision Agents permiten a los desarrolladores crear e implementar interfaces de alto rendimiento impulsadas por voz con facilidad. Estas plataformas gestionan la infraestructura compleja de transmisión de medios en tiempo real entre bastidores, permitiendo a los desarrolladores centrarse completamente en diseñar la experiencia de usuario.

También estamos asociándonos con empresas como Salesforce, Genspark y Lumeris, que están entusiasmadas con 3.8 Live y 3.8 Live Extended Thinking, destacando su impresionante latencia, fluidez y capacidades de llamada a herramientas.

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

Garantiza la transparencia con marcas de agua SynthID

Todo el audio generado por nuestros productos de IA está marcado con SynthID. Esta marca de agua imperceptible se teje directamente en la salida de audio, asegurando que el contenido generado por IA permanezca detectable para ayudar a prevenir la desinformación. Para obtener detalles sobre nuestro enfoque de seguridad y responsabilidad, revisa la ficha técnica del modelo (model card).

Comienza a usar nuestros últimos modelos de audio de Gemini:

3.8 Live se lanza a partir de hoy:

3.8 Live Extended Thinking se lanza a partir de hoy:

Guardar con un clic

Lee artículos virales en profundidad con IA en YouMind

Guarda la fuente, haz preguntas concretas, resume el argumento y convierte un artículo viral en notas reutilizables en un único espacio de trabajo con IA.

Explora YouMind
Para creadores

Convierte tu Markdown en un artículo de 𝕏 impecable

Cuando publicas tus propios textos largos, dar formato en 𝕏 a imágenes, tablas y bloques de código es un fastidio. YouMind convierte un borrador completo en Markdown en un artículo de 𝕏 impecable y listo para publicar.

Prueba Markdown a 𝕏

Más patrones por descifrar

Artículos virales recientes

Explorar más artículos virales