Découvrez Gemini 3.8 Live et Gemini 3.8 Live Extended Thinking

@GoogleAIStudio
ANGLAIS15 sept. 2026
121K
1.6K
127
61
339

TL;DR

Google lance Gemini 3.8 Live et Extended Thinking, offrant une IA vocale avancée avec raisonnement parallèle, contexte visuel en temps réel et exécution de tâches en arrière-plan pour les développeurs et les entreprises.

Gemini 3.8 Live et Gemini 3.8 Live Extended Thinking sont nos modèles de dialogue en temps réel les plus avancés à ce jour. Des améliorations majeures en matière d'intelligence et de raisonnement parallèle rendent la collaboration et l'exécution de tâches complexes par la voix plus intuitives.

Aujourd'hui, nous présentons deux nouveaux modèles qui apportent des avancées en matière de raisonnement quasi instantané, permettant de mieux activer les agents vocaux et de rendre les conversations avec l'IA plus intuitives et intelligentes.

  • Gemini 3.8 Live : Conçu pour l'évolutivité et l'efficacité des coûts, il combine une intelligence conversationnelle, un dialogue fluide et une compréhension visuelle.
  • Gemini 3.8 Live Extended Thinking : Conçu pour les tâches de haute complexité, il offre une intelligence accrue et un raisonnement multi-étapes.

Pour les développeurs et les entreprises, ces modèles fournissent les briques essentielles pour créer des agents vocaux fiables et prêts pour la production. Ils rendent également les échanges avec Gemini via l'application Gemini, Google Workspace et Search plus fluides et collaboratifs — vous aidant à résoudre des tâches complexes simplement avec votre voix.

Vivez des conversations plus fluides et intelligentes

Gemini 3.8 Live Extended Thinking offre une complétion de tâches et une intelligence de niveau entreprise, se classant n°1 global sur l'indice de qualité Speech to Speech d'Artificial Analysis (82,6), et menant dans la complétion de tâches agentiques avec 68,6 % sur τ-Voice et 35,1 % sur le benchmark τ-Voice-banking de Sierra. Il fournit également de solides capacités de raisonnement, obtenant un score de 97,7 % sur Big Bench Audio, tout en maintenant un point de prix très compétitif par rapport aux autres modèles de pointe.

Gemini 3.8 Live a montré une forte préférence parmi les utilisateurs, décrochant la deuxième place dans Speech Agent Arena. En plus de cette performance, il reste très rentable — offrant aux développeurs et aux entreprises un modèle capable et efficace conçu pour l'échelle.

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

Sur EVA-Bench de ServiceNow, un benchmark pour évaluer les agents vocaux, nos modèles repoussent la frontière de Pareto pour les workflows complexes en équilibrant avec succès précision et qualité conversationnelle.

Google AI Studio - inline image

Gemini 3.8 Live traite les entrées visuelles en quasi temps réel, enrichissant les conversations avec du contexte pour des réponses plus utiles. Il détecte automatiquement et bascule entre 97 langues prises en charge en cours de conversation. Il exécute des outils et des appels API en arrière-plan tout en continuant la conversation, afin que le modèle puisse accuser réception des demandes et continuer à discuter pendant que les tâches se terminent en arrière-plan.

Google AI Studio - inline image

Gemini 3.8 Live guide l'intégration des employés en temps réel, utilisant le contexte visuel pour répondre aux questions en direct.

Google AI Studio - inline image

Regardez Gemini 3.8 Live jouer aux échecs en quasi temps réel grâce au contexte visuel, au raisonnement et à un flux conversationnel naturel.

Pour les tâches nécessitant un raisonnement plus approfondi, 3.8 Live Extended Thinking raisonne et parle simultanément. Il offre une intelligence accrue pour les workflows complexes tout en maintenant un flux conversationnel ininterrompu — utilisant des indices verbaux précoces comme « Laissez-moi vérifier cela... » pour accuser réception des prompts naturellement, et une narration de progression en direct pour guider les utilisateurs à travers les tâches de fond multi-étapes à mesure qu'elles progressent.

Google AI Studio - inline image

Regardez Gemini 3.8 Live Extended Thinking transformer des croquis bruts et des retours vocaux en temps réel en composants React fonctionnels.

Google AI Studio - inline image

Découvrez comment Gemini 3.8 Live Extended Thinking coordonne des réservations multi-étapes et des appels de fonctions asynchrones — le tout sans interrompre la conversation naturelle en direct.

Google AI Studio - inline image

Regardez Gemini 3.8 Live construire des plans commerciaux complets et des kits d'outils marketing personnalisés à la volée grâce à la parole naturelle.

À travers Google Workspace et Search, nos modèles Live offrent des expériences plus intuitives et collaboratives — surtout lors de la résolution de vos tâches les plus complexes.

Google AI Studio - inline image

Essayez Gemini 3.8 Live Extended Thinking dans Google Workspace avec Docs Live, Gmail Live et Keep Live.

Google AI Studio - inline image

Obtenez une aide au dépannage étape par étape en temps réel, propulsée par Gemini 3.8 Live—directement dans Search Live.

Renforcer l'écosystème vocal des développeurs et des entreprises

En utilisant l'API Gemini Live, des plateformes de développement telles que Agora, Fishjam, LiveKit, Pipecat, Vercel et Vision Agents permettent aux développeurs de créer et de déployer facilement des interfaces pilotées par la voix hautes performances. Ces plateformes gèrent en coulisses l'infrastructure complexe de streaming média en temps réel, permettant aux développeurs de se concentrer entièrement sur la création de l'expérience utilisateur.

Nous collaborons également avec des entreprises comme Salesforce, Genspark et Lumeris, enthousiastes à l'idée d'utiliser 3.8 Live et 3.8 Live Extended Thinking, soulignant sa latence impressionnante, sa fluidité et ses capacités d'appel d'outils.

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

Garantir la transparence avec le filigrane SynthID

Tout l'audio généré par nos produits IA est marqué avec SynthID. Ce filigrane imperceptible est intégré directement dans la sortie audio, garantissant que le contenu généré par l'IA reste détectable pour aider à prévenir la désinformation. Pour plus de détails sur notre approche en matière de sécurité et de responsabilité, consultez la fiche technique du modèle (model card).

Commencer à utiliser nos derniers modèles Gemini Audio :

3.8 Live est déployé à partir d'aujourd'hui :

3.8 Live Extended Thinking est déployé à partir d'aujourd'hui :

Enregistrer en un clic

Lire les articles viraux en profondeur avec l’IA de YouMind

Enregistrez la source, posez des questions ciblées, résumez l’argument et transformez un article viral en notes réutilisables dans un seul espace de travail IA.

Découvrir YouMind
Pour les créateurs

Transformez votre Markdown en un article 𝕏 impeccable

Quand vous publiez vos propres textes longs, la mise en forme 𝕏 des images, tableaux et blocs de code est pénible. YouMind transforme un brouillon Markdown complet en un article 𝕏 impeccable, prêt à publier.

Essayer Markdown vers 𝕏

D'autres patterns à décoder

Articles viraux récents

Explorer plus d'articles viraux