Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking sind unsere bisher fortschrittlichsten Modelle für Live-Dialoge. Wesentliche Verbesserungen in den Bereichen Intelligenz und paralleles Reasoning machen die Zusammenarbeit und die Ausführung komplexer Aufgaben per Sprache intuitiver.
Heute stellen wir zwei neue Modelle vor, die Fortschritte im Near-Real-Time-Reasoning ermöglichen, um Voice-Agents effektiver zu unterstützen und die Interaktion mit KI intuitiver und intelligenter zu gestalten.
- Gemini 3.8 Live: Entwickelt für Skalierbarkeit und Kosteneffizienz, kombiniert es Konversationsintelligenz mit flüssigem Dialog und visuellem Grounding.
- Gemini 3.8 Live Extended Thinking: Entwickelt für hochkomplexe Aufgaben, bietet es eine gesteigerte Intelligenz und mehrstufiges Reasoning.
Für Entwickler und Unternehmen liefern diese Modelle die Bausteine für zuverlässige, produktionsreife Voice-Agents. Sie sorgen zudem dafür, dass die Kommunikation mit Gemini über die Gemini App, Google Workspace und Search flüssiger und kollaborativer wird – damit du komplexe Aufgaben allein per Sprache bewältigen kannst.
Erlebe flüssigere, intelligentere Gespräche
Gemini 3.8 Live Extended Thinking bietet Task Completion und Intelligenz auf Enterprise-Niveau und belegt den ersten Platz im Speech to Speech Quality Index von Artificial Analysis (82,6). Es führt bei der agentic Task Completion mit 68,6 % auf τ-Voice und 35,1 % auf dem Sierra’s τ-Voice-banking Benchmark an. Zudem verfügt es über starke Reasoning-Fähigkeiten mit einer Punktzahl von 97,7 % auf Big Bench Audio und bleibt preislich im Vergleich zu anderen Frontier-Modellen sehr wettbewerbsfähig.
Gemini 3.8 Live erfreut sich hoher Nutzerpräferenz und sichert sich den zweiten Platz in der Speech Agent Arena. Neben dieser Leistung bleibt das Modell äußerst kosteneffizient und bietet Entwicklern sowie Unternehmen ein leistungsstarkes, skalierbares Modell.




Auf ServiceNow’s EVA-Bench, einem Benchmark zur Bewertung von Voice-Agents, verschieben unsere Modelle die Pareto-Grenze für komplexe Workflows, indem sie Genauigkeit und Gesprächsqualität erfolgreich ausbalancieren.

Gemini 3.8 Live verarbeitet visuelle Eingaben nahezu in Echtzeit und bereichert Gespräche durch Kontextinformationen für hilfreichere Antworten. Das Modell erkennt automatisch 97 unterstützte Sprachen und wechselt mitten im Gespräch zwischen ihnen. Es führt Tools und API-Aufrufe im Hintergrund aus, während das Gespräch fortgesetzt wird, sodass Anfragen bestätigt werden können und die Unterhaltung weiterläuft, während Aufgaben im Hintergrund erledigt werden.

Gemini 3.8 Live unterstützt Mitarbeiter-Onboarding in Echtzeit und beantwortet live gestellte Fragen unter Nutzung des visuellen Kontexts.

Sieh dir an, wie Gemini 3.8 Live Schach spielt – nahezu in Echtzeit, unter Einsatz von visuellem Kontext, Reasoning und natürlichem Gesprächsfluss.
Für Aufgaben, die ein tiefergehendes Reasoning erfordern, denkt und spricht 3.8 Live Extended Thinking gleichzeitig. Es liefert eine gesteigerte Intelligenz für komplexe Workflows und behält dabei einen ununterbrochenen Gesprächsfluss bei – unter Verwendung früher verbaler Hinweise wie „Lass mich das kurz prüfen...“, um Prompts natürlich zu bestätigen, sowie einer Live-Fortschrittsnarration, die Benutzer durch mehrstufige Hintergrundaufgaben führt, während diese ablaufen.

Sieh dir an, wie Gemini 3.8 Live Extended Thinking rohe Skizzen und Echtzeit-Sprachfeedback in funktionale React-Komponenten verwandelt.

Erlebe, wie Gemini 3.8 Live Extended Thinking mehrstufige Buchungen und asynchrone Funktionsaufrufe koordiniert – alles ohne den natürlichen Live-Chat zu unterbrechen.

Sieh dir an, wie Gemini 3.8 Live komplette Businesspläne und maßgeschneiderte Marketing-Toolkits direkt per Sprache erstellt.
Über Google Workspace und Search hinweg bieten unsere Live-Modelle intuitivere, kollaborativere Erlebnisse – besonders bei der Bewältigung deiner komplexesten Aufgaben.

Teste Gemini 3.8 Live Extended Thinking in Google Workspace mit Docs Live, Gmail Live und Keep Live.

Erhalte schrittweise Troubleshooting-Hilfe in Echtzeit, powered by Gemini 3.8 Live – direkt in Search Live.
Stärkung des Ökosystems für Voice-Lösungen in Entwicklung und Enterprise
Durch die Nutzung der Gemini Live API ermöglichen Entwicklerplattformen wie Agora, Fishjam, LiveKit, Pipecat, Vercel und Vision Agents Entwicklern, leistungsstarke sprachgesteuerte Schnittstellen mühelos zu erstellen und bereitzustellen. Diese Plattformen übernehmen im Hintergrund die komplexe Infrastruktur für das Streaming von Echtzeit-Medien, sodass sich Entwickler voll auf die Gestaltung der User Experience konzentrieren können.
Wir arbeiten auch mit Unternehmen wie Salesforce, Genspark und Lumeris zusammen, die begeistert von 3.8 Live und 3.8 Live Extended Thinking sind und dessen beeindruckende Latenz, Flüssigkeit und Tool-Calling-Fähigkeiten hervorheben.











Transparenz durch SynthID-Wasserzeichen
Alle Audiodateien, die von unseren KI-Produkten generiert werden, sind mit SynthID gekennzeichnet. Dieses unsichtbare Wasserzeichen ist direkt in die Audioausgabe eingebettet und stellt sicher, dass KI-generierte Inhalte erkennbar bleiben, um Desinformation vorzubeugen. Für Details zu unserem Ansatz in Bezug auf Sicherheit und Verantwortung lesen Sie bitte die Model Card.
So nutzt du unsere neuesten Gemini Audio-Modelle:
3.8 Live wird ab heute schrittweise eingeführt:
- Für Entwickler: Über die Gemini API in Google AI Studio
- Für Unternehmen: In privater Preview in Gemini Enterprise und bald verfügbar in Gemini Enterprise for Customer Experience
- Für alle: In Search Live
3.8 Live Extended Thinking wird ab heute schrittweise eingeführt:
- Für Entwickler: Über die Gemini API in Google AI Studio
- Für Unternehmen: In privater Preview in Gemini Enterprise und bald verfügbar für Kunden von Gemini Enterprise for Customer Experience sowie Google Workspace Business.
- Für alle: In Gemini Live sowie für Google AI Pro- und Ultra-Abonnenten in Workspace in Docs und für alle Google AI-Abonnenten in Gmail und Keep





