Einführung von Gemini 3.8 Live und 3.8 Live Extended Thinking

@GoogleAIStudio
ENGLISCH15. Sept. 2026
121K
1.6K
127
61
339

TL;DR

Google stellt Gemini 3.8 Live und Extended Thinking vor und bietet damit fortschrittliche Voice-KI mit parallelem Reasoning, Echtzeit-Bildkontext und Hintergrund-Task-Ausführung für Entwickler und Unternehmen.

Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking sind unsere bisher fortschrittlichsten Modelle für Live-Dialoge. Wesentliche Verbesserungen in den Bereichen Intelligenz und paralleles Reasoning machen die Zusammenarbeit und die Ausführung komplexer Aufgaben per Sprache intuitiver.

Heute stellen wir zwei neue Modelle vor, die Fortschritte im Near-Real-Time-Reasoning ermöglichen, um Voice-Agents effektiver zu unterstützen und die Interaktion mit KI intuitiver und intelligenter zu gestalten.

  • Gemini 3.8 Live: Entwickelt für Skalierbarkeit und Kosteneffizienz, kombiniert es Konversationsintelligenz mit flüssigem Dialog und visuellem Grounding.
  • Gemini 3.8 Live Extended Thinking: Entwickelt für hochkomplexe Aufgaben, bietet es eine gesteigerte Intelligenz und mehrstufiges Reasoning.

Für Entwickler und Unternehmen liefern diese Modelle die Bausteine für zuverlässige, produktionsreife Voice-Agents. Sie sorgen zudem dafür, dass die Kommunikation mit Gemini über die Gemini App, Google Workspace und Search flüssiger und kollaborativer wird – damit du komplexe Aufgaben allein per Sprache bewältigen kannst.

Erlebe flüssigere, intelligentere Gespräche

Gemini 3.8 Live Extended Thinking bietet Task Completion und Intelligenz auf Enterprise-Niveau und belegt den ersten Platz im Speech to Speech Quality Index von Artificial Analysis (82,6). Es führt bei der agentic Task Completion mit 68,6 % auf τ-Voice und 35,1 % auf dem Sierra’s τ-Voice-banking Benchmark an. Zudem verfügt es über starke Reasoning-Fähigkeiten mit einer Punktzahl von 97,7 % auf Big Bench Audio und bleibt preislich im Vergleich zu anderen Frontier-Modellen sehr wettbewerbsfähig.

Gemini 3.8 Live erfreut sich hoher Nutzerpräferenz und sichert sich den zweiten Platz in der Speech Agent Arena. Neben dieser Leistung bleibt das Modell äußerst kosteneffizient und bietet Entwicklern sowie Unternehmen ein leistungsstarkes, skalierbares Modell.

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

Auf ServiceNow’s EVA-Bench, einem Benchmark zur Bewertung von Voice-Agents, verschieben unsere Modelle die Pareto-Grenze für komplexe Workflows, indem sie Genauigkeit und Gesprächsqualität erfolgreich ausbalancieren.

Google AI Studio - inline image

Gemini 3.8 Live verarbeitet visuelle Eingaben nahezu in Echtzeit und bereichert Gespräche durch Kontextinformationen für hilfreichere Antworten. Das Modell erkennt automatisch 97 unterstützte Sprachen und wechselt mitten im Gespräch zwischen ihnen. Es führt Tools und API-Aufrufe im Hintergrund aus, während das Gespräch fortgesetzt wird, sodass Anfragen bestätigt werden können und die Unterhaltung weiterläuft, während Aufgaben im Hintergrund erledigt werden.

Google AI Studio - inline image

Gemini 3.8 Live unterstützt Mitarbeiter-Onboarding in Echtzeit und beantwortet live gestellte Fragen unter Nutzung des visuellen Kontexts.

Google AI Studio - inline image

Sieh dir an, wie Gemini 3.8 Live Schach spielt – nahezu in Echtzeit, unter Einsatz von visuellem Kontext, Reasoning und natürlichem Gesprächsfluss.

Für Aufgaben, die ein tiefergehendes Reasoning erfordern, denkt und spricht 3.8 Live Extended Thinking gleichzeitig. Es liefert eine gesteigerte Intelligenz für komplexe Workflows und behält dabei einen ununterbrochenen Gesprächsfluss bei – unter Verwendung früher verbaler Hinweise wie „Lass mich das kurz prüfen...“, um Prompts natürlich zu bestätigen, sowie einer Live-Fortschrittsnarration, die Benutzer durch mehrstufige Hintergrundaufgaben führt, während diese ablaufen.

Google AI Studio - inline image

Sieh dir an, wie Gemini 3.8 Live Extended Thinking rohe Skizzen und Echtzeit-Sprachfeedback in funktionale React-Komponenten verwandelt.

Google AI Studio - inline image

Erlebe, wie Gemini 3.8 Live Extended Thinking mehrstufige Buchungen und asynchrone Funktionsaufrufe koordiniert – alles ohne den natürlichen Live-Chat zu unterbrechen.

Google AI Studio - inline image

Sieh dir an, wie Gemini 3.8 Live komplette Businesspläne und maßgeschneiderte Marketing-Toolkits direkt per Sprache erstellt.

Über Google Workspace und Search hinweg bieten unsere Live-Modelle intuitivere, kollaborativere Erlebnisse – besonders bei der Bewältigung deiner komplexesten Aufgaben.

Google AI Studio - inline image

Teste Gemini 3.8 Live Extended Thinking in Google Workspace mit Docs Live, Gmail Live und Keep Live.

Google AI Studio - inline image

Erhalte schrittweise Troubleshooting-Hilfe in Echtzeit, powered by Gemini 3.8 Live – direkt in Search Live.

Stärkung des Ökosystems für Voice-Lösungen in Entwicklung und Enterprise

Durch die Nutzung der Gemini Live API ermöglichen Entwicklerplattformen wie Agora, Fishjam, LiveKit, Pipecat, Vercel und Vision Agents Entwicklern, leistungsstarke sprachgesteuerte Schnittstellen mühelos zu erstellen und bereitzustellen. Diese Plattformen übernehmen im Hintergrund die komplexe Infrastruktur für das Streaming von Echtzeit-Medien, sodass sich Entwickler voll auf die Gestaltung der User Experience konzentrieren können.

Wir arbeiten auch mit Unternehmen wie Salesforce, Genspark und Lumeris zusammen, die begeistert von 3.8 Live und 3.8 Live Extended Thinking sind und dessen beeindruckende Latenz, Flüssigkeit und Tool-Calling-Fähigkeiten hervorheben.

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

Transparenz durch SynthID-Wasserzeichen

Alle Audiodateien, die von unseren KI-Produkten generiert werden, sind mit SynthID gekennzeichnet. Dieses unsichtbare Wasserzeichen ist direkt in die Audioausgabe eingebettet und stellt sicher, dass KI-generierte Inhalte erkennbar bleiben, um Desinformation vorzubeugen. Für Details zu unserem Ansatz in Bezug auf Sicherheit und Verantwortung lesen Sie bitte die Model Card.

So nutzt du unsere neuesten Gemini Audio-Modelle:

3.8 Live wird ab heute schrittweise eingeführt:

3.8 Live Extended Thinking wird ab heute schrittweise eingeführt:

Mit einem Klick speichern

Virale Artikel mit YouMind per KI tief lesen

Speichere die Quelle, stelle gezielte Fragen, fasse die Argumentation zusammen und verwandle einen viralen Artikel in wiederverwendbare Notizen in einem einzigen KI-Arbeitsbereich.

YouMind entdecken
Für Creator

Verwandle dein Markdown in einen sauberen 𝕏-Artikel

Wenn du eigene Langtexte veröffentlichst, wird die 𝕏-Formatierung von Bildern, Tabellen und Codeblöcken mühsam. YouMind macht aus einem ganzen Markdown-Entwurf einen sauberen, sofort postbaren 𝕏-Artikel.

Markdown zu 𝕏 testen

Mehr Muster zum Entschlüsseln

Aktuelle virale Artikel

Mehr virale Artikel entdecken