Gemini 3.8 Live та Gemini 3.8 Live Extended Thinking — це наші найпросунутіші моделі для живого діалогу. Значні вдосконалення в інтелекті та паралельному міркуванні роблять співпрацю та виконання складних завдань за допомогою голосу більш інтуїтивними.
Сьогодні ми представляємо дві нові моделі, які забезпечують прогрес у майже реальному часі для ефективного функціонування голосових агентів і роблять спілкування з ШІ більш інтуїтивним та розумним.
- Gemini 3.8 Live: Створена для масштабування та ефективності витрат, поєднує розмовний інтелект із плавністю діалогу та візуальним контекстом.
- Gemini 3.8 Live Extended Thinking: Створена для високоскладних завдань, з підвищеним рівнем інтелекту та багатоступінчастим міркуванням.
Для розробників та підприємств ці моделі надають базові компоненти для надійних, готових до виробництва голосових агентів. Вони також роблять спілкування з Gemini через додаток Gemini, Google Workspace та Пошук більш плавним та колаборативним — допомагаючи вам вирішувати складні завдання лише за допомогою голосу.
Відчуйте більш плавні та розумні розмови
Gemini 3.8 Live Extended Thinking забезпечує виконання завдань та інтелект корпоративного рівня, посідаючи перше місце за загальною оцінкою в Індексі якості мовлення Speech to Speech від Artificial Analysis (82,6), а також лідирує у виконанні агентських завдань з показниками 68,6% на τ-Voice та 35,1% на бенчмарку Sierra’s τ-Voice-banking. Вона також демонструє потужні можливості міркування, отримавши 97,7% на Big Bench Audio, при цьому зберігаючи висококонкурентну ціну порівняно з іншими передовими моделями.
Gemini 3.8 Live показала високий рівень вподобань серед користувачів, посівши друге місце в Speech Agent Arena. Окрім цієї продуктивності, модель залишається дуже економічно ефективною, пропонуючи розробникам та підприємствам потужну та ефективну модель, створену для масштабування.




На бенчмарку EVA-Bench від ServiceNow, який оцінює голосових агентів, наші моделі зміщують межу Парето для складних робочих процесів, успішно балансуючи точність із якістю розмови.

Gemini 3.8 Live обробляє візуальні входи майже в реальному часі, збагачуючи розмови контекстом для більш корисних відповідей. Вона автоматично виявляє та перемикається між 97 підтримуваними мовами під час діалогу. Модель виконує інструменти та API-запити у фоновому режимі, продовжуючи розмову, тож вона може підтверджувати запити та чатувати, поки завдання завершуються у фоні.

Gemini 3.8 Live супроводжує адаптацію працівників у реальному часі, використовуючи візуальний контекст для відповіді на запитання наживо.

Подивіться, як Gemini 3.8 Live грає у шахи майже в реальному часі, використовуючи візуальний контекст, логічне міркування та природний розмовний потік.
Для завдань, що потребують глибшого аналізу, 3.8 Live Extended Thinking міркує та говорить одночасно. Вона забезпечує підвищений інтелект для складних робочих процесів, зберігаючи безперервний розмовний потік — використовуючи ранні вербальні маркери, такі як «Дозвольте перевірити...», для природного підтвердження запитів, та озвучення прогресу в реальному часі, щоб проводити користувачів через багатоступінчасті фонові завдання.

Подивіться, як Gemini 3.8 Live Extended Thinking перетворює сирі ескізи та голосовий зворотний зв'язок у реальному часі на функціональні компоненти React.

Перегляньте, як Gemini 3.8 Live Extended Thinking координує багатоступінчасті бронювання та асинхронні виклики функцій — усе це без переривання природної розмови наживо.

Подивіться, як Gemini 3.8 Live створює повноцінні бізнес-плани та індивідуальні маркетингові набори інструментів «на льоту» через природне мовлення.
У Google Workspace та Пошуку наші моделі Live забезпечують більш інтуїтивний та колаборативний досвід — особливо під час вирішення ваших найскладніших завдань.

Спробуйте Gemini 3.8 Live Extended Thinking у Google Workspace з Docs Live, Gmail Live та Keep Live.

Отримайте покрокову допомогу з усуненням несправностей у реальному часі на основі Gemini 3.8 Live — прямо в Search Live.
Розвиток екосистеми голосових рішень для розробників та підприємств
Завдяки використанню Gemini Live API платформи для розробників, такі як Agora, Fishjam, LiveKit, Pipecat, Vercel та Vision Agents, дозволяють розробникам легко створювати та впроваджувати високопродуктивні інтерфейси, керовані голосом. Ці платформи беруть на себе складну інфраструктуру потокової передачі медіа в реальному часі, даючи змогу розробникам повністю зосередитися на створенні користувацького досвіду.
Ми також співпрацюємо з такими компаніями, як Salesforce, Genspark та Lumeris, які зацікавлені в 3.8 Live та 3.8 Live Extended Thinking, відзначаючи їхню вражаючу затримку (latency), плавність та можливості виклику інструментів.











Забезпечення прозорості за допомогою водяних знаків SynthID
Усі аудіофайли, згенеровані нашими продуктами ШІ, мають водяний знак SynthID. Цей непомітний водяний знак вбудований безпосередньо в аудіовихід, гарантуючи, що контент, створений ШІ, залишається виявленим, щоб допомогти запобігти поширенню дезінформації. Для деталей щодо нашого підходу до безпеки та відповідальності перегляньте картку моделі (model card).
Почніть використовувати наші останні аудіомоделі Gemini:
3.8 Live починає розгортатися вже сьогодні:
- Для розробників: У Gemini API через Google AI Studio
- Для підприємств: У приватній бета-версії в Gemini Enterprise та незабаром у Gemini Enterprise for Customer Experience
- Для всіх: У Search Live
3.8 Live Extended Thinking починає розгортатися вже сьогодні:
- Для розробників: У Gemini API через Google AI Studio
- Для підприємств: У приватній бета-версії в Gemini Enterprise та незабаром у Gemini Enterprise for Customer Experience і для бізнес-користувачів Google Workspace.
- Для всіх: У Gemini Live та для підписників Google AI Pro і Ultra у Workspace в Docs, а також для всіх підписників Google AI у Gmail та Keep





