Представлено Gemini 3.8 Live та 3.8 Live Extended Thinking

@GoogleAIStudio
АНГЛІЙСЬКА15 вер. 2026 р.
121K
1.6K
127
61
339

Коротко

Google представляє моделі Gemini 3.8 Live та Extended Thinking, пропонуючи просунутий голосовий ШІ з паралельним міркуванням, контекстом у реальному часі та фоновою виконанням завдань для розробників і підприємств.

Gemini 3.8 Live та Gemini 3.8 Live Extended Thinking — це наші найпросунутіші моделі для живого діалогу. Значні вдосконалення в інтелекті та паралельному міркуванні роблять співпрацю та виконання складних завдань за допомогою голосу більш інтуїтивними.

Сьогодні ми представляємо дві нові моделі, які забезпечують прогрес у майже реальному часі для ефективного функціонування голосових агентів і роблять спілкування з ШІ більш інтуїтивним та розумним.

  • Gemini 3.8 Live: Створена для масштабування та ефективності витрат, поєднує розмовний інтелект із плавністю діалогу та візуальним контекстом.
  • Gemini 3.8 Live Extended Thinking: Створена для високоскладних завдань, з підвищеним рівнем інтелекту та багатоступінчастим міркуванням.

Для розробників та підприємств ці моделі надають базові компоненти для надійних, готових до виробництва голосових агентів. Вони також роблять спілкування з Gemini через додаток Gemini, Google Workspace та Пошук більш плавним та колаборативним — допомагаючи вам вирішувати складні завдання лише за допомогою голосу.

Відчуйте більш плавні та розумні розмови

Gemini 3.8 Live Extended Thinking забезпечує виконання завдань та інтелект корпоративного рівня, посідаючи перше місце за загальною оцінкою в Індексі якості мовлення Speech to Speech від Artificial Analysis (82,6), а також лідирує у виконанні агентських завдань з показниками 68,6% на τ-Voice та 35,1% на бенчмарку Sierra’s τ-Voice-banking. Вона також демонструє потужні можливості міркування, отримавши 97,7% на Big Bench Audio, при цьому зберігаючи висококонкурентну ціну порівняно з іншими передовими моделями.

Gemini 3.8 Live показала високий рівень вподобань серед користувачів, посівши друге місце в Speech Agent Arena. Окрім цієї продуктивності, модель залишається дуже економічно ефективною, пропонуючи розробникам та підприємствам потужну та ефективну модель, створену для масштабування.

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

На бенчмарку EVA-Bench від ServiceNow, який оцінює голосових агентів, наші моделі зміщують межу Парето для складних робочих процесів, успішно балансуючи точність із якістю розмови.

Google AI Studio - inline image

Gemini 3.8 Live обробляє візуальні входи майже в реальному часі, збагачуючи розмови контекстом для більш корисних відповідей. Вона автоматично виявляє та перемикається між 97 підтримуваними мовами під час діалогу. Модель виконує інструменти та API-запити у фоновому режимі, продовжуючи розмову, тож вона може підтверджувати запити та чатувати, поки завдання завершуються у фоні.

Google AI Studio - inline image

Gemini 3.8 Live супроводжує адаптацію працівників у реальному часі, використовуючи візуальний контекст для відповіді на запитання наживо.

Google AI Studio - inline image

Подивіться, як Gemini 3.8 Live грає у шахи майже в реальному часі, використовуючи візуальний контекст, логічне міркування та природний розмовний потік.

Для завдань, що потребують глибшого аналізу, 3.8 Live Extended Thinking міркує та говорить одночасно. Вона забезпечує підвищений інтелект для складних робочих процесів, зберігаючи безперервний розмовний потік — використовуючи ранні вербальні маркери, такі як «Дозвольте перевірити...», для природного підтвердження запитів, та озвучення прогресу в реальному часі, щоб проводити користувачів через багатоступінчасті фонові завдання.

Google AI Studio - inline image

Подивіться, як Gemini 3.8 Live Extended Thinking перетворює сирі ескізи та голосовий зворотний зв'язок у реальному часі на функціональні компоненти React.

Google AI Studio - inline image

Перегляньте, як Gemini 3.8 Live Extended Thinking координує багатоступінчасті бронювання та асинхронні виклики функцій — усе це без переривання природної розмови наживо.

Google AI Studio - inline image

Подивіться, як Gemini 3.8 Live створює повноцінні бізнес-плани та індивідуальні маркетингові набори інструментів «на льоту» через природне мовлення.

У Google Workspace та Пошуку наші моделі Live забезпечують більш інтуїтивний та колаборативний досвід — особливо під час вирішення ваших найскладніших завдань.

Google AI Studio - inline image

Спробуйте Gemini 3.8 Live Extended Thinking у Google Workspace з Docs Live, Gmail Live та Keep Live.

Google AI Studio - inline image

Отримайте покрокову допомогу з усуненням несправностей у реальному часі на основі Gemini 3.8 Live — прямо в Search Live.

Розвиток екосистеми голосових рішень для розробників та підприємств

Завдяки використанню Gemini Live API платформи для розробників, такі як Agora, Fishjam, LiveKit, Pipecat, Vercel та Vision Agents, дозволяють розробникам легко створювати та впроваджувати високопродуктивні інтерфейси, керовані голосом. Ці платформи беруть на себе складну інфраструктуру потокової передачі медіа в реальному часі, даючи змогу розробникам повністю зосередитися на створенні користувацького досвіду.

Ми також співпрацюємо з такими компаніями, як Salesforce, Genspark та Lumeris, які зацікавлені в 3.8 Live та 3.8 Live Extended Thinking, відзначаючи їхню вражаючу затримку (latency), плавність та можливості виклику інструментів.

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

Забезпечення прозорості за допомогою водяних знаків SynthID

Усі аудіофайли, згенеровані нашими продуктами ШІ, мають водяний знак SynthID. Цей непомітний водяний знак вбудований безпосередньо в аудіовихід, гарантуючи, що контент, створений ШІ, залишається виявленим, щоб допомогти запобігти поширенню дезінформації. Для деталей щодо нашого підходу до безпеки та відповідальності перегляньте картку моделі (model card).

Почніть використовувати наші останні аудіомоделі Gemini:

3.8 Live починає розгортатися вже сьогодні:

3.8 Live Extended Thinking починає розгортатися вже сьогодні:

  • Для розробників: У Gemini API через Google AI Studio
  • Для підприємств: У приватній бета-версії в Gemini Enterprise та незабаром у Gemini Enterprise for Customer Experience і для бізнес-користувачів Google Workspace.
  • Для всіх: У Gemini Live та для підписників Google AI Pro і Ultra у Workspace в Docs, а також для всіх підписників Google AI у Gmail та Keep
Збереження в один клік

Використовуйте YouMind для AI-глибокого читання віральних статей

Зберігайте джерела, ставте цілеспрямовані запитання, підсумовуйте аргументи та перетворюйте віральні статті на корисні нотатки в одному AI-робочому просторі.

Дослідити YouMind
Для авторів

Перетворіть свій Markdown на охайну статтю для 𝕏

Коли ви публікуєте власні лонгріди, зображення, таблиці та блоки коду роблять форматування в 𝕏 складним. YouMind перетворює повну чернетку в Markdown на чисту статтю для 𝕏, готову до публікації.

Спробувати Markdown для 𝕏

Більше патернів для аналізу

Останні віральні статті

Переглянути більше віральних статей