Представляем Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking

@GoogleAIStudio
АНГЛИЙСКИЙ15 сент. 2026 г.
121K
1.6K
127
61
339

Суть

Google представляет модели Gemini 3.8 Live и Extended Thinking, предлагая разработчикам и предприятиям передовой голосовой ИИ с параллельными рассуждениями, визуальным контекстом в реальном времени и выполнением фоновых задач.

Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking — наши самые продвинутые модели для живого диалога на сегодняшний день. Значительные улучшения в интеллекте и параллельном рассуждении делают взаимодействие с ними более интуитивным, позволяя выполнять сложные задачи голосом.

Сегодня мы представляем две новые модели, которые обеспечивают прогресс в рассуждениях почти в реальном времени, чтобы эффективнее внедрять голосовых агентов и делать общение с ИИ более интуитивным и разумным.

  • Gemini 3.8 Live: Создана для масштабируемости и экономической эффективности, сочетая разговорный интеллект с плавностью диалога и визуальным пониманием контекста.
  • Gemini 3.8 Live Extended Thinking: Разработана для задач высокой сложности, с повышенным уровнем интеллекта и многошаговым рассуждением.

Для разработчиков и корпоративных клиентов эти модели предоставляют строительные блоки для создания надежных, готовых к использованию в продакшене голосовых агентов. Они также делают общение с Gemini через приложение Gemini, Google Workspace и Поиск более плавным и совместным — помогая вам решать сложные задачи, используя только голос.

Наслаждайтесь более плавными и умными беседами

Gemini 3.8 Live Extended Thinking обеспечивает выполнение задач и уровень интеллекта корпоративного класса, занимая первое место по совокупной оценке в Индексе качества речевого взаимодействия Speech to Speech Quality Index от Artificial Analysis (82,6), а также лидирует в выполнении агентских задач с показателями 68,6% в тесте τ-Voice и 35,1% в банковском бенчмарке Sierra’s τ-Voice-banking. Модель также демонстрирует мощные способности к рассуждению, набирая 97,7% в Big Bench Audio, при этом сохраняя крайне конкурентоспособную цену по сравнению с другими передовыми моделями.

Gemini 3.8 Live получила высокую оценку пользователей, заняв второе место в Speech Agent Arena. Помимо такой производительности, модель остается очень экономически эффективной, предоставляя разработчикам и предприятиям мощный и оптимальный инструмент, созданный для масштабирования.

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

На бенчмарке EVA-Bench компании ServiceNow, предназначенном для оценки голосовых агентов, наши модели расширяют границу Парето для сложных рабочих процессов, успешно балансируя между точностью и качеством беседы.

Google AI Studio - inline image

Gemini 3.8 Live обрабатывает визуальные входные данные почти в реальном времени, обогащая диалог контекстом для формирования более полезных ответов. Она автоматически определяет и переключается между 97 поддерживаемыми языками прямо во время разговора. Модель выполняет вызовы инструментов и API в фоновом режиме, продолжая беседу, что позволяет ей подтверждать запросы и поддерживать диалог, пока задачи завершаются в фоне.

Google AI Studio - inline image

Gemini 3.8 Live помогает в адаптации новых сотрудников в реальном времени, используя визуальный контекст для ответов на актуальные вопросы.

Google AI Studio - inline image

Посмотрите, как Gemini 3.8 Live играет в шахматы почти в реальном времени, используя визуальный контекст, логическое мышление и естественный ход беседы.

Для задач, требующих более глубокого анализа, 3.8 Live Extended Thinking рассуждает и говорит одновременно. Это обеспечивает повышенный интеллект для сложных рабочих процессов при сохранении непрерывного потока беседы — используя ранние вербальные сигналы вроде «Дайте мне проверить...», чтобы естественно реагировать на запросы, и озвучивая прогресс в реальном времени, чтобы проводить пользователей через многошаговые фоновые задачи по мере их выполнения.

Google AI Studio - inline image

Посмотрите, как Gemini 3.8 Live Extended Thinking превращает черновые наброски и голосовую обратную связь в реальном времени в функциональные компоненты React.

Google AI Studio - inline image

Узнайте, как Gemini 3.8 Live Extended Thinking координирует многошаговое бронирование и асинхронные вызовы функций — всё это без прерывания живой беседы.

Google AI Studio - inline image

Посмотрите, как Gemini 3.8 Live создает полные бизнес-планы и индивидуальные маркетинговые инструменты «на лету» посредством естественной речи.

В рамках Google Workspace и Поиска наши модели Live обеспечивают более интуитивный и совместный опыт работы — особенно при решении ваших самых сложных задач.

Google AI Studio - inline image

Попробуйте Gemini 3.8 Live Extended Thinking в Google Workspace с помощью Docs Live, Gmail Live и Keep Live.

Google AI Studio - inline image

Получайте пошаговую помощь в устранении неполадок в реальном времени на базе Gemini 3.8 Live — прямо внутри Search Live.

Развитие экосистемы голосовых решений для разработчиков и бизнеса

Используя Gemini Live API, такие платформы для разработчиков, как Agora, Fishjam, LiveKit, Pipecat, Vercel и Vision Agents, позволяют легко создавать и развертывать высокопроизводительные интерфейсы с голосовым управлением. Эти платформы берут на себя сложную инфраструктуру потоковой передачи медиа в реальном времени, давая разработчикам возможность полностью сосредоточиться на создании пользовательского опыта.

Мы также сотрудничаем с компаниями Salesforce, Genspark и Lumeris, которые заинтересованы в использовании 3.8 Live и 3.8 Live Extended Thinking, отмечая впечатляющую задержку ответа, плавность работы и возможности вызова инструментов.

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

Обеспечение прозрачности с помощью водяных знаков SynthID

Все аудиозаписи, генерируемые нашими продуктами на основе ИИ, маркируются водяными знаками SynthID. Этот незаметный водяной знак встраивается непосредственно в аудиофайл, гарантируя, что контент, созданный ИИ, останется обнаруживаемым, что помогает предотвратить распространение дезинформации. Для получения подробностей о нашем подходе к безопасности и ответственному использованию ознакомьтесь с карточкой модели.

Начните использовать наши последние аудиомодели Gemini:

3.8 Live начинает разворачиваться уже сегодня:

3.8 Live Extended Thinking начинает разворачиваться уже сегодня:

  • Для разработчиков: В Gemini API через Google AI Studio
  • Для предприятий: В закрытом превью в Gemini Enterprise и скоро будет доступна для корпоративных клиентов Gemini Enterprise for Customer Experience и Google Workspace.
  • Для всех: В Gemini Live, а также для подписчиков Google AI Pro и Ultra в Workspace (в Docs) и для всех подписчиков Google AI в Gmail и Keep
Сохранение в один клик

Используйте YouMind для глубокого чтения вирусных статей с помощью ИИ

Сохраняйте источники, задавайте точные вопросы, обобщайте аргументы и превращайте вирусные статьи в полезные заметки в одном рабочем пространстве ИИ.

Исследовать YouMind
Для авторов

Превратите ваш Markdown в аккуратную статью для 𝕏

Когда вы публикуете длинные тексты, изображения, таблицы и блоки кода, форматирование в 𝕏 становится мучением. YouMind превращает полный черновик в Markdown в чистую статью, готовую к публикации в 𝕏.

Попробовать Markdown для 𝕏

Другие паттерны для анализа

Недавние виральные статьи

Смотреть другие виральные статьи