Gemini 3.8 Live と Gemini 3.8 Live Extended Thinking のご紹介

@GoogleAIStudio
英語2026年9月15日
121K
1.6K
127
61
339

TL;DR

Google は Gemini 3.8 Live と Extended Thinking を発表しました。開発者や企業向けに、並列推論、リアルタイムの視覚コンテキスト、バックグラウンドでのタスク実行機能を備えた高度な音声 AI を提供します。

Gemini 3.8 Live と Gemini 3.8 Live Extended Thinking は、当社の最新かつ最も高度なライブ対話モデルです。知能と並列推論における大幅なアップグレードにより、音声を使った複雑なタスクの協力や実行がより直感的になります。

本日、ほぼリアルタイムでの推論における進歩をもたらす2つの新しいモデルを発表します。これにより、音声エージェントをより効果的に実現し、AI との会話をもっと直感的で知的なものにします。

  • Gemini 3.8 Live: スケールとコスト効率のために構築され、会話の知能、流暢な対話、視覚的な文脈理解を組み合わせています。
  • Gemini 3.8 Live Extended Thinking: 高複雑度タスクのために構築され、知能とマルチステップ推論が強化されています。

開発者や企業にとって、これらのモデルは信頼性が高く、本番環境で使用可能な音声エージェントのための基盤を提供します。また、Gemini アプリ、Google Workspace、Search を通じた Gemini との会話をより流動的で協力的なものにし、音声だけで複雑なタスクに取り組むのを支援します。

より流動的で知的な会話体験

Gemini 3.8 Live Extended Thinking は、エンタープライズレベルのタスク完了能力と知能を提供し、Artificial Analysis の Speech to Speech Quality Index で総合第1位(82.6)を獲得しました。さらに、τ-Voice で68.6%、Sierra の τ-Voice-banking ベンチマークで35.1%という成績で、エージェント型タスク完了においてリードしています。Big Bench Audio では97.7%のスコアを記録するなど強力な推論能力を持ちつつ、他の最先端モデルと比較して非常に競争力のある価格帯を維持しています。

Gemini 3.8 Live はユーザーからの高い支持を得ており、Speech Agent Arena で第2位を獲得しました。このパフォーマンスに加え、コスト効率の高さも維持しており、スケール向けに設計された有能かつ効率的なモデルとして開発者や企業に提供されます。

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

音声エージェントの評価ベンチマークである ServiceNow の EVA-Bench において、当社のモデルは精度と会話品質のバランスを取ることで、複雑なワークフローにおけるパレートフロンティアを押し広げています。

Google AI Studio - inline image

Gemini 3.8 Live は視覚入力をほぼリアルタイムで処理し、コンテキストを追加することでより有益な応答を実現します。会話中にサポートされる97言語の間で自動的に検出し、切り替えます。ツールやAPI呼び出しをバックグラウンドで実行しながら会話を継続するため、モデルはリクエストを確認しつつ、タスクがバックグラウンドで完了するまでチャットを続けることができます。

Google AI Studio - inline image

Gemini 3.8 Live は視覚的なコンテキストを使用してライブ質問に答えながら、従業員のオンボーディングをリアルタイムでガイドします。

Google AI Studio - inline image

Gemini 3.8 Live が視覚的なコンテキスト、推論、自然な会話の流れを使ってほぼリアルタイムでチェスをプレイする様子をご覧ください。

より深い推論が必要なタスクでは、3.8 Live Extended Thinking が同時に推論と発話を行います。複雑なワークフローに対して知能を高めつつ、途切れない会話の流れを維持します。「確認してみます…」のような早期の口頭の手がかりを使ってプロンプトを自然に認識し、マルチステップのバックグラウンドタスクが進むにつれてユーザーへライブ進捗ナレーションを提供します。

Google AI Studio - inline image

Gemini 3.8 Live Extended Thinking がラフスケッチとリアルタイムの音声フィードバックを機能する React コンポーネントに変換する様子をご覧ください。

Google AI Studio - inline image

Gemini 3.8 Live Extended Thinking が、自然なライブ会話を中断することなく、マルチステップの予約や非同期関数呼び出しを調整する様子をご覧ください。

Google AI Studio - inline image

Gemini 3.8 Live が自然な音声を通じて完全なビジネスプランやカスタムマーケティングツールキットをその場で構築する様子をご覧ください。

Google Workspace と Search を通じて、当社の Live モデルは特に最も複雑なタスクに取り組む際に、より直感的で協力的なエクスペリエンスを提供します。

Google AI Studio - inline image

Docs Live、Gmail Live、Keep Live を使用して Google Workspace で Gemini 3.8 Live Extended Thinking をお試しください。

Google AI Studio - inline image

Search Live 内で Gemini 3.8 Live による段階的なリアルタイムトラブルシューティングヘルプをご利用ください。

開発者と企業の音声エコシステムを支える

Gemini Live API を使用することで、AgoraFishjamLiveKitPipecat、Vercel、Vision Agents などの開発者プラットフォームは、開発者が高性能な音声駆動インターフェースを簡単に構築・展開できるようにします。これらのプラットフォームは裏側で複雑なリアルタイムメディアストリーミングインフラストラクチャを管理するため、開発者はユーザー体験の作成に完全に集中できます。

また、Salesforce、Genspark、Lumeris などの企業とも提携しています。これらのパートナーは 3.8 Live と 3.8 Live Extended Thinking の印象的なレイテンシ、流暢さ、ツール呼び出し機能に期待を寄せています。

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

SynthID 透かしによる透明性の確保

当社の AI プロダクトによって生成されたすべてのオーディオには、SynthID による透かしが含まれています。この知覚不可能な透かしはオーディオ出力に直接組み込まれており、誤情報の防止を支援するために AI 生成コンテンツが検出可能であることを保証します。安全性と責任に関する当社のアプローチの詳細については、モデルカードをご確認ください。

最新の Gemini Audio モデルの使用開始:

3.8 Live は本日より展開を開始します:

3.8 Live Extended Thinking は本日より展開を開始します:

  • 開発者の場合: Google AI Studio 経由の Gemini API で利用可能
  • 企業の場合: Gemini Enterprise でプライベートプレビュー中、また近日中に Gemini Enterprise for Customer Experience および Google Workspace ビジネス顧客向けに展開予定
  • 一般ユーザーの場合: Gemini Live で利用可能。また、Google AI Pro および Ultra サブスクライバーは Workspace の Docs で、すべての Google AI サブスクライバーは Gmail と Keep で利用可能
ワンクリック保存

YouMindでバイラル記事をAI深読み

ソースを保存し、的を絞った質問をし、主張を要約して、バイラル記事を再利用できるノートに変えます。すべてを1つのAIワークスペースで行えます。

YouMindを探索
クリエイターのために

あなたの Markdown をきれいな 𝕏 記事に

自分の長文を投稿するとき、画像・表・コードブロックを 𝕏 向けに整形するのは手間がかかります。YouMind は Markdown 全体を、そのまま投稿できるきれいな 𝕏 記事に変換します。

Markdown → 𝕏 を試す

解読すべきパターンをもっと

最近のバイラル記事

バイラル記事をもっと見る