Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 是我們迄今為止最先進的即時對話模型。在智慧與平行推理方面的重大升級,讓透過語音協作並執行複雜任務變得更加直覺。
今天,我們推出兩款新模型,帶來近即時推理技術的進步,以更有效地支援語音 Agent,並讓與 AI 的對話感覺更直覺、更聰明。
- Gemini 3.8 Live:專為規模化與成本效益打造,結合對話智慧、流暢互動與視覺理解能力。
- Gemini 3.8 Live Extended Thinking:專為高複雜度任務打造,具備更高的智慧與多步驟推理能力。
對於開發人員和企業而言,這些模型提供了構建可靠、可投入生產環境之語音 Agent 的基礎元件。它們也讓你在 Gemini App、Google Workspace 和 Search 中與 Gemini 的對話更加流暢且具協作性——幫助你僅透過語音就能處理複雜任務。
體驗更流暢、更聰明的對話
Gemini 3.8 Live Extended Thinking 提供企業級的任務完成能力與智慧表現,在 Artificial Analysis 的「語音對語音品質指數」(Speech to Speech Quality Index)中以 82.6 分位居整體第一,並在 Agentic 任務完成率上領先,於 τ-Voice 基準測試中達到 68.6%,在 Sierra 的 τ-Voice-banking 基準測試中達到 35.1%。它同時展現強大的推理能力,在 Big Bench Audio 中獲得 97.7% 的高分,而與其他前沿模型相比,仍保持極具競爭力的價格點。
Gemini 3.8 Live 深受使用者青睞,在 Speech Agent Arena 中排名第二。除了優異的效能外,它依然具有極高的成本效益——為開發人員和企業提供一款功能強大且高效、專為規模化打造的模型。




在 ServiceNow 的 EVA-Bench(一個用於評估語音 Agent 的基準測試)中,我們的模型透過成功平衡準確率與對話品質,將複雜工作流程的帕累托前沿(Pareto Frontier)推向新高度。

Gemini 3.8 Live 能以近即時的方式處理視覺輸入,透過上下文豐富對話內容,提供更實用的回應。它能自動偵測並在對話中途切換至 97 種支援語言之一。它在背景執行工具和 API 呼叫的同時繼續對話,因此模型可以確認請求並在任務於背景完成的過程中持續聊天。

Gemini 3.8 Live 利用視覺上下文即時回答問題,引導員工進行入職培訓。

觀看 Gemini 3.8 Live 如何利用視覺上下文、推理能力和自然對話流程,在近即時的情況下進行國際象棋對弈。
對於需要更深層推理的任務,3.8 Live Extended Thinking 能同時進行推理與說話。它在維持不間斷對話流程的同時,為複雜工作流程提供更高的智慧——使用如 "讓我查一下..." 等早期口頭提示來自然地確認指令,並透過即時進度敘述,引導使用者了解多步驟背景任務的進展。

觀看 Gemini 3.8 Live Extended Thinking 如何將原始草圖和即時語音回饋轉換為可用的 React 元件。

查看 Gemini 3.8 Live Extended Thinking 如何協調多步驟預訂和非同步函數呼叫——全程不打斷自然的即時對話。

觀看 Gemini 3.8 Live 如何透過自然語音,即時建立完整的商業計畫和客製化行銷工具包。
在 Google Workspace 和 Search 中,我們的 Live 模型提供更直覺、更具協作性的體驗——尤其是在處理你最複雜的任務時。

在 Google Workspace 中透過 Docs Live、Gmail Live 和 Keep Live 試用 Gemini 3.8 Live Extended Thinking。

在 Search Live 中直接獲得由 Gemini 3.8 Live 驅動的逐步即時故障排除協助。
賦能開發人員與企業語音生態系統
透過使用 Gemini Live API,開發平台如 Agora、Fishjam、LiveKit、Pipecat、Vercel 和 Vision Agents 讓開發人員能夠輕鬆構建和部署高效能的語音驅動介面。這些平台在幕後管理複雜的即時媒體串流基礎設施,讓開發人員能完全專注於打造使用者體驗。
我們也與 Salesforce、Genspark 和 Lumeris 等公司合作,他們對 3.8 Live 和 3.8 Live Extended Thinking 感到興奮,特別是其令人印象深刻的低延遲、流暢度和工具呼叫能力。











透過 SynthID 浮水印確保透明度
我們所有 AI 產品生成的音訊都標記有 SynthID 浮水印。這種不可見的浮水印直接嵌入音訊輸出中,確保 AI 生成的內容仍可被檢測出來,以幫助防止錯誤資訊的傳播。如需了解我們在安全與責任方面的做法詳情,請檢視模型卡(model card)。
開始使用我們最新的 Gemini 音訊模型:
3.8 Live 將於今日開始推出:
- 給開發人員:透過 Google AI Studio 中的 Gemini API
- 給企業:在 Gemini Enterprise 中進行私人預覽,即將推出 Gemini Enterprise for Customer Experience
- 給所有人:在 Search Live 中
3.8 Live Extended Thinking 將於今日開始推出:
- 給開發人員:透過 Google AI Studio 中的 Gemini API
- 給企業:在 Gemini Enterprise 中進行私人預覽,即將推出 Gemini Enterprise for Customer Experience 以及 Google Workspace 商業客戶版本
- 給所有人:在 Gemini Live 中,以及供 Google AI Pro 和 Ultra 訂閱者在 Workspace 的 Docs 中使用,並供所有 Google AI 訂閱者在 Gmail 和 Keep 中使用





