Gemini 3.8 Live और Gemini 3.8 Live Extended Thinking हमारे अब तक के सबसे उन्नत लाइव डायलॉग मॉडल हैं। बुद्धिमत्ता और समानांतर तर्क (parallel reasoning) में हुए बड़े अपग्रेड ने आवाज़ का उपयोग करके जटिल कार्यों पर सहयोग करने और उन्हें निष्पादित करने को अधिक सहज बना दिया है।
आज, हम दो नए मॉडल पेश कर रहे हैं जो लगभग रियल-टाइम तर्क (near real-time reasoning) में प्रगति लाते हैं, जिससे वॉइस एजेंट्स को अधिक प्रभावी ढंग से सक्षम किया जा सके और AI के साथ बातचीत करना अधिक सहज और बुद्धिमान महसूस हो।
- Gemini 3.8 Live: स्केल और लागत दक्षता के लिए बनाया गया, यह संवादी बुद्धिमत्ता (conversational intelligence), तरल संवाद और दृश्य ग्राउंडिंग (visual grounding) को एक साथ जोड़ता है।
- Gemini 3.8 Live Extended Thinking: उच्च जटिलता वाले कार्यों के लिए बनाया गया, इसमें बढ़ी हुई बुद्धिमत्ता और बहु-चरणीय तर्क क्षमताएं शामिल हैं।
डेवलपर्स और एंटरप्राइजेज के लिए, ये मॉडल विश्वसनीय, उत्पादन-तैयार (production-ready) वॉइस एजेंट्स बनाने की नींव प्रदान करते हैं। वे Gemini ऐप, Google Workspace और Search में Gemini के साथ बातचीत को भी अधिक तरल और सहयोगी बनाते हैं — जिससे आप केवल अपनी आवाज़ का उपयोग करके जटिल कार्यों को हल कर सकते हैं।
अधिक तरल और बुद्धिमान संवादों का अनुभव करें
Gemini 3.8 Live Extended Thinking एंटरप्राइज-ग्रेड कार्य पूर्णता और बुद्धिमत्ता प्रदान करता है, Artificial Analysis के Speech to Speech Quality Index (82.6) में समग्र रूप से #1 स्थान हासिल करता है, और τ-Voice पर 68.6% तथा Sierra के τ-Voice-banking बेंचमार्क पर 35.1% के साथ एजेंटिक कार्य पूर्णता में अग्रणी है। यह Big Bench Audio पर 97.7% स्कोर करते हुए शक्तिशाली तर्क क्षमताएं भी प्रदान करता है, जबकि अन्य फ्रंटियर मॉडलों की तुलना में अत्यधिक प्रतिस्पर्धी मूल्य बिंदु बनाए रखता है।
Gemini 3.8 Live ने उपयोगकर्ताओं के बीच उच्च प्राथमिकता हासिल की है, Speech Agent Arena में दूसरा स्थान प्राप्त किया है। इस प्रदर्शन के अलावा, यह अत्यधिक लागत-प्रभावी बना हुआ है—डेवलपर्स और एंटरप्राइजेज को स्केल के लिए बनाया गया एक सक्षम और कुशल मॉडल प्रदान करता है।




ServiceNow के EVA-Bench पर, जो वॉइस एजेंट्स का मूल्यांकन करने के लिए एक बेंचमार्क है, हमारे मॉडल सटीकता और संवादी गुणवत्ता के बीच सफलतापूर्वक संतुलन बनाकर जटिल वर्कफ़्लो के लिए Pareto Frontier को आगे बढ़ाते हैं।

Gemini 3.8 Live दृश्य इनपुट को लगभग रियल-टाइम में संसाधित करता है, जिससे अधिक सहायक प्रतिक्रियाओं के लिए संवादों में संदर्भ (context) भर जाता है। यह संवाद के दौरान 97 समर्थित भाषाओं का स्वतः पता लगाता है और उनके बीच बदलाव करता है। यह बैकग्राउंड में टूल्स और API कॉल्स को निष्पादित करता है जबकि संवाद जारी रहता है, ताकि मॉडल अनुरोधों को स्वीकार कर सके और बैकग्राउंड में कार्य पूरे होने तक चैटिंग जारी रख सके।

Gemini 3.8 Live दृश्य संदर्भ का उपयोग करके लाइव प्रश्नों के उत्तर देते हुए कर्मचारियों के ऑनबोर्डिंग (onboarding) में रियल-टाइम में मार्गदर्शन करता है।

देखें कि कैसे Gemini 3.8 Live दृश्य संदर्भ, तर्क और प्राकृतिक संवादी प्रवाह का उपयोग करके लगभग रियल-टाइम में शतरंज खेलता है।
उन कार्यों के लिए जिनकी गहरी तर्क क्षमता की आवश्यकता होती है, 3.8 Live Extended Thinking एक ही समय में तर्क करता है और बोलता है। यह जटिल वर्कफ़्लो के लिए बढ़ी हुई बुद्धिमत्ता प्रदान करता है जबकि अबाधित संवादी प्रवाह बनाए रखता है — "Let me check that..." जैसे शुरुआती मौखिक संकेतों का उपयोग करके प्राकृतिक रूप से प्रॉम्प्ट्स को स्वीकार करता है, और बहु-चरणीय बैकग्राउंड कार्यों के प्रगतिशील होने पर उपयोगकर्ताओं को लाइव प्रगति विवरण (live progress narration) के माध्यम से मार्गदर्शन करता है।

देखें कि कैसे Gemini 3.8 Live Extended Thinking कच्चे स्केच और रियल-टाइम वॉइस फीडबैक को कार्यात्मक React घटकों (components) में बदल देता है।

देखें कि कैसे Gemini 3.8 Live Extended Thinking बहु-चरणीय बुकिंग और असynchronous फंक्शन कॉल्स का समन्वय करता है — सभी प्राकृतिक लाइव संवाद को बाधित किए बिना।

देखें कि कैसे Gemini 3.8 Live प्राकृतिक वाणी के माध्यम से तुरंत पूर्ण व्यावसायिक योजनाएं और कस्टम मार्केटिंग टूलकिट बनाता है।
Google Workspace और Search में, हमारे Live मॉडल अधिक सहज और सहयोगी अनुभव प्रदान करते हैं — विशेष रूप से जब आपके सबसे जटिल कार्यों को हल किया जा रहा हो।

Docs Live, Gmail Live, और Keep Live के साथ Google Workspace में Gemini 3.8 Live Extended Thinking आज़माएं।

Search Live के अंदर ही Gemini 3.8 Live द्वारा संचालित चरण-दर-चरण, रियल-टाइम ट्रबलशूटिंग सहायता पाएं।
डेवलपर और एंटरप्राइज वॉइस इकोसिस्टम को सक्षम करना
Gemini Live API का उपयोग करके, Agora, Fishjam, LiveKit, Pipecat, Vercel, और Vision Agents जैसे डेवलपर प्लेटफॉर्म डेवलपर्स को आसानी से उच्च-प्रदर्शन वाले वॉइस-संचालित इंटरफेस बनाने और तैनात करने में सक्षम बनाते हैं। ये प्लेटफॉर्म पीछे की ओर जटिल रियल-टाइम मीडिया स्ट्रीमिंग इन्फ्रास्ट्रक्चर का प्रबंधन करते हैं, जिससे डेवलपर्स पूरी तरह से उपयोगकर्ता अनुभव (user experience) को बेहतर बनाने पर ध्यान केंद्रित कर सकें।
हम Salesforce, Genspark, और Lumeris जैसी कंपनियों के साथ भी साझेदारी कर रहे हैं, जो 3.8 Live और 3.8 Live Extended Thinking के प्रति उत्साहित हैं, जिसके प्रभावशाली लेटेंसी (latency), तरलता (fluidity) और टूल-कॉलिंग क्षमताओं को रेखांकित किया गया है।











SynthID वॉटरमार्किंग के साथ पारदर्शिता सुनिश्चित करना
हमारे AI उत्पादों द्वारा उत्पन्न सभी ऑडियो को SynthID के साथ वॉटरमार्क किया जाता है। यह अदृश्य वॉटरमार्क सीधे ऑडियो आउटपुट में बुना जाता है, जिससे यह सुनिश्चित होता है कि AI-जनित सामग्री पहचानने योग्य रहे और गलत सूचना (misinformation) को रोका जा सके। सुरक्षा और जिम्मेदारी के प्रति हमारे दृष्टिकोण के विवरण के लिए, मॉडल कार्ड की समीक्षा करें।
हमारे नवीनतम Gemini Audio मॉडलों का उपयोग शुरू करें:
3.8 Live आज से ही रोलआउट हो रहा है:
- डेवलपर्स के लिए: Google AI Studio के माध्यम से Gemini API में
- एंटरप्राइजेज के लिए: Gemini Enterprise में निजी पूर्वावलोकन (private preview) में और जल्द ही Gemini Enterprise for Customer Experience में उपलब्ध होगा।
- सभी के लिए: Search Live में
3.8 Live Extended Thinking आज से ही रोलआउट हो रहा है:
- डेवलपर्स के लिए: Google AI Studio के माध्यम से Gemini API में
- एंटरप्राइजेज के लिए: Gemini Enterprise में निजी पूर्वावलोकन में और जल्द ही Gemini Enterprise for Customer Experience और Google Workspace बिजनेस ग्राहकों के लिए उपलब्ध होगा।
- सभी के लिए: Gemini Live में और Docs में Google AI Pro और Ultra सब्सक्राइबर के लिए Workspace में, तथा Gmail और Keep में सभी Google AI सब्सक्राइबर के लिए





