Gemini 3.8 Live और 3.8 Live Extended Thinking का परिचय

@GoogleAIStudio
अंग्रेज़ी15 सित॰ 2026
121K
1.6K
127
61
339

TL;DR

Google ने Gemini 3.8 Live और Extended Thinking पेश किया है, जो डेवलपर्स और उद्यमों के लिए समानांतर तर्क, वास्तविक समय दृश्य संदर्भ और पृष्ठभूमि कार्य निष्पादन के साथ उन्नत वॉइस AI प्रदान करता है।

Gemini 3.8 Live और Gemini 3.8 Live Extended Thinking हमारे अब तक के सबसे उन्नत लाइव डायलॉग मॉडल हैं। बुद्धिमत्ता और समानांतर तर्क (parallel reasoning) में हुए बड़े अपग्रेड ने आवाज़ का उपयोग करके जटिल कार्यों पर सहयोग करने और उन्हें निष्पादित करने को अधिक सहज बना दिया है।

आज, हम दो नए मॉडल पेश कर रहे हैं जो लगभग रियल-टाइम तर्क (near real-time reasoning) में प्रगति लाते हैं, जिससे वॉइस एजेंट्स को अधिक प्रभावी ढंग से सक्षम किया जा सके और AI के साथ बातचीत करना अधिक सहज और बुद्धिमान महसूस हो।

  • Gemini 3.8 Live: स्केल और लागत दक्षता के लिए बनाया गया, यह संवादी बुद्धिमत्ता (conversational intelligence), तरल संवाद और दृश्य ग्राउंडिंग (visual grounding) को एक साथ जोड़ता है।
  • Gemini 3.8 Live Extended Thinking: उच्च जटिलता वाले कार्यों के लिए बनाया गया, इसमें बढ़ी हुई बुद्धिमत्ता और बहु-चरणीय तर्क क्षमताएं शामिल हैं।

डेवलपर्स और एंटरप्राइजेज के लिए, ये मॉडल विश्वसनीय, उत्पादन-तैयार (production-ready) वॉइस एजेंट्स बनाने की नींव प्रदान करते हैं। वे Gemini ऐप, Google Workspace और Search में Gemini के साथ बातचीत को भी अधिक तरल और सहयोगी बनाते हैं — जिससे आप केवल अपनी आवाज़ का उपयोग करके जटिल कार्यों को हल कर सकते हैं।

अधिक तरल और बुद्धिमान संवादों का अनुभव करें

Gemini 3.8 Live Extended Thinking एंटरप्राइज-ग्रेड कार्य पूर्णता और बुद्धिमत्ता प्रदान करता है, Artificial Analysis के Speech to Speech Quality Index (82.6) में समग्र रूप से #1 स्थान हासिल करता है, और τ-Voice पर 68.6% तथा Sierra के τ-Voice-banking बेंचमार्क पर 35.1% के साथ एजेंटिक कार्य पूर्णता में अग्रणी है। यह Big Bench Audio पर 97.7% स्कोर करते हुए शक्तिशाली तर्क क्षमताएं भी प्रदान करता है, जबकि अन्य फ्रंटियर मॉडलों की तुलना में अत्यधिक प्रतिस्पर्धी मूल्य बिंदु बनाए रखता है।

Gemini 3.8 Live ने उपयोगकर्ताओं के बीच उच्च प्राथमिकता हासिल की है, Speech Agent Arena में दूसरा स्थान प्राप्त किया है। इस प्रदर्शन के अलावा, यह अत्यधिक लागत-प्रभावी बना हुआ है—डेवलपर्स और एंटरप्राइजेज को स्केल के लिए बनाया गया एक सक्षम और कुशल मॉडल प्रदान करता है।

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

ServiceNow के EVA-Bench पर, जो वॉइस एजेंट्स का मूल्यांकन करने के लिए एक बेंचमार्क है, हमारे मॉडल सटीकता और संवादी गुणवत्ता के बीच सफलतापूर्वक संतुलन बनाकर जटिल वर्कफ़्लो के लिए Pareto Frontier को आगे बढ़ाते हैं।

Google AI Studio - inline image

Gemini 3.8 Live दृश्य इनपुट को लगभग रियल-टाइम में संसाधित करता है, जिससे अधिक सहायक प्रतिक्रियाओं के लिए संवादों में संदर्भ (context) भर जाता है। यह संवाद के दौरान 97 समर्थित भाषाओं का स्वतः पता लगाता है और उनके बीच बदलाव करता है। यह बैकग्राउंड में टूल्स और API कॉल्स को निष्पादित करता है जबकि संवाद जारी रहता है, ताकि मॉडल अनुरोधों को स्वीकार कर सके और बैकग्राउंड में कार्य पूरे होने तक चैटिंग जारी रख सके।

Google AI Studio - inline image

Gemini 3.8 Live दृश्य संदर्भ का उपयोग करके लाइव प्रश्नों के उत्तर देते हुए कर्मचारियों के ऑनबोर्डिंग (onboarding) में रियल-टाइम में मार्गदर्शन करता है।

Google AI Studio - inline image

देखें कि कैसे Gemini 3.8 Live दृश्य संदर्भ, तर्क और प्राकृतिक संवादी प्रवाह का उपयोग करके लगभग रियल-टाइम में शतरंज खेलता है।

उन कार्यों के लिए जिनकी गहरी तर्क क्षमता की आवश्यकता होती है, 3.8 Live Extended Thinking एक ही समय में तर्क करता है और बोलता है। यह जटिल वर्कफ़्लो के लिए बढ़ी हुई बुद्धिमत्ता प्रदान करता है जबकि अबाधित संवादी प्रवाह बनाए रखता है — "Let me check that..." जैसे शुरुआती मौखिक संकेतों का उपयोग करके प्राकृतिक रूप से प्रॉम्प्ट्स को स्वीकार करता है, और बहु-चरणीय बैकग्राउंड कार्यों के प्रगतिशील होने पर उपयोगकर्ताओं को लाइव प्रगति विवरण (live progress narration) के माध्यम से मार्गदर्शन करता है।

Google AI Studio - inline image

देखें कि कैसे Gemini 3.8 Live Extended Thinking कच्चे स्केच और रियल-टाइम वॉइस फीडबैक को कार्यात्मक React घटकों (components) में बदल देता है।

Google AI Studio - inline image

देखें कि कैसे Gemini 3.8 Live Extended Thinking बहु-चरणीय बुकिंग और असynchronous फंक्शन कॉल्स का समन्वय करता है — सभी प्राकृतिक लाइव संवाद को बाधित किए बिना।

Google AI Studio - inline image

देखें कि कैसे Gemini 3.8 Live प्राकृतिक वाणी के माध्यम से तुरंत पूर्ण व्यावसायिक योजनाएं और कस्टम मार्केटिंग टूलकिट बनाता है।

Google Workspace और Search में, हमारे Live मॉडल अधिक सहज और सहयोगी अनुभव प्रदान करते हैं — विशेष रूप से जब आपके सबसे जटिल कार्यों को हल किया जा रहा हो।

Google AI Studio - inline image

Docs Live, Gmail Live, और Keep Live के साथ Google Workspace में Gemini 3.8 Live Extended Thinking आज़माएं।

Google AI Studio - inline image

Search Live के अंदर ही Gemini 3.8 Live द्वारा संचालित चरण-दर-चरण, रियल-टाइम ट्रबलशूटिंग सहायता पाएं।

डेवलपर और एंटरप्राइज वॉइस इकोसिस्टम को सक्षम करना

Gemini Live API का उपयोग करके, Agora, Fishjam, LiveKit, Pipecat, Vercel, और Vision Agents जैसे डेवलपर प्लेटफॉर्म डेवलपर्स को आसानी से उच्च-प्रदर्शन वाले वॉइस-संचालित इंटरफेस बनाने और तैनात करने में सक्षम बनाते हैं। ये प्लेटफॉर्म पीछे की ओर जटिल रियल-टाइम मीडिया स्ट्रीमिंग इन्फ्रास्ट्रक्चर का प्रबंधन करते हैं, जिससे डेवलपर्स पूरी तरह से उपयोगकर्ता अनुभव (user experience) को बेहतर बनाने पर ध्यान केंद्रित कर सकें।

हम Salesforce, Genspark, और Lumeris जैसी कंपनियों के साथ भी साझेदारी कर रहे हैं, जो 3.8 Live और 3.8 Live Extended Thinking के प्रति उत्साहित हैं, जिसके प्रभावशाली लेटेंसी (latency), तरलता (fluidity) और टूल-कॉलिंग क्षमताओं को रेखांकित किया गया है।

Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image
Google AI Studio - inline image

SynthID वॉटरमार्किंग के साथ पारदर्शिता सुनिश्चित करना

हमारे AI उत्पादों द्वारा उत्पन्न सभी ऑडियो को SynthID के साथ वॉटरमार्क किया जाता है। यह अदृश्य वॉटरमार्क सीधे ऑडियो आउटपुट में बुना जाता है, जिससे यह सुनिश्चित होता है कि AI-जनित सामग्री पहचानने योग्य रहे और गलत सूचना (misinformation) को रोका जा सके। सुरक्षा और जिम्मेदारी के प्रति हमारे दृष्टिकोण के विवरण के लिए, मॉडल कार्ड की समीक्षा करें।

हमारे नवीनतम Gemini Audio मॉडलों का उपयोग शुरू करें:

3.8 Live आज से ही रोलआउट हो रहा है:

  • डेवलपर्स के लिए: Google AI Studio के माध्यम से Gemini API में
  • एंटरप्राइजेज के लिए: Gemini Enterprise में निजी पूर्वावलोकन (private preview) में और जल्द ही Gemini Enterprise for Customer Experience में उपलब्ध होगा।
  • सभी के लिए: Search Live में

3.8 Live Extended Thinking आज से ही रोलआउट हो रहा है:

  • डेवलपर्स के लिए: Google AI Studio के माध्यम से Gemini API में
  • एंटरप्राइजेज के लिए: Gemini Enterprise में निजी पूर्वावलोकन में और जल्द ही Gemini Enterprise for Customer Experience और Google Workspace बिजनेस ग्राहकों के लिए उपलब्ध होगा।
  • सभी के लिए: Gemini Live में और Docs में Google AI Pro और Ultra सब्सक्राइबर के लिए Workspace में, तथा Gmail और Keep में सभी Google AI सब्सक्राइबर के लिए
एक क्लिक में सहेजें

YouMind में वायरल लेखों की AI गहन पढ़ाई

स्रोत सहेजें, केंद्रित सवाल पूछें, तर्क का सारांश बनाएँ और एक वायरल लेख को एक ही AI वर्कस्पेस में दोबारा इस्तेमाल करने लायक नोट्स में बदलें।

YouMind देखें
क्रिएटर्स के लिए

अपने Markdown को एक साफ़-सुथरे 𝕏 आर्टिकल में बदलें

जब आप अपना लंबा कंटेंट पब्लिश करते हैं, तो इमेज, टेबल और कोड ब्लॉक को 𝕏 के लिए फ़ॉर्मेट करना मुश्किल होता है। YouMind पूरे Markdown ड्राफ़्ट को एक साफ़-सुथरे, पोस्ट के लिए तैयार 𝕏 आर्टिकल में बदल देता है।

Markdown से 𝕏 आज़माएँ

समझने के लिए और पैटर्न

हाल के वायरल लेख

और वायरल लेख देखें