AI Guide

Gemini 3.1 Flash-Lite: कीमत, फीचर्स और इस्तेमाल का तरीका

Gemini 3.1 Flash-Lite, Google का Gemini 3 सीरीज़ में सबसे किफायती मॉडल है। जानें कीमत, फीचर्स, बेंचमार्क और Chat Smith पर इस्तेमाल का तरीका।
Gemini 3.1 Flash-Lite: कीमत, फीचर्स और इस्तेमाल का तरीका
E
Editorial Team
Jul 22, 2026 ・ 5 mins read

Gemini 3.1 Flash-Lite, Google की Gemini 3 लाइनअप का सबसे कॉस्ट-इफेक्टिव मॉडल है, जो उन टीमों के लिए बनाया गया है जिन्हें भारी लागत के बिना स्पीड और स्केल चाहिए। जहाँ फ्लैगशिप मॉडल स्पीड की जगह गहराई को चुनते हैं, वहीं Flash-Lite इस समीकरण को पलट देता है: यह तेज़ी से जवाब देता है, कीमत काफी कम है, फिर भी ट्रांसलेशन, ट्रांसक्रिप्शन, डेटा एक्सट्रैक्शन और डॉक्यूमेंट समरी जैसे असली काम Gemini 2.5 Flash के करीब क्वालिटी के साथ करता है। इस गाइड में बताया गया है कि Gemini 3.1 Flash-Lite असल में क्या करता है, Gemini लाइनअप में इसकी कीमत कैसे कंपेयर होती है, और Chat Smith वर्कफ़्लो में यह कहाँ फिट बैठता है।

Gemini 3.1 Flash-Lite क्या है?

Gemini 3.1 Flash-Lite, Google की Gemini 3 सीरीज़ का सबसे हल्का और सबसे किफायती मॉडल है। यह हाई-वॉल्यूम, लेटेंसी-सेंसिटिव वर्कलोड के लिए बनाया गया है — यानी वो बैकग्राउंड टास्क जो दिन में हज़ारों-लाखों बार चलते हैं, जहाँ हर मिलीसेकंड और हर सेंट का फ्रैक्शन मायने रखता है। Google ने पहले इसे Google AI Studio में Gemini API के ज़रिए प्रीव्यू में और एंटरप्राइज़ के लिए Vertex AI के ज़रिए रोलआउट किया, फिर इसे जनरल एवेलेबिलिटी में लाया।

पुराने Gemini 2.0 Flash-Lite और Gemini 2.5 Flash-Lite मॉडल्स के मुकाबले, यह वर्ज़न क्वालिटी में एक बड़ा उछाल लाता है — इंस्ट्रक्शन फॉलोइंग, रीज़निंग और ऑडियो अंडरस्टैंडिंग जैसी कोर कैपेबिलिटीज़ में Gemini 2.5 Flash के साथ गैप को काफी हद तक कम करते हुए, फिर भी Lite-टियर प्राइसिंग बनाए रखता है। इसमें चार एडजस्टेबल थिंकिंग लेवल भी हैं (मिनिमल, लो, मीडियम, हाई), जिससे डेवलपर्स हर रिक्वेस्ट की मुश्किल के हिसाब से रीज़निंग डेप्थ को कम-ज़्यादा कर सकते हैं।

Gemini 3.1 Flash-Lite के मुख्य फीचर्स

मल्टीमॉडल इनपुट, टेक्स्ट आउटपुट

Gemini 3.1 Flash-Lite इनपुट के तौर पर टेक्स्ट, इमेज, वीडियो, ऑडियो और PDF फाइलें ले सकता है, लेकिन आउटपुट सिर्फ़ टेक्स्ट में देता है। इसमें 1,048,576 टोकन तक का इनपुट कॉन्टेक्स्ट विंडो और 65,536 टोकन तक का आउटपुट सपोर्ट है — यानी लंबे डॉक्यूमेंट्स, पूरी ऑडियो रिकॉर्डिंग्स या बड़ी चैट हिस्ट्री को एक ही कॉल में प्रोसेस करने के लिए काफी जगह।

एडजस्टेबल थिंकिंग लेवल

हर रिक्वेस्ट को गहरी रीज़निंग की ज़रूरत नहीं होती। Gemini 3.1 Flash-Lite हर कॉल के लिए थिंकिंग लेवल सेट करने देता है, ताकि मुश्किल प्रॉब्लम्स पर थोड़ी लेटेंसी की कीमत पर बेहतर एक्यूरेसी मिले, या जब टास्क सिंपल हो और स्पीड ज़्यादा मायने रखे, तो एक्स्ट्रा रीज़निंग स्टेप पूरी तरह स्किप कर दिया जाए।

एजेंटिक और हाई-वॉल्यूम वर्कलोड के लिए बना

स्पीड के अलावा, यह मॉडल बैच प्रोसेसिंग, प्रॉम्प्ट कैशिंग, फ़ंक्शन कॉलिंग, स्ट्रक्चर्ड JSON आउटपुट, कोड एग्ज़िक्यूशन और सर्च ग्राउंडिंग सपोर्ट करता है — यानी वो इन्फ्रास्ट्रक्चर जो एजेंटिक पाइपलाइन्स और ऑटोमेटेड क्लासिफ़ायर्स को असल में चाहिए होता है, सिर्फ़ एक चैट विंडो नहीं।

Gemini 3.1 Flash-Lite की कीमत और परफ़ॉर्मेंस

Gemini 3.1 Flash-Lite की कीमत $0.25 प्रति मिलियन इनपुट टोकन और $1.50 प्रति मिलियन आउटपुट टोकन है — जो Gemini 3 Flash की लगभग आधी कीमत है। स्पीड की बात करें तो, Artificial Analysis के इंडिपेंडेंट बेंचमार्क में पाया गया कि यह Gemini 2.5 Flash के मुकाबले फ़र्स्ट टोकन तक काफ़ी तेज़ी से पहुँचता है और आउटपुट थ्रूपुट भी ज़्यादा है, जबकि क्वालिटी बराबर या उससे बेहतर है।

टियरफोकसChat Smith पर उदाहरण
Proगहरी रीज़निंग, रिसर्च-ग्रेड एनालिसिसGemini 2.5 Pro
Flashस्पीड और कैपेबिलिटी के बीच बैलेंसGemini 3 Flash
Flash-Liteसबसे तेज़, सबसे सस्ता, हाई-वॉल्यूम टास्कGemini 3.1 Flash-Lite

इस टियर के लिए बना अकेला मॉडल Flash-Lite नहीं है। GPT-5 Nano और Claude Haiku 4.5 भी वही डिज़ाइन प्रिंसिपल फॉलो करते हैं — यानी कुछ रीज़निंग डेप्थ की जगह स्पीड और कम कीमत — और तीनों ही हाई-फ़्रीक्वेंसी जॉब्स के लिए काम आते हैं। Google की अपनी लाइनअप में, Gemini 3.1 Flash-Lite डिफ़ॉल्ट बजट ऑप्शन के तौर पर Gemini 2.5 Flash-Lite की जगह लेता है, जबकि Gemini 2.5 Flash अब भी क्वालिटी का वो बेंचमार्क है जिसे यह पकड़ने की कोशिश कर रहा है।

Chat Smith पर Gemini 3.1 Flash-Lite कैसे इस्तेमाल करें

Chat Smith आपको Google की बाकी मॉडल लाइनअप के साथ Gemini 3.1 Flash-Lite तक सीधी एक्सेस देता है, ताकि आप किसी एक मॉडल से बंधे रहने के बजाय टास्क के हिसाब से मॉडल बदल सकें। जब भी आपको तेज़, सस्ता आउटपुट चाहिए — जैसे क्विक रिप्लाई, फ़र्स्ट-ड्राफ्ट, ट्रांसलेशन या किसी लंबे PDF का समरी — तब यह एक अच्छा डिफ़ॉल्ट चॉइस है, और जब काम को ज़्यादा गहरी रीज़निंग चाहिए हो तो आप हमेशा किसी भारी मॉडल पर स्विच कर सकते हैं।

डॉक्यूमेंट-हैवी वर्कफ़्लो के लिए, Flash-Lite की स्पीड को Chat Smith के PDF समराइज़र के साथ मिलाने से पूरी फ़ाइल खोलने से पहले लंबी रिपोर्ट्स को जल्दी ट्रायाज करना आसान हो जाता है।

निष्कर्ष

Gemini 3.1 Flash-Lite, फ्लैगशिप Gemini मॉडल जो कुछ ऑफ़र करता है उसका ज़्यादातर हिस्सा बहुत कम कीमत में देता है, जिससे यह उस हाई-वॉल्यूम बैकग्राउंड काम के लिए एक प्रैक्टिकल डिफ़ॉल्ट बन जाता है जो असल में ज़्यादातर रियल-वर्ल्ड AI इस्तेमाल बनाता है। आप इसे Chat Smith के अंदर बाकी सभी मॉडल्स के साथ सीधे ट्राई कर सकते हैं।

अक्सर पूछे जाने वाले प्रश्न

1. Gemini 3.1 Flash-Lite क्या है?

Gemini 3.1 Flash-Lite, Google का Gemini 3 सीरीज़ में सबसे कॉस्ट-इफेक्टिव मॉडल है, जो ट्रांसलेशन, ट्रांसक्रिप्शन और स्ट्रक्चर्ड डेटा एक्सट्रैक्शन जैसे हाई-वॉल्यूम, लो-लेटेंसी टास्क के लिए बनाया गया है, और क्वालिटी में Gemini 2.5 Flash के करीब है।

2. Gemini 3.1 Flash-Lite की कीमत कितनी है?

इसकी कीमत $0.25 प्रति मिलियन इनपुट टोकन और $1.50 प्रति मिलियन आउटपुट टोकन है — यानी Gemini 3 Flash की लगभग आधी कीमत, जो इसे हाई-वॉल्यूम AI वर्कलोड चलाने का सबसे सस्ता तरीका बनाता है।

3. Gemini 3.1 Flash-Lite किन कामों के लिए सबसे अच्छा है?

यह ट्रांसलेशन, ऑडियो ट्रांसक्रिप्शन, स्ट्रक्चर्ड डेटा एक्सट्रैक्शन, डॉक्यूमेंट समरी जैसे बार-बार होने वाले और साफ़-साफ़ डिफ़ाइन किए गए टास्क के लिए बना है, साथ ही लाइटवेट राउटिंग के लिए भी, जहाँ एक तेज़ क्लासिफ़ायर कॉल तय करता है कि रिक्वेस्ट को किसी भारी मॉडल की ज़रूरत है या नहीं।

logo chat smith

Editorial Team

Chat Smith संपादकीय टीम AI के प्रति उत्साही लोगों, शोधकर्ताओं और कंटेंट क्रिएटर्स का एक समूह है, जो कृत्रिम बुद्धिमत्ता को अधिक सुलभ और व्यावहारिक बनाने के लिए समर्पित है। Chat Smith ब्लॉग के माध्यम से हम नवीनतम AI रुझान, टूल समीक्षाएँ, उद्योग संबंधी जानकारी और उपयोगी मार्गदर्शिकाएँ साझा करते हैं, ताकि व्यक्ति और व्यवसाय AI से अधिक मूल्य प्राप्त कर सकें। हमारा उद्देश्य सरल है—स्पष्ट, विश्वसनीय और आसानी से समझ आने वाली सामग्री प्रदान करना, जिससे पाठक AI की तेज़ी से बदलती दुनिया में हमेशा अपडेट रहें, अधिक उत्पादक बनें और दूसरों से आगे रह सकें।

संबंधित लेख

अपने काम को बेहतर बनाएं, बस एक क्लिक दूर!

प्रोजेक्ट आगे बढ़ाने के लिए जो कुछ भी चाहिए, वह आपकी उंगलियों पर है।