DeepSeek की मॉडल श्रृंखला एक छोटे ओपन-सोर्स कोडिंग मॉडल से बढ़कर दुनिया के सबसे अधिक देखे जाने वाले खुले वेट्स वाले AI परिवारों में से एक बन गई है। यह बंद प्रतिस्पर्धी मॉडलों की कीमत के एक छोटे हिस्से में अग्रणी स्तर के करीब बेंचमार्क स्कोर देने के लिए जानी जाती है। यह गाइड सभी प्रमुख DeepSeek मॉडल को नवीनतम से सबसे पुराने क्रम में सूचीबद्ध करती है और हर मॉडल के विनिर्देश, मुख्य विशेषताएँ तथा उपयुक्त उपयोग का संक्षिप्त परिचय देती है। साथ ही Chat Smith पर उपलब्ध मॉडल आज़माने के लिंक भी दिए गए हैं।

chat smith pro

DeepSeek V4 Pro & V4 Flash

24 अप्रैल 2026 को MIT लाइसेंस के तहत जारी DeepSeek V4 Pro (कुल 1.6T / सक्रिय 49B पैरामीटर) और DeepSeek V4 Flash (284B / सक्रिय 13B) दोनों 1M-टोकन कॉन्टेक्स्ट विंडो देते हैं, जिसकी लागत नए हाइब्रिड अटेंशन डिज़ाइन से कम हुई है। मूल्य: V4 Pro इनपुट $0.435/1M, आउटपुट $0.87/1M; V4 Flash इनपुट $0.14/1M, आउटपुट $0.28/1M। सबसे उपयुक्त: एजेंट आधारित कोडिंग और लंबे कॉन्टेक्स्ट वाला तर्क (Pro), अधिक मात्रा तथा कम विलंबता वाले कार्य (Flash)।

DeepSeek V3.2 (and V3.2-Speciale)

1 दिसंबर 2025 को जारी DeepSeek V3.2 टूल के उपयोग में सोच को सीधे जोड़ने वाला पहला DeepSeek मॉडल था और इसने SWE-Bench Verified पर 73.1% स्कोर किया। अधिक कंप्यूट वाला V3.2-Speciale तर्क को आगे ले गया, गणित ओलंपियाड में स्वर्ण पदक स्तर के नतीजे और AIME पर 96% हासिल किए। DeepSeek Reasoner V3.2 endpoint इस तर्क व्यवहार को विशेष “thinking” मोड के जरिए उपलब्ध कराता है। सबसे उपयुक्त: सामान्य सवाल-जवाब और एजेंट कार्य (V3.2), प्रतियोगिता स्तर का गणित तथा विस्तृत तर्क (Speciale)।

DeepSeek V3.2-Exp

29 सितंबर 2025 को जारी V3.2-Exp ने DeepSeek Sparse Attention (DSA) पेश किया। इसने पिछले संस्करण की तुलना में API मूल्य लगभग आधा किया और लंबे कॉन्टेक्स्ट वाले कार्यों की गति बढ़ाई। यह प्रायोगिक प्रीव्यू था जिसने दो महीने बाद आए पूर्ण V3.2 को आकार दिया। सबसे उपयुक्त: ऐतिहासिक संदर्भ; इसे V3.2 ने प्रतिस्थापित कर दिया है।

DeepSeek V3.1 (and V3.1-Terminus)

21 अगस्त 2025 को जारी DeepSeek V3.1 ने पहली बार “thinking” और सामान्य उत्तर मोड को एक ही मॉडल में मिलाया, जिससे चैट और तर्क के लिए अलग endpoint चुनने की जरूरत खत्म हुई। 22 सितंबर के Terminus सुधार ने अंग्रेज़ी/चीनी द्विभाषी आउटपुट को बेहतर किया, एजेंट द्वारा टूल उपयोग को मजबूत बनाया और लंबे कॉन्टेक्स्ट का खर्च घटाया। सबसे उपयुक्त: ऐतिहासिक संदर्भ; इसे V3.2 ने प्रतिस्थापित कर दिया है।

DeepSeek R1-0528

28 मई 2025 को जारी R1-0528, DeepSeek के मूल तर्क मॉडल का बड़ा अपडेट था। इसने AIME पर 91, LiveCodeBench पर 73 और SWE-bench Verified पर 57.6% हासिल किया। DeepSeek ने Qwen3 पर आधारित 8B डिस्टिल्ड संस्करण भी जारी किया, जो लैपटॉप पर चलाने लायक छोटा था। सबसे उपयुक्त: ऐतिहासिक संदर्भ; तर्क क्षमता अब V3.2/V4 श्रृंखला में मौजूद है।

DeepSeek V3-0324

24 मार्च 2025 को जारी V3-0324, मूल V3 आधार मॉडल का शांत लेकिन महत्वपूर्ण अपडेट था। यह MIT लाइसेंस के तहत Hugging Face पर जारी 685B-पैरामीटर MoE मॉडल था और बाद की रिलीज़ों की नींव बना। सबसे उपयुक्त: ऐतिहासिक संदर्भ; इसे V3.1 और बाद के संस्करणों ने पूरी तरह प्रतिस्थापित कर दिया है।

DeepSeek R1 (and R1-Zero)

20 जनवरी 2025 को जारी DeepSeek R1 ने कंपनी को घर-घर में पहचाना जाने वाला नाम बना दिया और लॉन्च वाले सप्ताह अमेरिकी टेक शेयरों के मूल्य से सैकड़ों अरब डॉलर मिटा दिए। इसने दिखाया कि बड़े पैमाने के supervised fine-tuning के बिना, केवल reinforcement learning से संचालित तर्क भी OpenAI o1 से प्रतिस्पर्धा करने वाला मॉडल बना सकता है। प्रायोगिक R1-Zero checkpoint ने शुरुआत से RL का परीक्षण किया, जबकि R1 ने पढ़ने में आसानी के लिए cold-start डेटा जोड़ा। छह छोटे डिस्टिल्ड मॉडल ने डेवलपर को हल्का संस्करण स्थानीय रूप से चलाने दिया। सबसे उपयुक्त: ऐतिहासिक संदर्भ; इसके बाद R1-0528 और V3.2/V4 श्रृंखला आई।

DeepSeek V3

25–26 दिसंबर 2024 को जारी DeepSeek V3 ने DeepSeek के Mixture-of-Experts डिज़ाइन को कुल 671 अरब पैरामीटर (37B सक्रिय) तक बढ़ाया और 14.8 ट्रिलियन टोकन पर प्रशिक्षण लिया। बताई गई लागत पश्चिमी प्रयोगशालाओं के समान मॉडलों के खर्च से बहुत कम थी। यही वह आधार आर्किटेक्चर है जिस पर बाद में R1 बनाया गया। सबसे उपयुक्त: संदर्भ और शोध; उदार लाइसेंस के तहत स्वयं होस्ट किया जा सकता है।

DeepSeek V2.5

5 सितंबर 2024 को जारी और उसी दिसंबर में संशोधित V2.5 ने DeepSeek के सामान्य चैट मॉडल और कोडिंग केंद्रित श्रृंखला को एक ही मॉडल में जोड़ा, जिससे V3 से पहले उत्पाद श्रृंखला सरल हुई। सबसे उपयुक्त: केवल ऐतिहासिक संदर्भ।

DeepSeek V2 (and Coder V2)

6 मई 2024 को जारी DeepSeek V2 (कुल 236B / सक्रिय 21B पैरामीटर, 128K कॉन्टेक्स्ट) बाद के हर DeepSeek प्रमुख मॉडल का आर्किटेक्चर संबंधी शुरुआती बिंदु है। इसने Mixture-of-Experts डिज़ाइन के साथ सस्ते KV कैश के लिए Multi-head Latent Attention (MLA) पेश किया, जिससे पुराने DeepSeek dense मॉडलों की तुलना में प्रशिक्षण लागत 42.5% और KV कैश आकार 93.3% कम हुआ। जून में आया DeepSeek Coder V2 इस आर्किटेक्चर को 338 प्रोग्रामिंग भाषाओं तक ले गया। सबसे उपयुक्त: ऐतिहासिक संदर्भ; आज checkpoint के बजाय आर्किटेक्चर महत्वपूर्ण है।

DeepSeek Coder & DeepSeek LLM (67B)

नवंबर 2023 में जारी DeepSeek के पहले मॉडल—DeepSeek Coder और 7B/67B DeepSeek LLM—लगभग 2 ट्रिलियन टोकन पर प्रशिक्षित थे और लॉन्च के समय कोडिंग, गणित व तर्क बेंचमार्क पर Meta LLaMA-2 70B से प्रतिस्पर्धा करते थे। V3 या R1 के दुनिया भर में सुर्खियाँ बनने से बहुत पहले उन्होंने DeepSeek को एक गंभीर ओपन-सोर्स प्रयोगशाला के रूप में स्थापित किया। सबसे उपयुक्त: केवल ऐतिहासिक संदर्भ।

DeepSeek श्रृंखला अब खुले वेट्स वाले सामान्य मॉडल, विशेष तर्क मॉडल और प्रमुख स्तर पर fast/pro संस्करणों तक फैली है। सभी उदार लाइसेंस के तहत जारी होते हैं और उनकी कीमत बंद प्रतिस्पर्धियों की तुलना में लगभग दसवाँ हिस्सा है। स्वयं होस्ट किए बिना इन मॉडलों का उपयोग करने वाली टीमों और व्यक्तियों के लिए Chat Smith उपलब्ध DeepSeek मॉडलों के साथ GPT, Claude, Gemini और Grok तक एक ही इंटरफ़ेस से पहुँच देता है। पूरा AI मॉडल कैटलॉग देखें और Chat Smith पर अपने वर्कफ़्लो के लिए सही मॉडल चुनें।

अक्सर पूछे जाने वाले प्रश्न

इस समय DeepSeek V4 परिवार चल रहा है, जो अप्रैल 2026 में दो रूपों में आया, जटिल तर्क और स्वचालित प्रोग्रामिंग के लिए बड़ा प्रतिरूप V4 Pro, और अधिक मात्रा वाले कामों के लिए हल्का तथा सस्ता V4 Flash। दोनों दस लाख इकाइयों जितना लंबा संदर्भ सँभालते हैं।

logo chat smith

Editorial Team

Managing Editor

Chat Smith संपादकीय टीम AI के प्रति उत्साही लोगों, शोधकर्ताओं और कंटेंट क्रिएटर्स का एक समूह है, जो कृत्रिम बुद्धिमत्ता को अधिक सुलभ और व्यावहारिक बनाने के लिए समर्पित है। Chat Smith ब्लॉग के माध्यम से हम नवीनतम AI रुझान, टूल समीक्षाएँ, उद्योग संबंधी जानकारी और उपयोगी मार्गदर्शिकाएँ साझा करते हैं, ताकि व्यक्ति और व्यवसाय AI से अधिक मूल्य प्राप्त कर सकें। हमारा उद्देश्य सरल है—स्पष्ट, विश्वसनीय और आसानी से समझ आने वाली सामग्री प्रदान करना, जिससे पाठक AI की तेज़ी से बदलती दुनिया में हमेशा अपडेट रहें, अधिक उत्पादक बनें और दूसरों से आगे रह सकें।

यह लेख साझा करें

संबंधित लेख