DeepSeek ने V4.1 Flash को 10 सितंबर 2026 को लॉन्च किया। कंपनी इसे नई आर्किटेक्चर फैमिली का सबसे छोटा, नेटिव मल्टीमॉडल मॉडल बताती है। [1][10] 14 सितंबर को 04:00 UTC (बीजिंग समय दोपहर 12 बजे) से V4 Pro API अनुरोध अपने आप V4.1 Flash पर रूट होंगे और उन पर Flash की दरें लागू होंगी। [3][39] ऑफ पीक API दरें $0.003 प्रति 10...
प्रकाशितकर्ताGPT-5.6 Terra से संपादितGPT Image 2 से चित्र बनाए गए
शोध उत्तर

Create a landscape editorial hero image for this Studio Global article: What did Chinese AI startup DeepSeek announce with the launch of its V4.1 Flash model on September 11, 2026, including how the slimmed-down. Article summary: DeepSeek launched V4.1-Flash on September 10, not September 11. It positioned the smaller, open-weight model as a new-architecture successor that combines native visual understanding with lower-cost, faster inference—and. Topic tags: general, news, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermark
DeepSeek ने 10 सितंबर 2026 को DeepSeek-V4.1-Flash जारी किया। यह सिर्फ एक नया मॉडल नहीं है: कंपनी इसे कम लागत वाले, नेटिव मल्टीमॉडल विकल्प के रूप में पेश कर रही है और V4-Pro API उपयोगकर्ताओं को इसी पर स्थानांतरित करने की तैयारी में है। ऐसे में प्रोडक्शन API चलाने वाली टीमों के लिए सबसे बड़ा बदलाव मॉडल माइग्रेशन है, केवल कीमत नहीं। 1
3
10
DeepSeek के अनुसार, V4.1-Flash उसकी नई आर्किटेक्चर फैमिली का सबसे छोटा मॉडल है। कंपनी का दावा है कि नई डिज़ाइन अधिक क्षमता, तेज़ इनफरेंस, ज्यादा थ्रूपुट और भविष्य में बड़े मॉडलों तक स्केल होने के लिए बनाई गई है। इसमें नेटिव विज़ुअल अंडरस्टैंडिंग भी है—यानी इमेज और टेक्स्ट इनपुट को किसी अलग विज़न ऐड-ऑन के बजाय मूल मॉडल में ही संभाला जाता है। 10
16
API में इसे deepseek-flash नाम से इस्तेमाल किया जा सकता है। इसके साथ पुराने V4-Flash और V4-Flash-Vision-Exp मॉडल हटा दिए गए हैं। 10
16
लॉन्च से जुड़ी रिपोर्टों और DeepSeek की जानकारी के मुताबिक, यह 552 अरब पैरामीटर वाला मिश्रित-विशेषज्ञ (Mixture-of-Experts या MoE) मॉडल है। इसमें causal encoder-decoder आर्किटेक्चर का इस्तेमाल हुआ है; इनपुट प्रोसेसिंग के दौरान 8 अरब और आउटपुट जनरेशन में 16 अरब पैरामीटर सक्रिय रहते हैं। रिपोर्टों के अनुसार मॉडल के वेट्स MIT लाइसेंस के तहत जारी किए गए हैं। 16
DeepSeek ने कहा है कि 14 सितंबर को 04:00 UTC, यानी बीजिंग समय दोपहर 12 बजे, से V4-Pro के अनुरोध स्वतः V4.1-Flash पर रूट किए जाएंगे। V4.1-Pro आने तक इन अनुरोधों की बिलिंग Flash दरों पर होगी। 3
इसका मतलब है कि V4-Pro एंडपॉइंट इस्तेमाल करने वाली टीमों को बिना एंडपॉइंट बदलने के भी मॉडल के व्यवहार में बदलाव दिख सकता है। अहम प्रोडक्शन वर्कलोड के लिए माइग्रेशन से पहले या तुरंत बाद इन पहलुओं की जांच करना व्यावहारिक रहेगा:
DeepSeek ने 10 सितंबर से Flash सीरीज़ की कीमतें बदली हैं। ऑफ-पीक समय में प्रकाशित दरें ये हैं:
पीक समय में ये दरें ऑफ-पीक कीमतों की दोगुनी होंगी। 15
कम टोकन-लागत लंबी बातचीत, एजेंट के कई चरणों वाले काम और मल्टीमॉडल अनुरोधों को सस्ता बना सकती है। दूसरी ओर, बेहद कम कीमतें AI प्रदाताओं पर प्रति टोकन राजस्व और मार्जिन का दबाव भी बढ़ाती हैं। उपलब्ध सामग्री MiniMax, Z.AI या Alibaba जैसी कंपनियों के शेयरों पर किसी निश्चित, तात्कालिक प्रभाव को स्थापित नहीं करती; इसलिए ऐसे बाजार-संबंधी दावों को सावधानी से देखना चाहिए।
DeepSeek का कहना है कि नई आर्किटेक्चर क्षमता, इनफरेंस गति और थ्रूपुट में सुधार करती है। लॉन्च पर आई रिपोर्टिंग में V4.1-Flash को कोडिंग और एजेंट कार्यों में V4-Pro से बेहतर तथा चलाने में सस्ता बताया गया। 1
लेकिन ये तुलना फिलहाल मुख्यतः कंपनी और लॉन्च-संबंधी दावों पर आधारित है। उपलब्ध स्रोत यह साबित नहीं करते कि V4.1-Flash हर तरह के काम, हर प्रॉम्प्ट, हार्डवेयर सेटअप या प्रतिस्पर्धी मॉडल के मुकाबले हमेशा तेज़ या बेहतर होगा। वास्तविक परिणाम प्रॉम्प्ट, टास्क, कॉन्करेंसी और टूल-यूज़ कॉन्फ़िगरेशन के अनुसार बदल सकते हैं।
रॉयटर्स ने बताया कि DeepSeek ने शंघाई के टेक-केंद्रित STAR Market में संभावित घरेलू आरंभिक सार्वजनिक निर्गम (IPO) की तैयारी के लिए CITIC Securities को जोड़ा है। सूत्रों के अनुसार कंपनी 2026 में लिस्टिंग प्रक्रिया शुरू करना चाहती है, हालांकि प्रस्ताव का आकार और समयसीमा स्पष्ट नहीं है।
ओपन वेट्स, मल्टीमॉडल सपोर्ट और कम API लागत वाला नया मॉडल संभावित IPO से पहले DeepSeek की उत्पाद-कहानी को मजबूत कर सकता है। हालांकि यह एक विश्लेषण है, लॉन्च का घोषित कारण नहीं। कम कीमतों के साथ बड़ा सवाल यह भी है कि बढ़ता उपयोग प्रति-इकाई कम राजस्व की भरपाई कर पाएगा या नहीं।
V4.1-Flash लॉन्च से कुछ दिन पहले अमेरिकी सरकारी एजेंसियों के संयुक्त परामर्श में आरोप लगाया गया था कि DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun और Z.AI ने नॉलेज डिस्टिलेशन के जरिए अमेरिकी अग्रणी मॉडलों की क्षमताओं को बड़े पैमाने पर निकाला। परामर्श के अनुसार, Claude, GPT, Gemini और Grok जैसे मॉडलों से लाखों अनुरोधों के जरिए अरबों टोकन निकाले गए, और यह संभवतः चीनी सरकार की जानकारी में हुआ। 17
ये अमेरिकी सरकार के आरोप हैं, अदालत द्वारा स्थापित निष्कर्ष नहीं। चीन ने इन्हें निराधार बताया और कहा कि अमेरिका AI उद्योग में एकाधिकार बनाए रखने की कोशिश कर रहा है। चीनी अधिकारियों ने तकनीकी आत्मनिर्भरता पर जोर दिया, साथ ही बातचीत की संभावना भी खुली रखी।
V4.1-Flash के जरिए DeepSeek का लक्ष्य अपनी नई मॉडल फैमिली के एक छोटे, नेटिव मल्टीमॉडल और कम-लागत मॉडल को ज्यादा API उपयोगकर्ताओं के लिए डिफॉल्ट बनाना है। ओपन वेट्स, दावा की गई दक्षता और कम टोकन कीमतें इसकी पेशकश के केंद्र में हैं। 10
15
16
तात्कालिक रूप से सबसे महत्वपूर्ण तारीख 14 सितंबर है, जब V4-Pro अनुरोध V4.1-Flash पर जाने लगेंगे। क्षमता और गति के व्यापक दावों की स्वतंत्र जांच अभी बाकी है, लेकिन कीमतों की रणनीति और अमेरिका-चीन के बढ़ते तकनीकी तनाव इस लॉन्च के असर को तय करेंगे। 3
17
Studio Global AI
इस पृष्ठ में एक स्रोत-समर्थित उत्तर शामिल है जिसे आप Studio Global के अंदर जारी रख सकते हैं।
DeepSeek ने V4.1 Flash को 10 सितंबर 2026 को लॉन्च किया। कंपनी इसे नई आर्किटेक्चर फैमिली का सबसे छोटा, नेटिव मल्टीमॉडल मॉडल बताती है। [1][10]
DeepSeek ने V4.1 Flash को 10 सितंबर 2026 को लॉन्च किया। कंपनी इसे नई आर्किटेक्चर फैमिली का सबसे छोटा, नेटिव मल्टीमॉडल मॉडल बताती है। [1][10] 14 सितंबर को 04:00 UTC (बीजिंग समय दोपहर 12 बजे) से V4 Pro API अनुरोध अपने आप V4.1 Flash पर रूट होंगे और उन पर Flash की दरें लागू होंगी। [3][39]
ऑफ पीक API दरें $0.003 प्रति 10 लाख कैश्ड इनपुट टोकन, $0.15 प्रति 10 लाख अनकैश्ड इनपुट टोकन और $0.60 प्रति 10 लाख आउटपुट टोकन हैं; पीक समय में दरें दोगुनी होंगी। [15]