डीपसीक ने एक मॉडल जारी किया है जो एक मिलियन टोकन्स के संदर्भ को प्रोसेस करता है और कुछ दो साल पहले जारी किए गए ओपन-सोर्स मॉडल्स की तुलना में कम पैरामीटर्स को सक्रिय करता है। 10 सितंबर को लॉन्च किया गया V4.1-Flash, चीनी AI स्टार्टअप का भाषा मॉडल्स की अर्थव्यवस्था को पुनर्परिभाषित करने का नवीनतम प्रयास है।
मॉडल 552 अरब पैरामीटर्स को मिक्सचर-ऑफ-एक्सपर्ट्स (MoE) आर्किटेक्चर में समाहित करता है, लेकिन इनपुट कार्यों के लिए केवल लगभग 8 अरब और आउटपुट के लिए 16 अरब पैरामीटर्स को ही सक्रिय करता है। परिणामस्वरूप एक ऐसा मॉडल बनता है जो अपने सक्रिय कंप्यूट के फुटप्रिंट से कहीं अधिक क्षमता दर्शाता है।
वह आर्किटेक्चर जो इसे काम करता है
V4.1-Flash एक असममित कारणात्मक इनपुट-डिकोडर आर्किटेक्चर पेश करता है, जिसमें इनपुट को प्रोसेस किया जाता है और आउटपुट को प्रत्येक कार्य के लिए अलग-अलग अनुकूलित मार्गों के माध्यम से जनरेट किया जाता है, बजाय इसके कि सब कुछ एकल पाइपलाइन से होकर चलाया जाए।
संदर्भ खिड़की 1 मिलियन टोकन तक फैल जाती है। इस विशाल संदर्भ का समर्थन करने के लिए एक KV कैश है जो प्रति टोकन लगभग 890 बाइट्स उपयोग करता है, जो पिछले V4-Flash मॉडल की आवश्यकता का लगभग एक-चौथाई है।
यह कैश कमी उतनी महत्वपूर्ण है जितनी यह सुनने में लगती है। KV कैश वह मेमोरी बॉटलनेक है जो यह निर्धारित करता है कि एक मॉडल कितने समानांतर उपयोगकर्ताओं की सेवा कर सकता है और उनकी बातचीत कितनी लंबी चल सकती है। इसे 75% कम करने से संचालक एक ही हार्डवेयर पर लगभग चार गुना अधिक उपयोगकर्ताओं की सेवा कर सकते हैं, या अपने GPU क्लस्टर को अपग्रेड किए बिना चार गुना लंबे संदर्भों को संभाल सकते हैं।
बेंचमार्क पर, डीपसीक दावा करता है कि V4.1-Flash कंपनी के अपने V4-Pro मॉडल को पार करता है और GPT-5.6 और Kimi K3 के साथ सीधी प्रतिस्पर्धा करता है। कंपनी पहले से ही V4-Pro से अनुरोधों को नए मॉडल पर रीडायरेक्ट कर रही है, और अपडेटेड मूल्य 14 सितंबर से लागू होंगे।
खुले वजन, खुली रणनीति
DeepSeek ने Hugging Face पर मॉडल के वेट्स को MIT लाइसेंस के तहत जारी किया है। नया मॉडल “deepseek-flash” एंडपॉइंट के माध्यम से DeepSeek की API के जरिए उपलब्ध है। ओपन वेट्स और API एक्सेस का संयोजन दो-ट्रैक अपनाने का रास्ता बनाता है: विकासक जो अपनी इंफ्रास्ट्रक्चर पर निष्पादन करना चाहते हैं, वे स्थानीय रूप से डाउनलोड और डिप्लॉय कर सकते हैं, जबकि जो प्रबंधित सेवाओं को पसंद करते हैं, वे DeepSeek के नए मूल्य श्रेणियों पर API को कॉल कर सकते हैं।
आईपीओ के प्रभाव और प्रतिस्पर्धी स्थिति
V4.1-Flash लॉन्च का समय यादृच्छिक नहीं है। अपेक्षा है कि डीपसीक शंघाई के स्टार मार्केट पर सार्वजनिक होगा, और लगातार तकनीकी गति को दर्शाना रोडशो प्रस्तुतियों को अधिक विश्वसनीय बनाने का प्रकार है।
V4.1-Flash में एकीकृत बहुआयामी समझ, जो दृश्य और पाठ डेटा दोनों को कवर करती है, OpenAI और Moonshot AI जैसे प्रतिद्वंद्वियों के लिए अंतर के अवसरों को संकुचित कर देती है, जो Kimi K3 विकसित करते हैं।
