Qwen 3.8 Flash की लागत DeepSeek-V4-Flash की तुलना में एक-तिहाई तक कम हो गई है

iconMetaEra
साझा करें
AI summary iconसारांश
अलीबाबा का Qwen 3.8 Flash, अब Qwen Office प्लेटफॉर्म पर उपलब्ध है, जो प्रति टोकन 6B सक्रिय पैरामीटर के साथ 125B MoE प्रदान करता है। यह 262,144 टोकन का समर्थन स्वीकृत रूप से करता है और 4090 GPU पर चलता है। इसकी कीमत 0.8 RMB प्रति मिलियन इनपुट टोकन है, जो DeepSeek-V4-Flash की लागत का एक-तिहाई है। अल्टकॉइन ट्रैक करने वाले ट्रेडर्स इसे एक महत्वपूर्ण विकास मान सकते हैं। मॉडल चार मिनट से कम समय में जटिल कार्यों को संभालता है और API-तैयार है। उसी दिन, Zhipu ने GLM-5.3-Flash को ओपन-सोर्स किया, जिसकी कीमत Claude Opus 4.8 की एक-चौथाई है। ऐसे लागत-कुशल मॉडल्स के प्रवेश से मार्केट संवेदनशीलता, जिसमें डर और लालच सूचकांक शामिल हैं, बदल सकती है।
अलीबाबा ने Qwen 3.8 Flash मॉडल को जारी किया और ओपन सोर्स किया, जिसमें 125B MoE आर्किटेक्चर का उपयोग किया गया है, जिसमें प्रति टोकन केवल लगभग 6B पैरामीटर सक्रिय होते हैं, जो मूल रूप से 262144 टोकन कंटेक्स्ट का समर्थन करता है और YaRN के माध्यम से 1M टोकन तक विस्तारित किया जा सकता है। इस मॉडल की नवीनता इसमें है कि यह उपभोक्ता स्तरीय 4090 GPU पर चल सकता है, जिससे डेटासेंटर-स्तरीय लंबे टेक्स्ट मॉडल का उपभोक्ता हार्डवेयर पर स्थानांतरण संभव हुआ है। इसकी कीमत और भी प्रतिस्पर्धी है: प्रति मिलियन टोकन इनपुट 0.8 युआन, आउटपुट 2.7 युआन, जो DeepSeek-V4-Flash की कीमत का एक-तिहाई है। प्रयोगात्मक परीक्षणों में देखा गया कि मॉडल 2 मिनट में चार प्लेटफॉर्म के लिए कंटेंट लिख सकता है, 4 मिनट में मीटिंग सारांश, टेबल संगठन और ईमेल उत्पादन पूरा कर सकता है। Qwen 3.8 Flash कुआनवेन ऑफिस प्लेटफॉर्म पर उपलब्ध है, और API इंटरफ़ेस भी समानांतर रूप से उपलब्ध है। उसी दिन, Zhipu ने GLM-5.3-Flash को ओपन सोर्स किया, जिसका प्रदर्शन Claude Opus 4.8 के समान है, लेकिन इसकी कीमत केवल उसकी चालीसवाँ हिस्सा है।

लेखक, स्रोत: क्वांटम बिट

Alibaba's Qwen new model has raised the bar again.

उन्होंने Qwen 3.8 Flash-Next को प्रकाशित और ओपन सोर्स किया, जो न केवल DeepSeek-V4-Flash की कीमत को सीधे धूल चटा देता है, बल्कि लॉन्च होते ही Huggingface पर शीर्ष स्थान प्राप्त कर लेता है!

चित्र

ट्विटर पर उपयोगकर्ता भी उत्साहित हो गए, और कुछ इंजीनियर्स ने प्रयोगात्मक वीडियो शेयर करके कहा कि बहुत बढ़िया:

Qwen 3.8 Flash ने VRAM की सीमा को खत्म कर दिया,डेटा सेंटर-लेवल का लंबा टेक्स्ट बड़ा मॉडल, अब कंस्यूमर-लेवल 4090 GPU पर भी चल रहा है!

चित्र

कुछ लोग पहले ही इसे अपने काम में इस्तेमाल कर चुके हैं।

8 मिनट से कम समय में, यह पायथन प्रोग्रामिंग, बहु-टेबल विश्लेषण और रिसर्च रिपोर्ट जनरेशन की पूरी वर्कफ्लो पूरी कर लेता है:

चित्र

बैओता इफेक्ट्स भी कोई समस्या नहीं हैं:

चित्र

वाह, क्या यह इतना शानदार है? हमें भी इसे आजमाना चाहिए।

चित्र

प्रति मिलियन टोकन इनपुट केवल 0.8 युआन

Qwen3.8-Flash 125B MoE आर्किटेक्चर का उपयोग करता है, जिसमें प्रति टोकन केवल लगभग 6B पैरामीटर सक्रिय होते हैं, और यह मूल रूप से 262144 टोकन के संदर्भ का समर्थन करता है और YaRN के माध्यम से 1M टोकन तक विस्तारित किया जा सकता है।

इसके साथ ही, यह Qwen4 के नए आर्किटेक्चर का पूर्वाभ्यास भी है।

Qwen 3.7 Plus की तुलना में, Qwen 3.8 Flash ने एक्टिवेटेड पैरामीटर्स को एक-तिहाई कर दिया है, और ट्रेनिंग लागत केवल उसकी 1/9 है, और जनरल, मैथमेटिकल रीजनिंग, प्रोग्रामिंग आदि क्षमताएँ अधिक शक्तिशाली हैं।

और कीमत और भी कम है, Qwen 3.8 Flash के लिए प्रति मिलियन टोकन इनपुट केवल 0.8 युआन, आउटपुट 2.7 युआन, कैश हिट 0.1 युआन, जो DeepSeek-V4-Flash की कीमत का एक-तिहाई है।

यह तो पिनडुओडुओ की एक बार काटने से भी कहीं ज्यादा तेज़ है (bushi

चित्र

ठीक है, ठीक है, चूंकि कीमत इतनी ऊंची हो चुकी है, तो हम अब और नहीं रुकेंगे, सीधे तौर पर दो वास्तविक परीक्षणों के साथ Qwen 3.8 Flash की कार्यालय परिदृश्य में वास्तविक क्षमता का परीक्षण करते हैं।

Real Test 1: Design four copy variants for a camera product, tailored to different platform styles

हमने एक "साइबर कॉपी चैलेंज" आयोजित किया, जिसमें Qwen 3.8 Flash को 1 युआन के बजट के भीतर एक लगभग दस हजार शब्दों की कैमरा उत्पाद जानकारी को Xiao Hong Shu, Weibo, Douyin और WeChat Moments के लिए पुनः लिखना था, ताकि हम देख सकें कि यह कितने कार्य पूरा कर सकता है।

निर्देश निम्नलिखित हैं:

चित्र

प्रॉम्प्ट भेजने के बाद, मैंने कंपनी के किचन में पानी भरा, जिसमें 2 मिनट से कम का समय लगा।

वापस आकर देखा तो, चारों अलग-अलग प्लेटफॉर्म के कॉपी पूरी तरह से तैयार हो चुकी हैं, और ब्रांड, स्टाइल और टैग बिल्कुल सही तरीके से टैग किए गए हैं (सिवाय इसके कि मैं इतनी लंबी पोस्ट अपने फ्रेंड्स सर्कल में नहीं डालता hhh):

चित्र

चित्र

चित्र

चित्र

चार लेखों को 2 मिनट से कम समय में पूरा कर लिया, "साइबर कर्मचारी" की गति ठीक है।

लेकिन कार्यस्थल पर वास्तव में परेशान करने वाली बात अक्सर कॉपी लिखना नहीं, बल्कि मीटिंग के बाद कौन सारी उलझनें सुलझाता है।

इसलिए, हमने इसे एक दूसरा कार्य दिया, जिससे इसकी वास्तविक कार्यालय क्षमता का परीक्षण किया गया।

Real Test 2: Turn a product weekly meeting into an actionable plan

हमने "स्मार्ट कस्टमर सर्विस एजेंट V2.0 की आवश्यकताएँ और तकनीकी समीक्षा बैठक" के विषय पर, एक विस्तृत मूल मीटिंग ट्रांसक्रिप्ट तैयार किया जो लोगों को सप्ताहिक बैठक के तुरंत बाद मिलने वाली, जिसमें समान उच्चारण वाले गलत शब्द और छोटी-छोटी बातचीत का मिश्रण है, और Qwen3.8-Flash ने एक ही बार में सारांश निकालना, तालिका तैयार करना और बैठक के बाद की ईमेल सूचना भेजना तीनों कार्य पूरा कर लिए।

चित्र△ चित्र AI द्वारा उत्पन्न, "token" को "स्टेक" सुनना बहुत जीवनपरक है

निर्देश निम्नलिखित हैं:

चित्र

डिफ़ॉल्ट मोड में, 4 मिनट से कम समय में, Qwen3.8-Flash ने सभी कार्यों को सफलतापूर्वक पूरा कर लिया, और पाँच मुख्य निष्कर्षों का सारांश, तालिका में विभाजित कार्य, ईमेल प्रारूप और प्राप्तकर्ता सभी मीटिंग की सामग्री के अनुसार सही थे।

चित्र

चित्र

चित्र

चित्र△ कुछ परीक्षण परिणाम चित्र

यह इसकी मांग किए बिना ही हमें स्वयं से उन मुद्दों को स्पष्ट कर देता है जो सम्मेलन में अभी तक चर्चा नहीं हुई हैं, ताकि हम अगली बैठक में उन पर आगे चर्चा कर सकें, be like:

चित्र

और इस बिंदु तक, मेरी सीमा अभी तक पूरी नहीं हुई है!

Ahaha, यह असीमित महसूस करना बहुत अच्छा लगता है।

अब, Qwen 3.8 Flash "Qianwen Office" प्लेटफॉर्म पर प्रारंभिक रूप से लॉन्च किया गया है, और API इंटरफेस भी समानांतर रूप से उपलब्ध है, कृपया इसे आजमाएं!

चित्र

एक और बात

देशी बड़े मॉडल की कीमत प्रतिस्पर्धा अधिक तीव्र हो गई है।

Qwen 3.8 Flash के लगभग एक ही समय पर, Zhipu ने GLM-5 श्रृंखला का पहला मूल बहुमोडल मॉडल GLM-5.3-Flash, जिसे पहले ऑनलाइन "नियो" बड़ा मॉडल Ox Alpha के रूप में लोकप्रियता प्राप्त हुई थी, खोल दिया।

समीक्षा में, इस मॉडल का प्रदर्शन Claude Opus 4.8 के बराबर है, लेकिन कीमत GLM-5.3 की 1/10 है।

चित्र

इसके अलावा, GLM-5.3-Flash दो सप्ताह के लिए आधी कीमत पर उपलब्ध है, जिसका अर्थ है कि इस अवधि के दौरान GLM-5.3-Flash की कीमत GLM-5.3 की 1/20 और Opus4.8 की 1/40 होगी।

चित्र

इसके अलावा, Qwen 3.8 Flash और GLM-5.3-Flash का एक और सामान्य बिंदु यह है कि उन्होंने इस बार DeepSeek-V4-Flash को अत्यंत कम कीमत पर अचानक घेर लिया (DeepSeek शिकायत करते हुए चला गया):

चित्र△DeepSeek-V4-Flash, Qwen 3.8 Flash, GLM-5.3-Flash की कीमतों की तुलना चार्ट

बिल्कुल नहीं, बहुत ज्यादा प्रतिस्पर्धा है।

डिस्क्लेमर: इस पेज पर दी गई जानकारी थर्ड पार्टीज़ से प्राप्त की गई हो सकती है और यह जरूरी नहीं कि KuCoin के विचारों या राय को दर्शाती हो। यह सामग्री केवल सामान्य सूचनात्मक उद्देश्यों के लिए प्रदान की गई है, किसी भी प्रकार के प्रस्तुतीकरण या वारंटी के बिना, न ही इसे वित्तीय या निवेश सलाह के रूप में माना जाएगा। KuCoin किसी भी त्रुटि या चूक के लिए या इस जानकारी के इस्तेमाल से होने वाले किसी भी नतीजे के लिए उत्तरदायी नहीं होगा। डिजिटल संपत्तियों में निवेश जोखिम भरा हो सकता है। कृपया अपनी वित्तीय परिस्थितियों के आधार पर किसी प्रोडक्ट के जोखिमों और अपनी जोखिम सहनशीलता का सावधानीपूर्वक मूल्यांकन करें। अधिक जानकारी के लिए, कृपया हमारे उपयोग के नियम और जोखिम प्रकटीकरण देखें।