অ্যালিবাবা Qwen 3.8 Flash মডেল প্রকাশ করেছে এবং ওপেন সোর্স করেছে, যা 125B MoE আর্কিটেকচার ব্যবহার করে, প্রতি টোকেনে মাত্র প্রায় 6B প্যারামিটার সক্রিয় হয়, মূলত 262144 টোকেন কনটেক্সট সমর্থন করে, এবং YaRN দ্বারা 1M টোকেন পর্যন্ত বাড়ানো যায়। এই মডেলের উদ্ভাবনী বৈশিষ্ট্য হল এটি কনজিউমার-লেভেল 4090 GPU-তে চালানো যায়, যা ডেটা সেন্টার-লেভেল দীর্ঘ টেক্সট মডেলকে কনজিউমার-লেভেল হার্ডওয়্যারে স্থানান্তরিত করে। এর দামও আরও প্রতিযোগিতামূলক: প্রতি মিলিয়ন টোকেন ইনপুট 0.8 ইয়ুয়ান, আউটপুট 2.7 ইয়ুয়ান, যা DeepSeek-V4-Flash-এর এক-তৃতীয়াংশ। পরীক্ষায় দেখা গেছে, মডেলটি 2 মিনিটে 4টি প্ল্যাটফর্মের জন্য কনটেন্ট লিখতে পারে, 4 মিনিটে মিটিং রিকর্ড, টেবিল সাজানো, এবং ইমেইল তৈরি করতে পারে। Qwen 3.8 Flash এখন Qwen Office-এ লঞ্চ করা হয়েছে, APIও একইসঙ্গে উন্মুক্ত। একইদিনে Zhipu GLM-5.3-Flash-ও ওপেন-সোর্স করেছে, যার পারফরম্যান্স Claude Opus 4.8-এর সমপর্যায়ের, কিন্তু দাম তার 1/40।লেখক, উৎস: কোয়ানটাম পজিশন
আলিবাবার কিয়েন নতুন মডেল, আবার নতুন মানদণ্ড নিয়ে এসেছে।
তারা প্রকাশ করেছে এবং ওপেন সোর্স করেছে Qwen 3.8 Flash-Next, যা শুধুমাত্র DeepSeek-V4-Flash-এর চেয়ে দামে সরাসরি পিছনে পড়ে না, বরং প্রকাশের সাথে সাথে Huggingface-এর শীর্ষস্থান অধিকার করেছে!

টুইটারের ব্যবহারকারীরাও উত্তেজিত হয়ে উঠেছেন, এমনকি কিছু ইঞ্জিনিয়ার পরীক্ষামূলক ভিডিও শেয়ার করে বলেছেন এটা অসাধারণ:
Qwen 3.8 Flash ভিআরএএমের বাধা নিঃশেষে কেটে দিয়েছে,কনজুমার লেভেলের 4090 গ্রাফিক্স কার্ডেও ডেটা সেন্টার-লেভেলের দীর্ঘ টেক্সট মডেল চালানো যায়!
অনেকে ইতিমধ্যে এটিকে তাদের কাজে ব্যবহার করে ফেলেছেন।
8 মিনিটের কম সময়ে, এটি পাইথন প্রোগ্রামিং, মাল্টি-টেবিল বিশ্লেষণ এবং গবেষণা প্রতিবেদন তৈরির সম্পূর্ণ ওয়ার্কফ্লো সম্পন্ন করেছে:

বাওতা ইফেক্টও সহজেই সম্ভব:

ওয়াও, এত দুর্দান্ত? আমাদেরও নিশ্চয়ই চেষ্টা করা উচিত।

প্রতি মিলিয়ন টোকেন ইনপুটের জন্য মাত্র 0.8 যুয়ান
Qwen3.8-Flash এ 125B MoE আর্কিটেকচার ব্যবহার করা হয়েছে, যেখানে প্রতি Token-এ মাত্র প্রায় 6B প্যারামিটার সক্রিয় হয়, যা মূলত 262144 Token পর্যন্ত কনটেক্সট সমর্থন করে এবং YaRN দ্বারা 1M Token পর্যন্ত বাড়ানো যায়।
এটি একইসাথে Qwen4 এর নতুন আর্কিটেকচারের পূর্বাভাস।
Qwen 3.7 Plus-এর তুলনায় Qwen 3.8 Flash শুধু সক্রিয় প্যারামিটারকে এক-তৃতীয়াংশে কমিয়েছে, বরং প্রশিক্ষণ খরচও এর এক-নবমাংশ মাত্র, এবং সাধারণ, গাণিতিক যুক্তি এবং প্রোগ্রামিংয়ের ক্ষমতা সবচেয়ে বেশি উন্নত হয়েছে।
আরও বেশি আকর্ষণীয় হলো মূল্য: Qwen 3.8 Flash-এর জন্য প্রতি মিলিয়ন টোকেন ইনপুট মাত্র 0.8 যুয়ান, আউটপুট 2.7 যুয়ান, ক্যাশ হিট 0.1 যুয়ান, যা DeepSeek-V4-Flash-এর মূল্যের 1/3 এর কম।
এটা পিনდুওয়ানের কাট এক ডাবলের তুলনায় অনেক বেশি (bushi)

ঠিক আছে, ঠিক আছে, যেহেতু মূল্য এই পর্যায়ে পৌঁছে গেছে, তাহলে আমরা আর সংকোচ করব না, সরাসরি শক্তি বাড়াই, দুটি বাস্তব পরীক্ষার মাধ্যমে Qwen 3.8 Flash-এর অফিস স্কেনারিওতে বাস্তবিক কাজের ক্ষমতা পরীক্ষা করি।
প্রায়োগিক পরীক্ষা ১: ক্যামেরা পণ্যের জন্য চারটি ভিন্ন স্টাইলের প্ল্যাটফর্মের জন্য কপি ডিজাইন করুন
আমরা একটি "সাইবার কপি চ্যালেঞ্জ" আয়োজন করেছি, যেখানে Qwen 3.8 Flash-কে 1 টাকার বাজেটে একটি প্রায় দশহাজার শব্দের ক্যামেরা পণ্যের তথ্যকে ছোট হলুদ, ওয়েইবো, ডাওয়িন এবং ওয়েচ্যাট মুমেন্ট কপিতে পুনর্লিখন করতে হবে, যাতে দেখা যায় এটি কতগুলি কাজ সম্পন্ন করতে পারে।
নির্দেশাবলী নিম্নরূপ:

প্রম্পট পাঠানোর পর, আমি কোম্পানির টিফিন রুমে পানি নিয়ে এলাম, যা মাত্র ২ মিনিটেরও কম সময় নিয়েছিল।
ফিরে দেখলাম, চারটি ভিন্ন প্ল্যাটফর্মের জন্য সব কনটেন্ট লেখা শেষ হয়ে গেছে, এবং ব্র্যান্ড, স্টাইল, ট্রেন্ডিং হ্যাশট্যাগগুলো ঠিকমতো টার্গেট করা হয়েছে (শুধু আমি এত লম্বা পোস্ট ফেসবুকে পোস্ট করি না hhh):




দুই মিনিটের বেশি না লাগিয়ে চারটি কনটেন্ট শেষ করে ফেলা হয়েছে, “সাইবার কর্মচারী” এর হাতের গতি ঠিক আছে।
কিন্তু কর্মক্ষেত্রে সত্যিকার অর্থে বিরক্তিকর বিষয়টি হলো কপি লেখার ব্যাপার নয়, বরং মিটিং শেষে কে এই বিশৃঙ্খলা সাজাবে।
তাই, আমরা এটিকে দ্বিতীয় কাজ দিয়েছি, যা এর বাস্তব কার্যক্ষমতা পরীক্ষা করবে।
দ্বিতীয় পরীক্ষা: একটি পণ্য সপ্তাহিক মিটিংকে বাস্তবায়নযোগ্য পরিকল্পনায় রূপান্তরিত করা
আমরা "স্মার্ট কাস্টমার সার্ভিস এজেন্ট V2.0 প্রয়োজনীয়তা এবং প্রযুক্তিগত পর্যালোচনা সভা" বিষয়ে একটি অখণ্ড মূল মিটিং ট্রান্সক্রিপ্ট তৈরি করেছি, যা সম্প্রতি সপ্তাহিক মিটিং শেষে পাওয়া যাওয়ার মতো, যেখানে অনেক শব্দভুল এবং অপ্রাসঙ্গিক কথোপকথন রয়েছে, এবং Qwen3.8-Flash-কে একবারেই সারসংক্ষেপ, টেবিল সাজানো এবং মিটিং-এর পরের ইমেইল তিনটি কাজই সম্পন্ন করতে দিয়েছি।
△ চিত্রটি এআই দ্বারা তৈরি, "token" কে "偷啃" শোনা খুবই জীবন্ত।
নির্দেশাবলী নিম্নরূপ:

ডিফল্ট মোডে, 4 মিনিটের কম সময়ে Qwen3.8-Flash সমস্ত কাজ সফলভাবে সম্পন্ন করেছে, এবং পাঁচটি মূল উপসংহার, টেবিলের কাজের বণ্টন, ইমেইলের ফরম্যাট সবই সঠিক এবং প্রাপকগুলি মিটিংয়ের সাথে পুরোপুরি মিলে যায়।



△ কিছু পরীক্ষার ফলাফলের চিত্র
এটি এমনকি এটি চাওয়ার প্রয়োজন ছাড়াই আমাদের জন্য সভায় এখনও সিদ্ধান্তে পৌঁছানো হয়নি এমন বিষয়গুলি স্পষ্টভাবে সাজিয়ে দেয়, যাতে আমরা পরবর্তী সভায় তা আলোচনা করতে পারি, be like:

এবং এই পর্যায়েও আমার কোটা এখনও শেষ হয়নি!
Ahahaha, এই অসীম অনুভূতি খুব ভালো লাগছে।
এখন, Qwen 3.8 Flash প্রথমবারের মতো "কুয়ান ওয়েন অফিস" প্ল্যাটফর্মে চালু হয়েছে, এবং API ইন্টারফেসও একইসাথে উন্মুক্ত করা হয়েছে, আপনি চাইলে এটি পরীক্ষা করতে পারেন!

একটি অতিরিক্ত বিষয়
দেশী বড় মডেলের মূল্য যুদ্ধ আরও তীব্র হয়েছে।
কিউওয়েন 3.8 ফ্ল্যাশ ওপেন-সোর্স হওয়ার প্রায় একই সময়ে, জিজ্ঞাপ জিএলএম-5 সিরিজের প্রথম ন্যাটিভ মাল্টিমোডাল মডেল জিএলএম-5.3-ফ্ল্যাশ ওপেন-সোর্স করেছে, যা আগে ইন্টারনেটে বিখ্যাত “নিউলাই” বড় মডেল Ox Alpha।
মূল্যায়নে, এই মডেলের পারফরম্যান্স Claude Opus 4.8-এর সমান, কিন্তু মূল্য GLM-5.3-এর 1/10 এ কমিয়ে দেওয়া হয়েছে।

এছাড়াও, GLM-5.3-Flash দুই সপ্তাহের জন্য অর্ধেক দামে উপহার হিসেবে প্রকাশ করা হয়েছে, যার অর্থ অ্যাকশন পিরিয়ডে GLM-5.3-Flash-এর দাম শুধুমাত্র GLM-5.3-এর 1/20 এবং Opus4.8-এর 1/40।

এছাড়াও, Qwen 3.8 Flash এবং GLM-5.3-Flash-এর একটি সাধারণ বিষয় হল যে এই দুটি মডেল এবার অত্যন্ত কম দামে DeepSeek-V4-Flash-কে অবাক করে দিয়েছে (DeepSeek অভিযোগ করে চলে গেল):
△DeepSeek-V4-Flash, Qwen 3.8 Flash, GLM-5.3-Flash এর মূল্য তুলনা চার্ট
অবশ্যই, খুব প্রতিযোগিতামূলক।
