DeepSeek এ 552B প্যারামিটার এবং 1M-টোকেন কনটেক্সট উইন্ডো সহ V4.1-Flash মডেল চালু করেছে

iconCryptoBriefing
শেয়ার
AI summary iconসারাংশ
সেপ্টেম্বর ১০-এ ডিপসিক ভি৪.১-ফ্ল্যাশ মডেল সহ একটি নতুন টোকেন লিস্টিং প্রকাশ করেছে, যার ৫৫২B প্যারামিটার এবং ১M-টোকেন কনটেক্সট উইন্ডো রয়েছে। এই মডেলটি MoE আর্কিটেকচার ব্যবহার করে, যা ইনপুটের জন্য ৮B এবং আউটপুটের জন্য ১৬B সক্রিয় করে। এটি একটি অসমমিত Causal Encoder-Decoder ডিজাইন যোগ করেছে এবং KV ক্যাশে ব্যবহার ৭৫% কমিয়েছে। মডেলটি ডিপসিক ভি৪-প্রোকে পরাজিত করেছে এবং এখন সেপ্টেম্বর ১৪-এর আপডেটেড মূল্যনির্ধারণের মাধ্যমে API-এর মাধ্যমে অ্যাক্সেসযোগ্য। Hugging Face-এ MIT লাইসেন্সের অধীনে ওজনগুলি ওপেন-সোর্সড, যা ডেভেলপারদের এবং ট্রেডারদের জন্য নতুন টোকেন লঞ্চের খবর প্রদান করে।

ডিপসিক একটি মডেল প্রকাশ করেছে যা এক মিলিয়ন টোকেনের কনটেক্সট প্রসেস করে এবং দুই বছর আগে প্রকাশিত কিছু ওপেন-সোর্স মডেলের চেয়ে কম প্যারামিটার সক্রিয় করে। ১০ সেপ্টেম্বর চালু করা V4.1-Flash চীনা এআই স্টার্টআপটির বৃহৎ ভাষা মডেলের অর্থনীতিকে পুনর্লিখনের জন্য সাম্প্রতিক প্রচেষ্টা।

মডেলটি 552 বিলিয়ন প্যারামিটারকে একটি মিক্সচার-অফ-এক্সপার্ট (MoE) আর্কিটেকচারে প্যাক করে, কিন্তু ইনপুট টাস্কের জন্য মাত্র প্রায় 8 বিলিয়ন এবং আউটপুটের জন্য 16 বিলিয়ন প্যারামিটারই সক্রিয় করে। ফলাফল হলো একটি মডেল যা এর সক্রিয় কম্পিউট ফুটপ্রিন্টের চেয়ে অনেক বেশি করে।

এটি কাজ করার জন্য আর্কিটেকচার

V4.1-Flash এর মাধ্যমে ডিপসিক একটি অসমমিত কার্সাল এনকোডার-ডিকোডার আর্কিটেকচার চালু করেছে, যা ইনপুট প্রক্রিয়াকরণ এবং আউটপুট জেনারেশনের জন্য প্রতিটি কাজের জন্য আলাদা আলাদা পথ ব্যবহার করে, একটি একক পাইপলাইনের মধ্যে দিয়ে সবকিছু চালানোর পরিবর্তে।

বিজ্ঞাপন

কনটেক্সট উইন্ডো 1 মিলিয়ন টোকেন পর্যন্ত বাড়িয়ে দেওয়া হয়েছে। এই বিশাল কনটেক্সটকে সমর্থন করতে একটি KV ক্যাশে প্রায় 890 বাইট প্রতি টোকেন ব্যবহার করে, যা আগের V4-Flash মডেলের প্রয়োজনীয়তার প্রায় এক-চতুর্থাংশ।

এই ক্যাশ হ্রাস যা শোনাচ্ছে তার চেয়ে বেশি গুরুত্বপূর্ণ। KV ক্যাশ হল মেমোরির বন্ধনী যা নির্ধারণ করে একটি মডেল কতজন সমান্তরাল ব্যবহারকারীকে সেবা দিতে পারবে এবং তাদের কথোপকথন কতক্ষণ চলবে। এটিকে 75% কমিয়ে অপারেটররা একই হার্ডওয়্যারে প্রায় চারগুণ বেশি ব্যবহারকারীকে সেবা দিতে পারবে, অথবা তাদের GPU ক্লাস্টার আপগ্রেড না করেই চারগুণ দীর্ঘ কনটেক্সট পরিচালনা করতে পারবে।

বেঞ্চমার্কে, ডিপসিক দাবি করে যে V4.1-Flash কোম্পানির নিজস্ব V4-Pro মডেলকে ছাড়িয়ে যায় এবং GPT-5.6 এবং Kimi K3-এর সাথে সরাসরি প্রতিদ্বন্দ্বিতা করে। কোম্পানিটি ইতিমধ্যেই V4-Pro থেকে অনুরোধগুলি নতুন মডেলের দিকে পাঠিয়েছে, এবং আপডেটকৃত মূল্যনির্ধারণ 14 সেপ্টেম্বর থেকে কার্যকর হবে।

খোলা ওজন, খোলা কৌশল

DeepSeek এই মডেলের ওজনগুলি Hugging Face-এ MIT লাইসেন্সের অধীনে প্রকাশ করেছে। নতুন মডেলটি DeepSeek-এর API-এর মাধ্যমে “deepseek-flash” এন্ডপয়েন্টের মাধ্যমে অ্যাক্সেসযোগ্য। ওপেন ওজন এবং API অ্যাক্সেসের সংমিশ্রণটি দুটি পথে গ্রহণের সুযোগ তৈরি করে: যারা নিজস্ব ইনফ্রাস্ট্রাকচারে ইনফারেন্স চালাতে চান, তারা স্থানীয়ভাবে ডাউনলোড এবং ডিপ্লয় করতে পারেন, যারা ম্যানেজড সার্ভিসগুলির পছন্দ করেন, তারা DeepSeek-এর নতুন মূল্যনির্ধারণ স্তরগুলিতে API-এ কল করতে পারেন।

আইপিও প্রভাব এবং প্রতিযোগিতামূলক অবস্থান

V4.1-Flash লঞ্চের সময়সূচী দুর্ঘটনাজনিত নয়। ডিপসিককে শাংহাইয়ের স্টার মার্কেটে তালিকাভুক্ত করার প্রত্যাশা রয়েছে, এবং নিরন্তর প্রযুক্তিগত গতিশীলতা প্রদর্শন হল সেই ধরনের বিষয় যা রোডশো প্রেজেন্টেশনকে আরও বিশ্বাসযোগ্য করে তোলে।

V4.1-Flash-এ একীভূত মাল্টিমোডাল বুঝতে পারা, যা ভিজুয়াল এবং টেক্সট ডেটা উভয়কে কভার করে, ওপেনএআই এবং মুনশট এআই-এর মতো প্রতিদ্বন্দ্বীদের জন্য পার্থক্যের সুযোগকে সংকুচিত করে, যারা Kimi K3 বিকাশ করে।

দাবিত্যাগ: এই পৃষ্ঠার তথ্য তৃতীয় পক্ষের কাছ থেকে প্রাপ্ত হতে পারে এবং অগত্যা KuCoin এর মতামত বা মতামত প্রতিফলিত করে না। এই বিষয়বস্তু শুধুমাত্র সাধারণ তথ্যগত উদ্দেশ্যে প্রদান করা হয়, কোন ধরনের প্রতিনিধিত্ব বা ওয়ারেন্টি ছাড়াই, বা এটিকে আর্থিক বা বিনিয়োগ পরামর্শ হিসাবে বোঝানো হবে না। KuCoin কোনো ত্রুটি বা বাদ পড়ার জন্য বা এই তথ্য ব্যবহারের ফলে যে কোনো ফলাফলের জন্য দায়ী থাকবে না। ডিজিটাল সম্পদে বিনিয়োগ ঝুঁকিপূর্ণ হতে পারে। আপনার নিজের আর্থিক পরিস্থিতির উপর ভিত্তি করে একটি পণ্যের ঝুঁকি এবং আপনার ঝুঁকি সহনশীলতা সাবধানে মূল্যায়ন করুন। আরও তথ্যের জন্য, অনুগ্রহ করে আমাদের ব্যবহারের শর্তাবলী এবং ঝুঁকি প্রকাশ পড়ুন।