মার্ক জাকারবার্গ বুধবার মেটা-এর প্রথম কৃত্রিম বুদ্ধিমত্তা (এআই) কোডিং এজেন্ট মিউজ কোড বিটা সংস্করণে চালু করেন। মেটা যে চারটি তুলনা প্রকাশ করেছিল, অ্যানথ্রোপিকের ক্লড ওপাস 5 সেই চারটিতেই এটিকে পরাজিত করেছে।
মেটা সেই চার্টগুলি তবুও প্রকাশ করেছে। কোম্পানিটি একটি ভালো টুলের পরিবর্তে একটি সস্তা টুল বিক্রি করছে। স্বাধীন পরীক্ষার ডেটা বোঝায় যে ফারাকটি মেটা যা দেখিয়েছে তার চেয়ে বেশি।
X-এ আমাদের অনুসরণ করুন যাতে ঘটনার সাথে সাথে সর্বশেষ খবর পান
মেটার নিজস্ব চার্টগুলি এনথ্রোপিককে প্রতিটি রাউন্ডে হাতে দেয়
মিউজ স্পার্ক 1.2 হল মিউজ কোডের ভিতরের মডেল। এটি টার্মিনাল-বেঞ্চ 2.1-এ 82.9% স্কোর করেছে।
একই পরীক্ষায় Claude Opus 5 86.7% স্কোর করেছে। Terminal-Bench হল লোড ইনস্টিটিউট এবং স্ট্যানফোর্ডের গবেষকদের তৈরি। এটি সিস্টেম মেরামত, ডেটা কাজ এবং সুরক্ষা সহ 89টি বাস্তব চাকরি নির্ধারণ করে।
দ্বিতীয় স্থান সম্মানজনক। মিউজ কোড ৮১.৮% এবং গ্রক বিল্ড ৮১.৬% এ ওপেনএআইয়ের কোডেককে পরাজিত করেছে।

পরবর্তী চার্টটি আরও কঠিন ছিল। DeepSWE 1.1 গ্রেডিংয়ের সময় ইন্টারনেট অ্যাক্সেস বন্ধ করে 113টি কোডিং টাস্ক নির্ধারণ করে। Muse Spark 1.2 59.3% নিয়ে তৃতীয় স্থানে নেমে আসে।
মেটা তার নিজের ইঞ্জিনিয়ারদের দ্বারা তৈরি ৪৪০টি বাস্তব পুল রিকোয়েস্ট থেকে একটি পরীক্ষা প্রকাশ করেছে। মিউজ স্পার্ক ১.২ সেখানে ৭০.৬% স্কোর করেছে, যা অপাস ৫-এর চেয়ে প্রায় নয় পয়েন্ট পিছনে।

এই স্কোরটি শুধুমাত্র Muse Spark 1.1-এর চেয়ে 2.3 পয়েন্ট বেশি, যেটি মেটা জুলাইয়ে চালু করেছিল।
মডেল মেটা তার কোডিং চার্ট থেকে বাদ দিয়েছে
মেটা নিজেকে GPT-5.6 Terra-এর সাথে পরিমাপ করেছে। ওপেনএআই সোল নামে একটি শক্তিশালী মডেল বিক্রি করে, এবং মেটা এটিকে তিনটি কোডিং চার্ট থেকেই বাদ দিয়েছে।
সল স্বাধীন টার্মিনাল-বেঞ্চ 2.1 লিডারবোর্ড-এ ৮৯.৫% স্কোর নিয়ে শীর্ষে রয়েছে। অপাস ৫ এর স্কোর ৮৯.১%।
উভয় সংখ্যাই মেটা যা ওপাস 5-এর জন্য প্রতিবেদন করেছে, 86.7% কে পরাজিত করেছে। মেটা তার শক্তিশালী প্রতিদ্বন্দ্বীর একটি দুর্বল সেটিং বেছে নিয়েছিল এবং তবুও এর পিছনে থেকে গিয়েছিল।
সলের বিরুদ্ধে, প্রকৃত নেতা, মিউজ স্পার্ক 1.2 কেবলমাত্র 3.8 এর পরিবর্তে 6.6 পয়েন্ট পিছিয়ে।
মেটা একটি জায়গায় সল-কে অন্তর্ভুক্ত করেছে। ১,০০০-এর বেশি টুল কল চালানো একটি জিপিইউ কার্নেল টাস্কে, সল বেসলাইনের চেয়ে ৭১.২% উন্নতি করেছে। মিউজ স্পার্ক ১.২ ৬৮.৭% করেছে এবং ছয়টির মধ্যে চতুর্থ স্থান অধিকার করেছে।
অন্য একটি সতর্কবাণী বিপরীত দিকে কাজ করে। এখনও সেই পাবলিক লিডারবোর্ডে Muse Spark 1.2 দেখা যায়নি, যেখানে 183টি মডেলের মধ্যে মাত্র 26টির পরীক্ষা করা হয়েছে। তার 82.9% এখনও মেটা-এর পরিসংখ্যান।
“মিউজ স্পার্ক ১.২ হল আমাদের সীমান্তের দিকে এগিয়ে যাওয়ার পরবর্তী পদক্ষেপ, যার পরে আরও বড় এবং সক্ষম মডেলগুলি আসছে,” জুকারবার্গ বলেছেন একটি পোস্টে।
জুকারবার্গ শীঘ্রই নিজের প্রতিদ্বন্দ্বীকে মডেল হিসেবে আয়োজন করতে পারেন
রিপোর্ট অনুযায়ী, মেটা এনথ্রোপিককে কম্পিউট ভাড়া দেওয়ার জন্য আলোচনায় রত। এই চুক্তি দুই বছরে $10 বিলিয়ন পর্যন্ত পৌঁছাতে পারে। তখন মেটার ডেটা সেন্টারগুলি Claude মডেলগুলি চালানোর জন্য সহায়তা করবে, যেগুলি Muse Code কে প্রতিস্থাপনের জন্য তৈরি করা হয়েছিল।
মিউজ কোডের পিছনের নেতৃত্ব খরচে ছিল। জুকারবার্গ জুন ২০২৫-এ স্কেল এআই এবং এর প্রতিষ্ঠাতা আলেক্সান্দ্র ওয়াংকে $14.3 বিলিয়নে কিনেছিলেন, যিনি এখন মেটা সুপারইন্টেলিজেন্স ল্যাবস পরিচালনা করছেন।
দাম হল যে লিভার ওয়াং-এর কাছে বাকি আছে। হারগুলি মেটার প্রথম পেইড API-এর জুলাই চালুর সাথে মিলে যায়, যা $1.25 প্রতি মিলিয়ন ইনপুট টোকেন এবং $4.25 প্রতি মিলিয়ন আউটপুট টোকেন।
একটি অবদানকারী স্তরের খরচ ১০ গুণ কম। ডেভেলপাররা তাদের কাজের উপর Meta-কে ট্রেন করতে দিয়ে যোগ্যতা অর্জন করে। ওয়াং মিউজ স্পার্ক লাইনের গ্রহণের সংখ্যা দেওয়ার প্রত্যাখ্যান করেন।
মেটার অ্যাকাউন্টগুলি ছাড়ের ব্যাখ্যা করে। গত ত্রৈমাসিকে আয় 28% বেড়ে 60.8 বিলিয়ন ডলার হয়েছে, তবে পরিচালনা লাভ 8% কমে 18.8 বিলিয়ন ডলার হয়েছে।
অপারেটিং মার্জিন গত বছরের একই সময়ের তুলনায় 43% থেকে হ্রাস পেয়ে 31% হয়েছে। মেটা এই ত্রৈমাসিকে মাত্র ক্যাপিটাল প্রকল্পে 31.08 বিলিয়ন ডলার খরচ করেছে, এবং বছরের জন্য সর্বোচ্চ 145 বিলিয়ন ডলারের দিকে নির্দেশ দিয়েছে।
মিউজ কোড এমন ইঞ্জিনিয়ারিং সরবরাহ করে যা ক্লাউড কোডের অভাব। ব্যাকগ্রাউন্ড এজেন্টগুলি একটি সেশনের মধ্যে প্রসঙ্গ ধারণ করে। সাব-এজেন্টগুলি একটি রিপোজিটরির পৃথক কপিতে কাজ করে।
মেটা একটি শক্তিশালী দ্বিতীয়-সেরা কোডার তৈরি করেছে এবং এটিকে একটি বাজেট বিকল্পের মতো মূল্য দিয়েছে। বিটা দেখাবে যে ডেভেলপাররা প্রায় দশগুণ ছোট বিলের জন্য কয়েকটি পয়েন্ট সঠিকতা বিনিময় করে।
