NVIDIA ভেরা রুবিন NVL72 প্রকাশ করেছে, ডিপসিকের থ্রুপুট 30 গুণ বাড়িয়েছে

icon MarsBit
শেয়ার
AI summary iconসারাংশ
NVIDIA অন-চেইন সংবাদ প্রকাশ করেছে যাতে Vera Rubin NVL72 টেস্ট ফলাফল দেখানো হয়েছে, যেখানে DeepSeek-V4-Pro থ্রুপুট 30x বৃদ্ধি পেয়েছে। GB300 NVL72 এর তুলনায় টোকেন খরচ 35x কমেছে। প্ল্যাটফর্মটিতে Vera CPU এবং Groq 3 LPX অন্তর্ভুক্ত রয়েছে, যা এখন SpaceXAI দ্বারা ব্যবহৃত হচ্ছে। পারফরম্যান্সের বৃদ্ধির কারণে আগামীতে নতুন টোকেন লিস্টিংয়ের সম্ভাবনা রয়েছে।

অসাধারণ।

এখনই, নিভিডিয়া প্রথমবারের মতো তাদের পরবর্তী প্রজন্মের ফ্ল্যাগশিপ ক্যাবিনেট, ভেরা রুবিন NVL72-এর চিপ-অন-বোর্ড পরীক্ষার ডেটা প্রকাশ করেছে।

এবং, এই পরীক্ষাটি সরাসরি আনলো ডিপসিক -V4-Pro, সবচেয়ে বাস্তবিক «অ্যাজেন্ট কোডিং» টাস্ক চালান!

ফলাফল অবাক করে দেয়: বর্তমান শীর্ষ মেশিন GB300 NVL72-এর তুলনায়, ভেরা রুবিনের প্রতি মেগাওয়াট থ্রুপুট সর্বোচ্চ 30 গুণ বেড়েছে এবং টোকেন খরচ সর্বোচ্চ 35 গুণ কমেছে!

অ্যাজেন্ট

কেউ চিৎকার করে উঠল: "আমি তো বিনিয়োগকারীদের বোকা বানানোর জন্য এতটাই বাড়াবাড়ি করে PPT লিখতে পারি না!"

অন্য এক ব্যক্তির মজার মন্তব্য: "আগে হাজার ডলারে H200 মহঙ্গা মনে হত, কিন্তু এখন ফিরে তাকালে দেখি H200 এমনকি বেসিক ভার্সনও নয়।"

অ্যাজেন্ট

চলুন এটি ভালোভাবে পর্যালোচনা করি।

H200 থেকে GB300 পর্যন্ত, বাস্তব Agent ওয়ার্কলোডের থ্রুপুট সর্বোচ্চ 30 গুণ বৃদ্ধি পেয়েছে, যেখানে খরচ প্রায় দ্বিগুণ হয়েছে।

GB300 থেকে ভেরা রুবিন পর্যন্ত, থ্রুপুট আবার 30 গুণ পর্যন্ত বৃদ্ধি পেয়েছে, এবং সম্পূর্ণ র্যাকের দাম প্রায় দ্বিগুণ হয়েছে।

পুরনো হুয়াংয়ের মুরের আইন অনুযায়ী, এই দুই বছরে নভেডিয়ার সবচেয়ে বড় প্রযুক্তিগত উন্নতি হল জিপিইউ নয়, বরং এটির দাম 4 গুণ বাড়িয়ে 900 গুণ বেশি গতি অর্জন!

অ্যাজেন্ট

এবার, নভিডিয়া সবাইকে একটি অস্বাভাবিক সত্য ঘোষণা করেছে: LLM যুগ শেষ, এজেন্ট যুগ শুরু, আগের সব AI পারফরম্যান্স বেঞ্চমার্ক বাতিল!

অ্যাজেন্ট

এর মধ্যে, এজেন্টদের জন্য ডিজাইন করা Vera CPU-কে মাস্কের SpaceXAI রাতারাতি ইনস্টল করেছে এবং সরাসরি মহাকাশে পাঠানোর প্রস্তুতি নিচ্ছে।

আজই, নভিডিয়া গ্রোক 3 এলপিএক্স সম্পূর্ণ বড় উৎপাদনে প্রবেশ করেছে।

Gemma 4 31B এর উপর চলছে, গতি অসাধারণ, প্রতি সেকেন্ডে সরাসরি 3400 টোকেন পৌঁছেছে। ট্রিলিয়ন প্যারামিটার মডেলের থ্রুপুট, 35 গুণ বৃদ্ধি পেয়েছে।

অ্যাজেন্ট

অ্যাজেন্ট

এই নতুন রেকর্ডগুলি আজ রাত থেকে এজেন্ট ইকোসিস্টেমের ব্যবসায়িক কাঠামোকে পুনর্লিখন করে দেবে!

নিভিডিয়াকে ভেরা রুবিন চালু করতে হবে কেন?

OpenRouter-এর সর্বশেষ ডেটা উত্তর দেয়: বাস্তব জীবনে, একটি Agent AI টাস্ক দ্বারা ব্যবহৃত Token-এর সংখ্যা সাধারণ চ্যাট কথোপকথনের 15 গুণ!

উদাহরণস্বরূপ, যদি একটি এজেন্ট একটি কোম্পানির গবেষণা করে বিনিয়োগ সিদ্ধান্ত নেয়, তাহলে এই প্রক্রিয়ায় এজেন্ট এবং সাব-এজেন্টগুলি নিরন্তর যুক্তি দেয়, যা টোকেনের সঞ্চয়কে পরবর্তী পদক্ষেপের ইনপুট হিসাবে ব্যবহার করে, এবং দীর্ঘ কনটেক্সট প্রসেসিং হয়ে ওঠে এজেন্ট AI-এর সবচেয়ে গুরুত্বপূর্ণ সীমাবদ্ধতা।

অ্যাজেন্ট

যত বেশি বুদ্ধিমান এজেন্ট ইন্টারঅ্যাকশন হয়, তত বেশি থ্রুপুট—এজেন্টের সংখ্যা 10 গুণ বেড়েছে, টুল কল 2 গুণ বেড়েছে, ক্যালকুলেশন ক্ষমতা এবং অ্যালগরিদমের দ্বন্দ্ব নতুন চাহিদা তৈরি করেছে।

অ্যাজেন্ট

চ্যাটকে এজেন্ট হিসেবে ব্যবহার করবেন না, পুরনো বেঞ্চমার্ক সম্পূর্ণরূপে বাতিল!

এই সময়, পারম্পরিক এআই বেঞ্চমার্কিং (যেমন স্থির দৈর্ঘ্যের 8K/1K সিকোয়েন্স টেস্ট) সম্পূর্ণরূপে অকার্যকর হয়ে পড়ে।

নভেডিয়া অফিসিয়ালি বলেছে: পারফরম্যান্স মাপন অবশ্যই উন্নত হতে হবে! একক ইনফারেন্স রিকোয়েস্ট মাপা আর চলবে না, পুরো Agent ওয়ার্কফ্লো ধরতে হবে।

এর জন্য তারা SemiAnalysis-এর অধীনে থাকা AgentX বেঞ্চমার্ক ব্যবহার করেছে।

এই পরীক্ষাটি আর কঠোর প্রশ্নোত্তর নয়, বরং প্রকৃত, প্রসঙ্গ বৃদ্ধি, টুল কল এবং সাব-অ্যাজেন্ট জেনারেশন সহ একটি «কোডিং সেশন»-এর রিপ্লে।

অ্যাজেন্ট

এই কারণেই H200 নতুন এজেন্ট মাঠে অসহায় মনে হচ্ছে, ভেরা রুবিন রাজত্ব করতে বাধ্য।

ভেরা রুবিন NVL72 × ডিপসিক-ভি৪-প্রো:

হ্যাশরেট মনস্টার এসে গেছে

ভেরা রুবিন NVL72-এর ক্ষমতা প্রমাণের জন্য, নভিডিয়া সরাসরি ওপেন-সোর্স রাজা— ডিপসিক -V4-Pro (1.6T) এর অন-চিপ পরীক্ষা চালানো হচ্ছে।

ডেটা প্রকাশের সাথে সাথে ফলাফল অবিশ্বাস্য—

AgentX ওয়ার্কলোডের অধীনে, Vera Rubin NVL72-এর প্রতি মেগাওয়াট থ্রুপুট, GB300 NVL72-এর চেয়ে সর্বোচ্চ 30 গুণ বেশি!

অ্যাজেন্ট

দয়া করে মনে রাখবেন, এখানে পুরনো H200-এর তুলনা করা হচ্ছে না, বরং অত্যন্ত জনপ্রিয় মূল জিবি৩০০-এর সাথে।

GB300 একই সাথে ডিপসিক V4-Pro টেস্টিং-এ, প্রতি মেগাওয়াট থ্রুপুট ইতিমধ্যে H200-এর তুলনায় 15 গুণ বেশি।

তবে ভেরা রুবিন জিবি৩০০-এর কাঁধে আরও ৩০ গুণ উঠে গেলেন এবং প্যারেটো বক্ররেখার উপরেও উঠে গেলেন!

এর অর্থ কী?

বিদ্যুৎ সরবরাহের সীমাবদ্ধতার মধ্যে কাজ করা «এআই ফ্যাক্টরি»-এর জন্য এটি ভৌত নিয়মের সীমানা প্রসারিত করে।

একই বিদ্যুৎ বাজেটে, ভেরা রুবিন ৩০ গুণ বেশি এজেন্ট কাজ করতে পারে।

মেগাওয়াট বা গিগাওয়াট স্কেলের ডেটা সেন্টারের জন্য, এটি হল হঠাৎ করে ৩০ গুণ কম্পিউটিং সম্পদ তৈরি করা।

এছাড়াও, NVIDIA DSX MaxLPS প্রযুক্তিটি GPU, র্যাক এবং ওয়ার্কলোড স্তরে পাওয়ার ম্যানেজমেন্ট করতে পারে, যা একই মেগাওয়াট বাজেটে GPU এর পরিমাণ 40% পর্যন্ত বাড়িয়ে দেয়, ফলে AI ফ্যাক্টরির প্রতি মেগাওয়াট থ্রুপুট আরও বৃদ্ধি পায়!

অ্যাজেন্ট

টোকেন খরচ 35 গুণ কমে গেল! এজেন্ট শিল্পের 'লেজ' পুনর্লিখিত হলো

প্রতি মেগাওয়াট থ্রুপুট সরাসরি প্রতিটি জেনারেট টোকেনের খরচকে প্রভাবিত করে। পারফরম্যান্সের বিস্ফোরণ সবচেয়ে সরাসরি পরিণতি হল ব্যবসায়িক মডেলের পরমাণু বিস্ফোরণ।

নভেডিয়া ঘোষণা করেছে যে, ভেরা রুবিন NVL72 প্রতি মিলিয়ন টোকেন উৎপাদনের খরচ GB300 NVL72 এর চেয়ে সর্বোচ্চ 35 গুণ কম!

অ্যাজেন্ট

যখন রিজনিং খরচ 35 গুণ হঠাৎ কমে যায়, তখন 24 ঘন্টা অবিচ্ছিন্ন ডিজিটাল কর্মচারী বাস্তবতায় পরিণত হবে, এবং ToC সুপার অ্যাপগুলির বিস্ফোরণ ঘটবে।

লাও হুয়াং এই কাট দিয়ে এজেন্ট অ্যাপ্লিকেশনের যুগের দরজা খুলে দিয়েছেন।

অ্যাজেন্ট

চরম সমন্বিত ডিজাইন: লাও হুয়াং এটি কীভাবে করেছেন?

আপনি হয়তো জিজ্ঞাসা করছেন: ৩০ গুণ দ্রুত কিভাবে সম্ভব? এটি একটি চিপের প্রযুক্তির উপর নির্ভর করে?

অবশ্যই না।

ভেরা রুবিন NVL72-এর অসাধারণ পারফরম্যান্স বৃদ্ধি ঘটেছে «অত্যন্ত সমন্বিত ডিজাইন» এর মাধ্যমে।

অ্যাজেন্ট

যেমন বিচ্ছিন্ন সেবা, বিতরিত KV ক্যাশ, KV অনুভূত রাউটিং, মেগাMoE ইত্যাদি।

অ্যাজেন্ট

এছাড়াও, NVFP4 কোয়ান্টাইজেশন মডেল ওয়েট সরাসরি 4-বিট প্রেসিশনে কম্প্রেস করে, আউটপুট গুণমান বজায় রেখে মেমোরি ব্যবহার উল্লেখযোগ্যভাবে কমিয়ে দেয় এবং থ্রুপুটকে সরাসরি বাড়িয়ে দেয়।

এবং ষষ্ঠ প্রজন্মের NVLink এবং বড় মডেল MoE এর সংমিশ্রণ বর্তমান ইথারনেটের তুলনায় 10 গুণ দ্রুত এবং 3 গুণ কম ল্যাটেন্সির সাথে ইন্টারকানেকশন প্রদান করে, যা এরকম ডিপসিক এই MoE আর্কিটেকচার ভিত্তিক বড় মডেলটি 72টি GPU-এর মধ্যে বিভিন্ন «বিশেষজ্ঞ» সাবনেটওয়ার্ককে সহজেই কল করতে পারে।

এটি শুধু গ্রাফিক্স কার্ড বিক্রি করা নয়, লুয়াং একটি সম্পূর্ণ «এআই বিদ্যুৎ কেন্দ্র» বিক্রি করছেন।

অ্যাজেন্ট

নভিডিয়া গ্রোক 3 এলপিএক্স সম্পূর্ণ বড় উৎপাদন:

প্রতি সেকেন্ডে 3400 টোকেন, কোড এজেন্টের পরিবর্তন!

হট চিপস ২০২৬ সম্মেলনে, নভিডিয়া একটি আশ্চর্যজনক ঘোষণা করে: গ্রোক ৩ এলপিএক্স এখন পুরোপুরি বড় পরিমাণে উৎপাদন শুরু করেছে!

অ্যাজেন্ট

গ্রোক 3 এলপিএক্স, ভেরা রুবিন এনভিএল৭২ ডেটা সেন্টার প্ল্যাটফর্মের একক বিস্তার।

এটি এই সিস্টেমের জন্য বিশেষভাবে তৈরি করা হয়েছে, যার মুখ্য বৈশিষ্ট্য হল কম ল্যাটেন্সি সহ উপসংহার ত্বরান্বিতকরণ।

এই কালো প্রযুক্তিটি গত ডিসেম্বরে নভিডিয়া দ্বারা স্টার্টআপ গ্রোক থেকে 200 বিলিয়ন ডলার খরচ করে ক্রয় করা হয়েছিল।

অ্যাজেন্ট

AI এজেন্টগুলি ডিকোডিং ল্যাটেন্সির সমস্যার সম্মুখীন হয়, এই সমস্যার সমাধানের জন্য Groq 3 LPX বিশাল কনটেক্সট প্রসেসিং এবং টোকেন জেনারেশনকে সম্পূর্ণভাবে পৃথক করেছে।

নভেডিয়ার সমাধান হলো, বড় প্রসঙ্গ প্রক্রিয়াকরণের জন্য Rubinstein GPU ব্যবহার করা এবং অতি দ্রুত টোকেন জেনারেশনের জন্য Groq 3 LPX-এর উপর নির্ভর করা।

একজন পড়ার জন্য দায়ী, অন্যজন লেখার জন্য দায়ী, প্রত্যেকে নিজের সবচেয়ে ভালো কাজটি করছে।

অ্যাজেন্ট

একটি সম্পূর্ণ র্যাক-লেভেল ডিপ্লয়মেন্টে, উচ্চতম ব্যান্ডউইথ ইন্টারকানেকশনের মাধ্যমে পর্যন্ত 256টি LP30 অ্যাক্সেলারেটর জিপিইউ-এর সাথে সমন্বিতভাবে কাজ করে এন্টারপ্রাইজ-লেভেলের ইনফারেন্স ইঞ্জিন গঠন করে।

অ্যাজেন্ট

এর ফলে, গ্রোক 3 এলপিএক্স সরাসরি রেকর্ড ভাঙা আউটপুট গতি অর্জন করেছে।

Artificial Analysis-এর বেঞ্চমার্কে, Groq 3 LPX 100,000 টোকেনের দীর্ঘ কনটেক্সট উইন্ডোতে Gemma 4 31B চালায় এবং অসাধারণ 3,400 টোকেন/সেকেন্ড আউটপুট গতি অর্জন করে!

এটি অত্যন্ত দেরি-সংবেদনশীল ওয়ার্কলোডে প্রতিদ্বন্দ্বীদের তুলনায় চারগুণ দ্রুত প্রতিক্রিয়া সময় প্রদান করে।

অ্যাজেন্ট

যে বহুধাপবিশিষ্ট বুদ্ধিমান কর্মচারী কাজগুলি গত কয়েক ঘন্টায় সম্পন্ন হত, এখন কয়েক মিনিটেই সম্পন্ন হচ্ছে!

অ্যাজেন্ট

Groq 3 LPX এ 5000 টোকেন জেনারেট করতে 50 সেকেন্ড থেকে 1.5 সেকেন্ডে নেমে এসেছে, 34 গুণ পার্থক্য।

অ্যাজেন্ট

এবং কোডিং টাস্কে, Groq 3 LPX-এর সর্বোচ্চ আউটপুট গতি 6981 টোকেন/সেকেন্ড।

অ্যাজেন্ট

হুয়াং রেন্সুন সরাসরি বলেছেন যে, এলপিএক্স এর মাধ্যমে অতি দ্রুত টোকেন জেনারেশন প্রয়োগ করে এআই থ্রুপুট এবং প্রতিক্রিয়া ক্ষমতায় "আবারও একটি বিশাল প্রগতি" অর্জন করা হয়েছে।

অ্যাজেন্ট

নেবিয়াস নেবিয়াস টোকেন ফ্যাক্টরিতে এই চিপটি ডিপ্লয় করেছে, যাতে বুদ্ধিমান চক্রের প্রতিটি পদক্ষেপে তাৎক্ষণিক প্রতিক্রিয়ার চরম অভিজ্ঞতা পাওয়া যায়।

অ্যাজেন্ট

এর পরে আসে গ্রোক নিজে।

অ্যাজেন্ট

প্রথম Agent-বিশেষায়িত CPU প্রকাশিত,

মাস্ক রাতের বেলায় মহাকাশে উড়ে গেলেন!

এই অফিসিয়াল ঘোষণায়, সবচেয়ে আকাঙ্ক্ষী পদক্ষেপ হল ভেরা সিপিইউ।

এজেন্টের জন্য নভেডিয়া একটি বিশেষ সিপিইউ তৈরি করেছে।

ভেরা এই সিপিউটি হল বুদ্ধিমান এজেন্টগুলিকে পুরোপুরি পুষ্টি দেওয়ার জন্য বিশেষভাবে তৈরি।

এটি 88টি স্ব-উন্নয়নকৃত Olympus কোর, উচ্চ ব্যান্ডউইথ LPDDR5X মেমোরি এবং 1.2TB/s ব্যান্ডউইথ সহ সজ্জিত।

অ্যাজেন্ট

বড় মডেল যুগে কেন একটি সম্পূর্ণ নতুন CPU প্রয়োজন?

হট চিপসের স্থানে, নভিডিয়া ভেরা সিপিইউয়ের কর্মকর্তা সরাসরি বলেন, "এজেন্টিক এআই হল ইতিহাসের সবচেয়ে জটিল কম্পিউটেশনাল টাস্ক।"

অ্যাজেন্ট

একটি টাস্কে, এজেন্টের পিছনে শত শত ধাপ চলছে: টুল কল করা, পাইথন কোড এক্সিকিউট করা, কনটেক্সট বদলানো, বিপুল পরিমাণ ডেটা প্রসেস করা...

এই ডেলিভারি স্কেডিউলিং কাজগুলি সম্পূর্ণরূপে CPU-এর উপর চাপিয়ে দেওয়া হয়েছে। তাই, নভেডিয়াকে এজেন্টের জন্য আলাদা একটি CPU তৈরি করতে হবে।

এই বিষয়টিকে গুরুত্ব দিয়ে, মাস্কের SpaceXAI রাতারাতি ঘোষণা করেছে যে নভেডিয়া Vera CPU-এর ব্যাপক বাস্তবায়ন শুরু হয়েছে!

এই বছরের মে মাসের শুরুতেই নভিডিয়া প্রথম ব্যাচ ভেরা স্যাম্পলগুলি চুপিচুপি A কোম্পানি, ওপেনএআই এবং স্পেসএক্সএআই-এর কাছে পাঠিয়েছিল।

শুধু তিন মাস পরেই, SpaceXAI এটিকে সম্পূর্ণ বাস্তবায়নে স্থানান্তরিত করতে উৎসুক।

আরও পাগলামি হলো, SpaceXAI গ্রককে চালানোর জন্য ভেরা রুবিন প্ল্যাটফর্মের উপর ভিত্তি করে গিগাওয়াট কম্পিউটিং ফ্যাক্টরি তৈরি করছে।

এছাড়াও, এই ক্ষমতা সরাসরি মহাকাশে পাঠানো হবে।

মাস্ক বলেছেন, "দুটি শক্তিশালী প্রতিষ্ঠান একত্রিত হয়ে 2028 সালে বৃহৎ পরিসরে চালু করার জন্য একটি অপ্টিমাইজড ভেরা রুবিন NVL72 ডিজাইন করেছে।"

অ্যাজেন্ট

স্পেসএক্সএআই-এর প্রথম প্রজন্মের «স্টারমাইন্ড» এআই স্যাটেলাইটটি ভেরা রুবিন এনভিএল৭২ র্যাক-লেভেল সিস্টেম ব্যবহার করার পরিকল্পনা করা হয়েছে।

অ্যাজেন্ট

একটি GPU থেকে সম্পূর্ণ Agent ফ্যাক্টরি

একই দিনে, দুটি চিপ ভেরা সিপিইউ এবং গ্রোক 3 এলপিএক্স সম্পূর্ণরূপে বড় পরিমাণে উৎপাদন শুরু করে।

This is significant for NVIDIA.

অ্যাজেন্ট

বৃহৎ মডেল যুগে, নভিডিয়া জিপিইউ দিয়ে ট্রেনিং এবং ইনফারেন্স জয় করেছে।

এজেন্ট যুগে, এর পরিসর এখন CPU, ইনফারেন্স অ্যাক্সেলারেটর, NVLink ইত্যাদি পর্যন্ত বিস্তৃত।

লো হুয়াং যা বিক্রি করছেন, তা এখন শুধুমাত্র একটি GPU নয়।

তিনি যা বিক্রি করতে চান, তা হলো একটি এআই ফ্যাক্টরি যা নিয়মিত টোকেন উৎপাদন করতে পারে।

এবার লাও হুয়াং সম্পূর্ণ «এজেন্ট যুগ»-এর জন্য একটি নতুন ভিত্তি তৈরি করতে চাইছেন।

প্রসঙ্গ:

https://x.com/MinLiBuilds/status/2091915873661686204

https://developer.nvidia.com/blog/nvidia-vera-rubin-and-blackwell-set-a-new-standard-for-agentic-ai-performance-per-watt/

https://developer.nvidia.com/blog/inside-nvidia-groq-3-lpx-the-low-latency-inference-accelerator-for-the-nvidia-vera-rubin-platform/

https://developer.nvidia.com/blog/maximizing-ai-factory-performance-per-watt-with-nvidia-dsx-maxlps/

এই লেখাটি ওয়েইচ্যাট গ্রুপ "নিউ জ্ঞান মেট্রিক্স" থেকে এসেছে, লেখক: ASI আবিষ্কার

দাবিত্যাগ: এই পৃষ্ঠার তথ্য তৃতীয় পক্ষের কাছ থেকে প্রাপ্ত হতে পারে এবং অগত্যা KuCoin এর মতামত বা মতামত প্রতিফলিত করে না। এই বিষয়বস্তু শুধুমাত্র সাধারণ তথ্যগত উদ্দেশ্যে প্রদান করা হয়, কোন ধরনের প্রতিনিধিত্ব বা ওয়ারেন্টি ছাড়াই, বা এটিকে আর্থিক বা বিনিয়োগ পরামর্শ হিসাবে বোঝানো হবে না। KuCoin কোনো ত্রুটি বা বাদ পড়ার জন্য বা এই তথ্য ব্যবহারের ফলে যে কোনো ফলাফলের জন্য দায়ী থাকবে না। ডিজিটাল সম্পদে বিনিয়োগ ঝুঁকিপূর্ণ হতে পারে। আপনার নিজের আর্থিক পরিস্থিতির উপর ভিত্তি করে একটি পণ্যের ঝুঁকি এবং আপনার ঝুঁকি সহনশীলতা সাবধানে মূল্যায়ন করুন। আরও তথ্যের জন্য, অনুগ্রহ করে আমাদের ব্যবহারের শর্তাবলী এবং ঝুঁকি প্রকাশ পড়ুন।