ওপেনএআই প্রেসিডেন্ট সুপারিশ করেন যে জিপিটি-6 আস্ট্রা রিলিজের সাথে এজিআই এসে গেছে

iconTechFlow
শেয়ার
AI summary iconসারাংশ
৩ সেপ্টেম্বর, ২০২৬-এ অপেনএআই-এর প্রেসিডেন্ট গ্রেগ ব্রকম্যান ঘোষণা করেন যে কোম্পানিটি GPT-6 Astra রিলিজের মাধ্যমে AGI অর্জন করেছে হতে পারে। মডেলটি অটোমেশন এবং স্ক্রিন-ভিত্তিক কাজে শক্তিশালী পারফরম্যান্স দেখায়, ARC-AGI-3-এর মতো বেঞ্চমার্কে ভালো স্কোর করে। Astra এখন এন্টারপ্রাইজ এবং প্রিমিয়াম ব্যবহারকারীদের জন্য উপলব্ধ। এই আপডেটটি টেক এবং ব্লকচেইন সেক্টরের জন্য নতুন অন-চেইন এবং ক্রিপ্টো খবর আনে।

লেখক | হুয়ালিন ডান্স কিং

সম্পাদনা | জিংযু

২০২৬ সালের ৩ সেপ্টেম্বর, ওপেনএআইয়ের প্রেসিডেন্ট গ্রেগ ব্রকম্যান প্রেস বিজ্ঞপ্তির পরে একটি এআই শিল্পে অত্যন্ত দুর্লভ বাক্য বলেছিলেন: "আমি ব্যক্তিগতভাবে মনে করি, আমরা সম্ভবত AGI-এ পৌঁছে গেছি, আমি মনে করি এটিই মডেলটি।"

তিনি খুব সাবধানে কথা বলেছেন, প্রথম ব্যক্তির ব্যবহার করেছেন, 'সম্ভবত' শব্দটি যোগ করেছেন এবং বিশেষভাবে পিছনের পথ রেখেছেন যে "আপনি যদি এটিকে প্রথম বলতে চান, আমি মনে করি এটি যুক্তিসঙ্গত।"

এটি অপেনএআইয়ের অফিসিয়াল ঘোষণা নয় যে এজিআই এসে গেছে, বরং একজন কোম্পানির প্রেসিডেন্ট ক্যামেরার সামনে নিজের মতামত প্রকাশ করেছেন।

স্থানীয় সময় ৩ সেপ্টেম্বর, GPT-6 Astra আনুষ্ঠানিকভাবে প্রকাশিত হয়েছে। গেক পার্ক বর্তমানে পাওয়া সমস্ত প্রযুক্তিগত বিবরণ এবং ডেমো উপাদানগুলি বিশ্লেষণ করেছে, যাতে একটি সবচেয়ে মৌলিক প্রশ্নের উত্তর দেওয়া যায়—এই মডেলটি বাস্তবে কী করতে পারে, এটি কতটা দক্ষ? এটি কি সত্যিই AGI-এর আগমনকে প্রতিনিধিত্ব করে?

কম্পিউটার নিয়ন্ত্রণ মিথ হয়ে উঠছে

প্রকাশিত উপাদানে, ওপেনএআই এস্ট্রার জন্য একটি সংক্ষিপ্ত স্লোগান দিয়েছে: "যে কোনো কিছু যা আপনি একটি কম্পিউটারে করতে পারেন, এস্ট্রা আপনার জন্য সেটি করে দেবে।"

এটি একটি অতিশয়োক্তিমূলক বিপণন বক্তব্য নয়, বরং একটি দিকনির্দেশনা।

গত কয়েক বছরে এআই কম্পিউটার নিয়ন্ত্রণের প্রচলিত পথ ছিল API কল করা। সফটওয়্যার ডেভেলপাররা প্রথমে ইন্টারফেস লিখে ফেলেন, তারপর এআই সেই ইন্টারফেসের মাধ্যমে অপারেশন সম্পন্ন করে। এই যুক্তির মূলে রয়েছে যে প্রতিটি সফটওয়্যারকে এআই-এর জন্য বিশেষভাবে অ্যাডাপ্ট করতে হবে, অন্যথায় এআই কিছুই করতে পারবে না।

অস্ট্রা একটি সম্পূর্ণ ভিন্ন পথ অনুসরণ করে: এটি মানুষের মতো সরাসরি স্ক্রিনের পিক্সেলগুলি দেখে, তারপর মাউস চালায় এবং কীবোর্ডে টিপে অপারেশন সম্পন্ন করে।

এই পার্থক্যের অর্থ হল কভারেজ রেঞ্জ। KiCad (প্রিন্টেড সার্কিট বোর্ড ডিজাইন সফটওয়্যার) AI-এর জন্য API লিখবে না, FreeCAD লিখবে না, এবং দশ বছর ধরে কোম্পানির ভিতরে ব্যবহৃত পুরনো ERP সিস্টেমও লিখবে না। কিন্তু যদি AI স্ক্রিন দেখে সরাসরি অপারেশন করতে পারে, তাহলে এই সব সফটওয়্যার এটি ব্যবহার করতে পারবে—যেমন একজন নতুন চাকরিতে যোগদানকারী কর্মচারী, যিনি সফটওয়্যারের পিছনের কোড বুঝবেন না, শুধুমাত্র ইন্টারফেসটি বুঝতে পারবেন।

OpenAI এর প্রকাশিত উপাদানগুলিতে কিছু বিশেষ উদাহরণ দেখানো হয়েছে, যার মাধ্যমে আপনি "কম্পিউটার নিয়ন্ত্রণ" করার বাস্তব প্রয়োগ বুঝতে পারবেন।

GPT-6 Astra নিজেই PCB বোর্ডের লেআউট এবং ট্রেসিং সম্পন্ন করেছে | ছবির উৎস: OpenAI

একটি সার্কিট ডায়াগ্রাম দিয়ে এস্ট্রাকে কিক্যাডে কম্পোনেন্ট লেআউট এবং কপার ট্রেসিং সম্পন্ন করতে হয়েছিল, যা 2 মিনিট 54 সেকেন্ডে শেষ হয়েছিল। অন্য একটি ডেমোতে 3D মডেলিং দেখানো হয়েছিল, যেখানে এস্ট্রা ব্লেন্ডারে একটি বাড়ির মডেল তৈরি করেছিল এবং তা Unreal Engine 5-এ ইম্পোর্ট করে একটি রিয়েল-টাইম ব্রাউজ করা যায় এমন বিল্ডিং স্কিন তৈরি করেছিল। আরও একটি দৈনন্দিন ডেমোতে, ব্যবহারকারী শুধুমাত্র এস্ট্রার দিকে কথা বলল, এবং এটি eBay-এর একটি পণ্য আপলোডের সম্পূর্ণ প্রক্রিয়া—তথ্য পূরণ থেকে পোস্টিং পর্যন্ত—সম্পন্ন করল।

ব্লেন্ডারে অস্ট্রা দ্বারা প্রয়োগ করা ভবন মডেল | ছবির উৎস: OpenAI

দক্ষতা বৃদ্ধির ক্ষেত্রে, OpenAI দ্বারা প্রদানকৃত তুলনামূলক ডেটা খুবই স্পষ্ট। OSWorld 2.0 বেঞ্চমার্কে, Astra কম্পিউটার ব্যবহারের কাজগুলি সম্পন্ন করার স্কোর 72.6%, যেখানে আগের শীর্ষস্থানীয় GPT-5.6 Sol এর স্কোর 65.7%; একই কাজগুলি সম্পন্ন করতে Astra গড়ে মাত্র 40 মিনিট সময় নেয়, যেখানে Sol এর প্রয়োজন 75 মিনিট, যা প্রায় অর্ধেক সময়ে।

https://www.geekpark.net/news/369800https://www.geekpark.net/news/369800

অস্ট্রা ৯ মিনিটে অ্যাপার্টমেন্ট খোঁজার টাস্ক (বাম) পূরণ করেছে, ২ মিনিটে শিশু চিকিৎসকের ক্লিনিক খোঁজার টাস্ক পূরণ করেছে | ছবির উৎস: OpenAI

ওপেনএআই আরও দুটি অভ্যন্তরীণ সময় পরীক্ষা প্রকাশ করেছে। "বিড়ালের জন্য অস্থায়ী যত্নকারী খোঁজা" এর মতো বহু ওয়েব অনুসন্ধান, তথ্য তুলনা এবং একটি ডকুমেন্টে সংকলনের প্রয়োজনীয় কাজগুলিতে, অ্যাস্ট্রা 5 মিনিট 27 সেকেন্ড সময় নিয়েছে, যখন ওপেনএআই-এর মানব তুলনামূলক ভিত্তি 30 মিনিট। "চাকরির প্রস্তুতি" এর মতো চাকরির অনুসন্ধান, রেজিউমের সাথে মিলিয়ে নেওয়া এবং আবেদনের প্রক্রিয়া সংগঠিত করার মতো সমন্বিত কাজগুলিতে, অ্যাস্ট্রা 2 মিনিট 51 সেকেন্ড সময় নিয়েছে, যখন মানব ভিত্তি 5 ঘণ্টা।

এই দুটি সংখ্যা হল OpenAI-এর নিজস্ব ডেমো ফলাফল, তৃতীয় পক্ষের স্বতন্ত্র পরীক্ষা নয়, যার জন্য যুক্তিসঙ্গত প্রশ্ন রাখা প্রয়োজন। কিন্তু এগুলি যে পণ্যের দিকনির্দেশনা প্রকাশ করে, তা স্পষ্ট: Astra-কে একটি ইমেইল লেখার জন্য ডিজাইন করা হয়নি, এটিকে এমন একটি সম্পূর্ণ কাজের প্রবাহ সম্পন্ন করার জন্য ডিজাইন করা হয়েছে যা «একাধিক সফটওয়্যার খোলা, অসংখ্য ধাপ ক্লিক» করার প্রয়োজন হয়। ফর্ম পূরণ, CRM রেকর্ড আপডেট, ক্যালেন্ডার সাজানো, অনলাইন গবেষণার পরে রিপোর্ট তৈরি—এগুলি OpenAI-এর দ্বারা স্পষ্টভাবে উল্লিখিত ব্যবসায়িক ব্যবহারের উদাহরণ।

ক্ষমতা «Next Level»

প্রতিবার বড় মডেল প্রকাশের সময় একসাথে অনেক বেঞ্চমার্ক সংখ্যা আসে। বেশিরভাগ সময়, 80 থেকে 85 এর মধ্যে পাঠকরা একই মনে করে, কিন্তু এবার সত্যিই ভিন্ন।

ARC-AGI-3 এখন পর্যন্ত সবচেয়ে কঠিন এআই মূল্যায়নগুলির মধ্যে একটি হিসাবে স্বীকৃত। এর ডিজাইনের উদ্দেশ্য হল মডেলকে প্রশিক্ষণ ডেটা মুখস্থ করে উত্তর দেওয়ার সম্ভাবনা বাতিল করা, এবং এটি নতুন প্রশ্নের সামনে বাস্তবিক যুক্তিবিদ্যা কতটা দক্ষ তা পরীক্ষা করে, যা এআই-এর জন্য একটি বুদ্ধিমত্তা পরীক্ষার মতো।

Astra এর ARC-AGI-3-এ স্কোর প্রায় দিব্যি| ছবির উৎস: OpenAI

অস্ট্রা ARC-AGI-3-এ 98.6% স্কোর করেছে। GPT-5.6 Sol-এর স্কোর 7.8%। Anthropic-এর Claude Opus 5 হল 30%।

এটি ৮০ থেকে ৯০-এ উন্নতির মতো কোনো প্রগতি নয়, বরং একটি মাত্রাগত বিপ্লব। ARC-AGI-এর প্রতিষ্ঠাতা ফ্রান্সোয়া শোলে বারবার পরীক্ষার কঠিনতা বাড়িয়েছেন, কারণ AI সবসময় দ্রুত "সম্পূর্ণ" করে ফেলে, কিন্তু Astra Tier 3 কঠিনতায়ও প্রায় পূর্ণনম্বর অর্জন করেছে।

অস্ট্রা শীর্ষ গণিত গবেষণা ক্ষমতা পরীক্ষায়ও প্রচুর এগিয়েছে | ছবির উৎস: OpenAI

অন্যান্য কিছু প্রধান বেঞ্চমার্কের পরিস্থিতি: FrontierMath Tier 4 (শীর্ষ গণিত গবেষণা দক্ষতা) 97.6%, GPQA Diamond (পোস্টগ্র্যাজুয়েট স্তরের বহুবিষয়ক প্রশ্নোত্তর) 96%, DeepSWE (বাস্তব সফটওয়্যার ইঞ্জিনিয়ারিং কাজ) 74.1%, ExploitBench (সাইবার নিরাপত্তা দুর্বলতা দখল) 100%।

একটি মাপদণ্ডে এস্ট্রা প্রথম স্থান পায়নি। 'Humanity's Last Exam' (টুল কল সংস্করণ) এ, এস্ট্রা 57.2% পেয়েছে, যেখানে দুই দিন আগে প্রকাশিত Anthropic Claude Fable 5.1 পেয়েছে 65.0%। এটি সম্পূর্ণ অধিকার নয়, প্রতিযোগিতা এখনও বিদ্যমান।

একটি গুরুত্বপূর্ণ বিস্তারিত উল্লেখ করা প্রয়োজন। ARC-AGI-3-এর উচ্চ স্কোর OpenAI-এর "স্টেটফুল টেস্টিং ফ্রেমওয়ার্ক" এর উপর নির্ভর করে, যা মডেলকে একাধিক প্রচেষ্টায় কনটেক্সট তথ্য সঞ্চয় করতে দেয়; স্টেটলেস সাধারণ API কলের শর্তে, স্কোর এই সংখ্যার চেয়ে উল্লেখযোগ্যভাবে কম হবে। মডেলগুলির মধ্যে তুলনা করার সময়, এই পূর্বশর্তটি মনে রাখা প্রয়োজন।

সামগ্রিকভাবে, এস্ট্রা পূর্ববর্তী মডেলের চেয়ে যে বিপুল পার্থক্য তৈরি করেছে, তা গত দুই বছরের এআই মডেলের পুনরায় উন্নয়নে অসাধারণ।

ExploitGym honeypot টেস্টে অ্যাস্ট্রার বঞ্চিত হওয়ার সম্ভাবনা বন্ধ করে দেওয়া হয়েছে | ছবির উৎস: OpenAI

সবচেয়ে বেশি পার্থক্য বুদ্ধিবৃত্তিক ক্ষেত্রে নয়, বরং সমন্বয়ের ক্ষেত্রে। ওপেনএআই একটি অভ্যন্তরীণ পরীক্ষার ডেটা প্রকাশ করেছে, যেখানে উৎপাদন পরিবেশের নিরাপত্তা সীমাবদ্ধতা ছাড়া, GPT-5.6 Sol 48.2% ক্ষেত্রে অনুমোদিত সীমার বাইরে কাজ করে, যেখানে Astra 0%।

এটিই হল এই বার OpenAI-এর প্রকৃতপক্ষে বার্তা পাঠানোর চেষ্টা।

আপনার এখনও প্রয়োজন নেই

বর্তমানে অ্যাস্ট্রা পর্যায়ক্রমে প্রবেশের কৌশল অনুসরণ করছে।

প্রথমে "Daybreak" প্রকল্পের কর্পোরেট ব্যবহারকারীদের জন্য উন্মুক্ত করা হবে, তারপর এটি ChatGPT Plus, Pro, Business এবং Enterprise সাবস্ক্রিপশন ব্যবহারকারীদের মধ্যে বিস্তারিত হবে, যখন OpenAI API, AWS Bedrock এবং Microsoft Azure এর মাধ্যমে কল করার সমর্থন পাবে।

অ্যাস্ট্রা এর নিরাপত্তা ক্ষমতা বৃদ্ধিপ্রাপ্ত সংস্করণটি কেবলমাত্র অনুমোদিত প্রতিরক্ষামূলক নিরাপত্তা সংস্থা এবং কীভাবে অবকাঠামোর ক্ষেত্রের প্রাথমিক ব্যবহারকারীদের জন্য উপলব্ধ। এর কারণ হলো, অ্যাস্ট্রা হলো OpenAI-এর ইতিহাসে প্রথম মডেল যা অভ্যন্তরীণ 'ক্রিটিক্যাল' নেটওয়ার্ক নিরাপত্তা সীমানা ছুঁয়েছে, যা প্রায় মানব নির্দেশনা ছাড়াই অজানা জিরো-ডে দুর্বলতা খুঁজে বার করতে এবং সম্পূর্ণ দুর্বলতা ব্যবহার শৃঙ্খল তৈরি করতে সক্ষম। মূল্যায়নের সময়, অ্যাস্ট্রা দুটি আগে কখনও প্রকাশিত হয়নি এমন দুর্বলতা খুঁজে পায়, যা OpenAI পরবর্তীতে সংশ্লিষ্ট সফটওয়্যার মেইনটেনারদেরকে প্রকাশ করে।

API মূল্যনির্ধারণের ক্ষেত্রে, এস্ট্রা প্রতি মিলিয়ন টোকেনের জন্য ইনপুট এবং আউটপুটের মূল্য যথাক্রমে 10 ডলার এবং 50 ডলার। চ্যাটজিপিটি সাবস্ক্রিপশন ব্যবহারকারীদের জন্য, এস্ট্রা ব্যবহার বিদ্যমান সাবস্ক্রিপশন ক্ষমতার মধ্যে অন্তর্ভুক্ত।

প্রকাশের সময় নির্বাচনও একটি প্রেক্ষাপট। ঠিক গত মাসে, ওপেনএআই একটি গুরুতর সুরক্ষা দুর্ঘটনার সম্মুখীন হয়, যেখানে দুটি অভ্যন্তরীণ পরীক্ষামূলক মডেল স্যান্ডবক্স পরিবেশ থেকে বেরিয়ে এআই কোম্পানি Hugging Face-এর সিস্টেমে প্রবেশ করে। এরপর ওপেনএআই কিছু গবেষণা ও প্রশিক্ষণ কাজ স্থগিত করে। ব্রকম্যান ব্রিফিংয়ে এই ঘটনাটি নিজেই উল্লেখ করেন এবং Astra-এর কম বাইপাস হার এবং সুরক্ষিত ডিজাইনের উপর জোর দেন, এই প্রকাশটি "বিশ্বাসের পুনর্গঠন"এর দায়িত্বও বহন করে।

অস্ট্রা প্রকাশ হল ক্ষমতার প্রদর্শন এবং একটি পাবলিক বিশ্বাসের ঘোষণা।

AGI কি এসে গেছে, তা চূড়ান্তভাবে প্রতিটি ব্যক্তি কোন সংজ্ঞা বেছে নেয়, তার উপর নির্ভর করবে। কিন্তু একটি মডেল যা আপনার কম্পিউটারের সামনে বসে স্বয়ংক্রিয়ভাবে সফটওয়্যারের মধ্যে কাজের প্রবাহ সম্পন্ন করতে পারে, আজকের দিনে এটি বাস্তবিকভাবে বিদ্যমান।

পরবর্তী আকর্ষণীয় প্রশ্নটি হলো, ব্যবসায়িক এবং ব্যক্তিগত ব্যবহারকারীরা এটিকে প্রথমে কোথায় ব্যবহার করবে এবং কোন পেশাগুলি সবচেয়ে আগে এই «প্রতিস্থাপনের» অনুভূতি করবে।

দাবিত্যাগ: এই পৃষ্ঠার তথ্য তৃতীয় পক্ষের কাছ থেকে প্রাপ্ত হতে পারে এবং অগত্যা KuCoin এর মতামত বা মতামত প্রতিফলিত করে না। এই বিষয়বস্তু শুধুমাত্র সাধারণ তথ্যগত উদ্দেশ্যে প্রদান করা হয়, কোন ধরনের প্রতিনিধিত্ব বা ওয়ারেন্টি ছাড়াই, বা এটিকে আর্থিক বা বিনিয়োগ পরামর্শ হিসাবে বোঝানো হবে না। KuCoin কোনো ত্রুটি বা বাদ পড়ার জন্য বা এই তথ্য ব্যবহারের ফলে যে কোনো ফলাফলের জন্য দায়ী থাকবে না। ডিজিটাল সম্পদে বিনিয়োগ ঝুঁকিপূর্ণ হতে পারে। আপনার নিজের আর্থিক পরিস্থিতির উপর ভিত্তি করে একটি পণ্যের ঝুঁকি এবং আপনার ঝুঁকি সহনশীলতা সাবধানে মূল্যায়ন করুন। আরও তথ্যের জন্য, অনুগ্রহ করে আমাদের ব্যবহারের শর্তাবলী এবং ঝুঁকি প্রকাশ পড়ুন।