GPT-6 Astra ARC-AGI-3-এ প্� практически পারফেক্ট স্কোর পেয়ে এজিআই নিয়ে বিতর্ক জাগিয়েছে

iconMetaEra
শেয়ার
AI summary iconসারাংশ
GPT-6 Astra ARC-AGI-3-এ প্� практически পারফেক্ট স্কোর করেছে, একটি সিম্বলিক ওয়ার্ল্ড মডেল ব্যবহার করে 96% টাস্কে মানুষের চেয়ে বেশি ভালোভাবে জটিল পাজল সমাধান করেছে। পরীক্ষাটির খরচ ছিল $18,000, যেখানে সমালোচকদের মতে এটি আসল AGI-এর পরিবর্তে বাহ্যিক টুলগুলির উপর নির্ভর করেছিল। রিস্ক-অন অ্যাসেটের প্রতি বাড়তি আগ্রহের মধ্যে, মডেলটির কর্মক্ষমতা উচ্চখরচের কম্পিউটেশনের বদলে বাস্তব AI অগ্রগতির প্রশ্ন তোলে। CFT এজেন্সিগুলি ইতিমধ্যেই AI-এর উন্নতির মাধ্যমে নিয়ন্ত্রণমূলক কাঠামোগুলিকে কীভাবে প্রভাবিত করা হচ্ছে, তা পর্যবেক্ষণ করছে।
GPT-6 Astra এর ARC-AGI-3 টেস্টে 100% এর কাছাকাছি স্কোর অর্জনের কারণে মনোযোগ আকর্ষণ করেছে। এই মডেলটি দক্ষ “সিম্বলিক ওয়ার্ল্ড মডেল” তৈরি করে বাস্তব বিশ্বকে লজিক্যাল সিম্বল এবং কারণ-প্রভাব কোডে বিমূর্ত করে, অপরিচিত গ্রাফিক্যাল গেমগুলিতে স্বয়ংক্রিয়ভাবে DSL বীজগণিতের সিম্বল সিস্টেম তৈরি করে পরিবেশের নিয়মগুলি রেকর্ড করে, “ভার্চুয়াল স্যান্ডবক্স” তৈরি করে সিমুলেশনের মাধ্যমে পরবর্তী পদক্ষেপ নেয়। তবে, উচ্চ স্কোরের পিছনে প্রতি প্রশ্নের জন্য 360 ডলার, এবং সমগ্র টেস্টের জন্য 18,000 ডলারের প্রচুর কম্পিউটেশনাল খরচ রয়েছে। ARC Prize ফাউন্ডেশনের প্রেসিডেন্ট গ্রেগ কামরাডট বলেন, উচ্চ স্কোর Harness-এর বাইরের ফ্রেমওয়ার্কের উপর নির্ভরশীল, এটি প্রকৃত AGI-এর বিপ্লব নয়, শুধুমাত্র AI-এর বুদ্ধিমত্তা বাড়ছে তা প্রমাণিত হয়েছে।

লেখক এবং উৎস: লেইফেঙ্গোয়েন

AI বুদ্ধিমত্তা পরীক্ষা ভেঙে ফেলুন! GPT-6 Astra-এর সিম্বলিক ওয়ার্ল্ড মডেল কি একটি বিপ্লব, নাকি টাকা দিয়ে স্কোর বাড়ানো?

প্রতিটি প্রশ্নে 360 ডলার পোড়াচ্ছে, GPT-6 কি সত্যিই AGI পার করে গেছে?

OpenAI-এর সবচেয়ে শক্তিশালী মডেল GPT-6 Astra চূড়ান্তভাবে চালু হয়েছে, যা কম্পিউটার অপারেশন, গবেষণা এবং নিরাপত্তা প্রতিরোধে অসাধারণ বিপ্লব ঘটিয়েছে। অনেক উল্লেখযোগ্য সাফল্যের মধ্যে, সবচেয়ে বেশি আলোচিত হয়েছে ARC-AGI-3 পরীক্ষায় এর 100% এর কাছাকাছি স্কোর।

AI বুদ্ধিমত্তা পরীক্ষা ভেঙে ফেলুন! GPT-6 Astra-এর সিম্বলিক ওয়ার্ল্ড মডেল কি একটি বিপ্লব, নাকি টাকা দিয়ে স্কোর বাড়ানো?

ARC-AGI-3 কী? এটি বর্তমানে বিশ্বব্যাপী প্রযুক্তি জগতে স্বীকৃত একটি AI-এর "বুদ্ধিমত্তা" মূল্যায়ন তালিকা, আপনি এটিকে AI-এর জন্য মেনসা ক্লাবের ভর্তি পরীক্ষা হিসাবে বুঝতে পারেন।

এই পরীক্ষাটিতে শুধুমাত্র পরিবর্তনশীল চিত্রের নিয়ম রয়েছে, যা প্র্যাকটিস করা যায় না; AI-কে মানুষের মতো পরিবেশ অন্বেষণ, লক্ষ্য অনুমান করতে হবে, এবং স্থানীয় প্রতিক্রিয়া ও যুক্তির মাধ্যমে নিয়মটি খুঁজে বার করতে হবে। এটি বিভিন্ন মূল্যায়নে একটি উন্নত পর্যায়ের, এবং AI-কে শুধুমাত্র একটি টুল হিসাবেই দেখা হচ্ছে নাকি সত্যিকারের বুদ্ধিমত্তা আছে, তা আরওভালভাবে পরীক্ষা করে।

এবং GPT-6 Astra এই পরীক্ষাটি সম্পূর্ণরূপে পার হয়ে গেল, যেহেতু আগের মডেল GPT-5.6 Sol এর স্কোর ছিল মাত্র 38.3%, এটি একটি বিশাল প্রগতি। এই বুদ্ধিমত্তা মানুষকেও অতিক্রম করেছে, 96% লেভেলে এটি মানুষের চেয়ে বেশি কার্যকরীভাবে কাজ করেছে এবং গড়ে মানুষের চেয়ে 51.7% কম অ্যাকশন স্টেপ নিয়েছে।

যদি একটি কৃত্রিম বুদ্ধিমত্তা সম্পূর্ণ অপরিচিত পরিবেশে যুক্তিগত নিয়ম গড়ে তোলার এবং সমস্যা সমাধানের ক্ষমতা অর্জন করে, তাহলে আমরা কল্পনা করতে পারি যে ভবিষ্যতে এটি অপরিচিত অটোনোমাস ড্রাইভিং পরিস্থিতিতে সঠিক পছন্দ করতে পারে বা একটি সম্পূর্ণ নতুন, অজানা ভাইরাসের বহির্ভূত হওয়ার সময় দ্রুত একটি কার্যকরী ওষুধের অণুগঠন প্রতিষ্ঠা করতে পারে।

GPT-6 Astra কেন এত বুদ্ধিমান তা বুঝতে, ARC Prize অফিসিয়ালরা এর ব্যাকএন্ড রেকর্ড পুনর্বিশ্লেষণ করেন এবং দেখেন যে এটি গেম খেলার সময় দক্ষ “সিম্বলিক ওয়ার্ল্ড মডেল” তৈরি করে।

AI বুদ্ধিমত্তা পরীক্ষা ভেঙে ফেলুন! GPT-6 Astra-এর সিম্বলিক ওয়ার্ল্ড মডেল কি একটি বিপ্লব, নাকি টাকা দিয়ে স্কোর বাড়ানো?

সিমবলিক ওয়ার্ল্ড মডেল হল "ওয়ার্ল্ড মডেল"-এর একটি উন্নত বিকাশ। যখন ওয়ার্ল্ড মডেল শিল্পীর মতো ভবিষ্যত পূর্বানুমানের জন্য চিত্র ব্যবহার করে; তখন সিমবলিক ওয়ার্ল্ড মডেল একজন গণিতবিদের মতো, বাস্তব বিশ্বকে যুক্তিগত সিম্বল এবং কারণ-প্রভাব কোডে বিশদভাবে সাজায়।

এই প্রযুক্তিটিকে এআইয়ের উন্নত যুক্তিবিদ্যার দিকে যাওয়ার অপরিহার্য পথ হিসাবে স্বীকৃত।

সিম্বল ওয়ার্ল্ড মডেল কী?

পূর্বে, ARC-AGI সিরিজ বেঞ্চমার্কে অনেক বড় মডেল উচ্চ স্কোর পায়নি এর একটি প্রধান কারণ ছিল তাদের “বলি ট্রায়াল অ্যান্ড এরর”-এর অভ্যাস। AI গেমের স্ক্রিনকে পিক্সেল ব্লকে কেটে ফেলে, প্রথমে যেকোনো জায়গায় ক্লিক করে, ভুল হলে দিক বদলায়, এবং সৌভাগ্যের ওপর নির্ভর করে গেমটি পার করে।

এই মোডে, যদিও কিছু স্কোর ভাঙা যায়, এআই খেলার নিয়মগুলি বাস্তবিকভাবে বুঝতে বা শিখতে পারে না।

সিম্বল ওয়ার্ল্ড মডেল কেন সমগ্র পরিস্থিতি নিয়ন্ত্রণ করে, তার কারণ হল এটি পরিবেশের ভৌত নিয়ম এবং কারণ-প্রভাব সম্পর্ককে পুরোপুরি বুঝে পরিশীলিত গণনার মাধ্যমে বিকল্প নির্বাচন করে।

বাস্তব পরীক্ষায়, যখন GPT-6 Astra অপরিচিত গ্রাফিক্স গেমে প্রবেশ করে, তখন এটি নিজের তৈরি করা DSL, একটি বিশেষ বীজগাণিতিক প্রতীক পদ্ধতি ব্যবহার করে পর্যবেক্ষিত পরিবেশের জন্য বিস্তারিত নোট তৈরি করতে শুরু করে। উদাহরণস্বরূপ, এটি গেমের সম্ভাব্য নিহিত নিয়মগুলি, পরবর্তীতে বাস্তবায়িত নির্দেশাবলীর ধারাবাহিকতা, এমনকি প্রতিটি পিক্সেলের গতিপথকেও সঠিকভাবে স্থানাঙ্ক ব্যবস্থায় ম্যাপ করে।

এই বীজগাণিতিক রেকর্ডিং পদ্ধতি একটি একক নির্ধারিত বিশ্বের অবস্থা তৈরি করে, যা আগের মডেলগুলির প্রাকৃতিক ভাষায় ইন্টারঅ্যাকশনের মাধ্যমে উৎপন্ন অস্পষ্টতার তুলনায় সঠিকতার জন্য একটি ঐতিহাসিক বিপ্লব আনে।

তারপর, এটি মনের মধ্যে একটি পাইথন কোড লজিক লিখবে: "যদি আমি A চাপি, তবে গ্রাফ 90 ডিগ্রি বামে ঘুরবে।"

তারপর, এটি নিজের মস্তিষ্কে একটি "ভার্চুয়াল স্যান্ডবক্স" তৈরি করে, যেখানে পরবর্তী পরিকল্পনার প্রতিটি ধাপ মানসিকভাবে পরীক্ষা করা হয়। যখন লজিক্যাল সিকোয়েন্সটি সম্পূর্ণ এবং নির্ভুল বলে প্রমাণিত হয়, তখনই এটি বাস্তব গেমে প্রথম পদক্ষেপ নেয়। এটিই কারণ যে, এর অপারেশনের দক্ষতা মানুষের চেয়ে অনেক বেশি।

GPT-6 Astra-এর ক্ষমতার সীমানা পরীক্ষা করতে, রেড টিম প্ল্যাটফর্ম PRO‑LONG এটিকে কোড স্যান্ডবক্সে রাখে, যেখানে AI নিজেই কাস্টম কোড লিখতে এবং চালাতে পারে।

ফলাফলস্বরূপ, GPT-6 Astra প্রতিটি গেমের জন্য বিশেষভাবে টুল তৈরি করতে শুরু করে। উদাহরণস্বরূপ, একটি প্রহরীদের পাহারাযুক্ত জটিল ল্যাবিরিন্থ গেমে, GPT-6 Astra নিজেই একটি নেভিগেশন সিস্টেম লিখেছিল, তারপর যুদ্ধের নিয়ম যোগ করেছিল, এবং প্রহরীদের পাহারার পথ সিমুলেশন করেছিল, শেষ পর্যন্ত এই নিজস্ব টুলচেইনের মাধ্যমে ফলাফলকে পূর্ণাঙ্গভাবে পূর্বাভাস দিয়েছিল এবং যাচাই করেছিল।

পূর্বে, এই সিম্বলিক রিজনিং এবং স্বয়ংক্রিয় টুল তৈরির ক্ষমতা সম্পূর্ণরূপে বাহ্যিক হারনেস এক্সটেনশন ফ্রেমওয়ার্কের উপর নির্ভর করত। এক্সটেনশনগুলি মডেলের জন্য ইমেজ ট্রান্সলেশন, স্টেট রেকর্ডিং এবং রেজাল্ট ভেরিফিকেশন করত, কিন্তু এর বড় অসুবিধা ছিল: মডেল এবং এক্সটেনশনের মধ্যে ডেটা ট্রান্সফারের ফলে উচ্চ ল্যাটেন্সি হত; এক্সটেনশনের ইঞ্জিনিয়ারিং ক্ষমতা বড় মডেলেরওয়েট ট্রেনিংয়ের সাথে সম্পূর্ণভাবে বিচ্ছিন্ন ছিল; ক্লাউড-ভিত্তিক কম্পিউটিং এনভায়রনমেন্ট এবং বাহ্যিক স্ক্রিপ্টের উপর অত্যধিক নির্ভরশীলতার কারণে, এই উচ্চ-স্তরের ক্ষমতাগুলি এডজ-সাইড এডজ-এইচডি-তে ডিপ্লয় করা খুবই কঠিন।

এবং GPT-6 Astra এখন Harness-এর অসংখ্য ক্ষমতাকে মডেলের নিজস্ব ওজনে অন্তর্ভুক্ত করেছে। সিম্বলিক ওয়ার্ল্ড মডেলের পক্ষে সর্বদা অগ্রণী ছিলেন শীর্ষ পণ্ডিত গ্যারি মারকাস, তিনি GPT-6 Astra-কে এই পথের একটি বড় বিজয় হিসাবে প্রশংসা করেছেন।

গত দুই বছরে এই দিকে শিক্ষাগত ও শিল্প ক্ষেত্রে অসংখ্য মৌলিক অর্জন হয়েছে, হার্ভার্ড, MIT থেকে শুরু করে Google DeepMind পর্যন্ত, সবাই "সিম্বলিক ওয়ার্ল্ড মডেল"-এর উপর বিনিয়োগ করছে। AGI-এর দিকে যাওয়ার অসংখ্য শাখার মুখে, শিল্পটি একটি মৌলিক প্রযুক্তিগত সমঝোতায় পৌঁছাচ্ছে।

এত উচ্চ স্কোর, তাহলে AGI নিশ্চিত?

প্রশ্নকর্তা নিজেই শীতল পানি ঢেলে দিলেন

আকর্ষণীয় বিষয় হলো, সমগ্র ইন্টারনেট এই র‍্যাঙ্কিং স্কোরের জন্য উত্তেজিত হওয়ার সময়, অনেকেই OpenAI-এর প্রেসিডেন্ট গ্রেগ ব্রকম্যানের “AGI এসে গেছে” বাক্যটি শেয়ার করছিল, যখন ARC Prize ফান্ডেশনের প্রেসিডেন্ট গ্রেগ কামরাডট নিজেই ঠাণ্ডা পানি ঢেলে দিলেন।

তিনি প্রশ্ন তৈরি করার ক্ষেত্রে কেন্দ্রীয় ব্যক্তি, বেঞ্চমার্ক কীভাবে ডিজাইন করা হবে এবং স্কোর কীভাবে ব্যাখ্যা করা হবে, তাঁরই কথায় সবচেয়ে বেশি প্রভাব রয়েছে। মূল্যায়নের দৃষ্টিকোণ থেকে, তিনি মনে করেন যে স্কোরগুলি সত্যিকারের, কিন্তু এগুলি AGI-এর চেয়ে অনেক দূরে।

এখন পর্যন্ত, তিনি অনেক দলকে Agent Harness ব্যবহার করে ARC-AGI-3-এ 90% এর বেশি স্কোর পেতে দেখেছেন, যেমন অত্যন্ত শক্তিশালী মেমোরি এক্সট্রা সহ PRO-LONG, গভীর পূর্বানুমানে দক্ষ Tycho, এবং নিজের প্রোগ্রামিং পরিবেশকে স্বয়ংক্রিয়ভাবে উন্নত করতে পারে Prime Agent।

এই উচ্চ স্কোর প্রাপ্ত পণ্যগুলির সাধারণ প্রযুক্তিগত রেসিপি হল লস-লেস মেমোরি, প্রোগ্রামেটিক বিশ্লেষণ, স্পষ্ট অনুমান পরীক্ষা, ধারাবাহিক অবস্থা এবং কম খরচের অভ্যন্তরীণ গণনা এই পাঁচটি অংশ।

অক্ষত মেমোরি স্মৃতির জন্য দায়ী, প্রোগ্রামেটিক বিশ্লেষণ যুক্তির জন্য দায়ী, স্পষ্ট ধারণা পরীক্ষা অনুমানের জন্য দায়ী, টেকসই অবস্থা বহু-পর্যায়ের ইন্টারঅ্যাকশনের কনটেক্সটের জন্য দায়ী, কম খরচের অভ্যন্তরীণ গণনা সস্তা অভ্যন্তরীণ কম্পিউটিং ক্ষমতার জন্য দায়ী, যাতে AI ভার্চুয়াল পরিবেশে ভয়ঙ্করভাবে পরীক্ষা-নিরীক্ষা করে সঠিক উত্তর প্রদান করতে পারে। এগুলি একসাথে একটি অজেয় Harness গঠন করে, যা মডেলের নিজস্ব অপূর্ণতা পূরণ করবে।

GPT-6 Astra 100% পারফরম্যান্সের দিকে এগিয়ে যাচ্ছে, একই স্ট্যান্ডার্ড হারনেস ব্যবহার করে, এটি বিশেষভাবে কাস্টমাইজড “সাপ্লায়ার অ্যাডাপ্টার বেস” ব্যবহার করে কন্টিনিউয়াস ডায়ালগ এবং কনটেক্সট কমপ্রেশনের মাধ্যমে লজিক্যাল চেইনকে সমর্থন করে। প্রতিটি গেম পূর্ণ হওয়ার পর 360 ডলারের মূল্যবান কম্পিউটিং পাওয়ার খরচ হয়। যদি সম্পূর্ণ টেস্টটি সম্পন্ন করা হয়, তবে মোট কম্পিউটিং বিল 18,000 ডলার (প্রায় 1,35,000 চীনা ইয়ুয়ান) হবে!

একজন মানুষ একটি গ্রাফিক পাজল সমাধান করতে শুধু কয়েক মিনিট সময় নেয়, মানব মস্তিষ্কের 20W মেটাবলিক পাওয়ার অনুযায়ী বিদ্যুতের খরচ অর্ধেক সেন্টেরও কম; পরীক্ষার্থীদের প্রকৃত ঘন্টার বেতন প্রদান সহ গণনা করলে প্রতি খেলার খরচ হয় 12.78 ডলার, যেখানে AI-এর জন্য খরচ হয় 360 ডলার। এই “টাকার ক্ষমতা” দিয়ে অর্জিত ফলাফলগুলি কি সত্যিই সাধারণ মানুষের জন্য সহজলভ্য AGI-এর পথ হতে পারে?

অবশ্যই, GPT-6 Astra এখন হারনেসের ক্ষমতাগুলি ধীরে ধীরে অন্তর্ভুক্ত করছে, যদি এটি বিকাশ চালিয়ে যায়, তবে মডেলের অন্তর্নিহিত গণনা ক্ষমতা আরও বেশি শক্তিশালী হয়ে উঠবে। তবে, যেহেতু এর যুক্তিসম্পন্ন প্রক্রিয়াটি অস্পষ্ট হয়ে উঠছে, ডেভেলপাররা জানতে পারছেন না যে AI সত্যিই বুঝতে শুরু করেছে কিনা, নাকি এটি আরও দক্ষ প্রতারণার পথ খুঁজে পেয়েছে।

উপরের প্রশ্নে ফিরে যাই, GPT-6 Astra কি আসলে AGI?

এই প্রশ্নের উত্তরে, গ্রেগ কামরাডট তাঁর দীর্ঘ নিবন্ধের শেষে একটি দার্শনিক প্রতিক্রিয়া দিয়েছেন। মানুষকে কেন “সাধারণ বুদ্ধিমত্তা” হিসাবে বিবেচনা করা হয়, কারণ মানুষ যেকোনো অজানা বিশ্বের সাথে খাপ খাইয়ে নিতে পারে, এমনকি প্রাচীনকালের শিশুকে আধুনিক যুগে ফেলে দিলেও সে মেট্রো ব্যবহার করা এবং মোবাইল ফোন চালানো শিখে ফেলবে। এই বুদ্ধিমত্তা হাজার বছর ধরে অব্যাহত থাকে এবং প্রযুক্তির উন্নতির পথে এগিয়ে যায়। কিন্তু বর্তমানে প্রযুক্তি জগতের যে “পরীক্ষা”গুলি AI-এর জন্য আয়োজন করা হচ্ছে, সেগুলি শুধুমাত্র AI-এর জন্য “গ্রাফিক্স-বেসড ম্যাচ-থ্রি” পরীক্ষা।

এটি শুধু প্রমাণ করে যে এআই বুদ্ধিমান হয়ে উঠছে, কিন্তু এজিআই-এর আগমনের কোনো প্রমাণ নয়।

দাবিত্যাগ: এই পৃষ্ঠার তথ্য তৃতীয় পক্ষের কাছ থেকে প্রাপ্ত হতে পারে এবং অগত্যা KuCoin এর মতামত বা মতামত প্রতিফলিত করে না। এই বিষয়বস্তু শুধুমাত্র সাধারণ তথ্যগত উদ্দেশ্যে প্রদান করা হয়, কোন ধরনের প্রতিনিধিত্ব বা ওয়ারেন্টি ছাড়াই, বা এটিকে আর্থিক বা বিনিয়োগ পরামর্শ হিসাবে বোঝানো হবে না। KuCoin কোনো ত্রুটি বা বাদ পড়ার জন্য বা এই তথ্য ব্যবহারের ফলে যে কোনো ফলাফলের জন্য দায়ী থাকবে না। ডিজিটাল সম্পদে বিনিয়োগ ঝুঁকিপূর্ণ হতে পারে। আপনার নিজের আর্থিক পরিস্থিতির উপর ভিত্তি করে একটি পণ্যের ঝুঁকি এবং আপনার ঝুঁকি সহনশীলতা সাবধানে মূল্যায়ন করুন। আরও তথ্যের জন্য, অনুগ্রহ করে আমাদের ব্যবহারের শর্তাবলী এবং ঝুঁকি প্রকাশ পড়ুন।