Anthropic Fable 5.1 API আপডেট মডেল ডিস্টিলেশন ব্লক করে

icon MarsBit
শেয়ার
AI summary iconসারাংশ
অ্যানথ্রোপিক ফেবল 5.1 প্রকাশ করেছে, যা মডেল ডিস্টিলেশন বন্ধ করে দেয় এমন একটি প্রধান API আপডেট। এই আপডেটে ক্লাউডের যুক্তির অননুমোদিত নিষ্কাশন বন্ধ করতে কনটেক্সট চেক যোগ করা হয়েছে। পরিবর্তিত প্রম্পট ব্যবহারকারী ডেভেলপারদের ত্রুটি বা ব্লক সরিয়ে ফেলা হতে পারে। নিয়মগুলি ৩১ আগস্ট, ২০২৬-এর পরের নতুন অ্যাকাউন্টগুলির জন্য প্রযোজ্য। সংশ্লিষ্ট ব্যবহারকারীদের জন্য পারফরম্যান্স উন্নত হয়েছে। এই BTC আপডেট এবং ETH আপডেটটি মডেল সিকিউরিটির কঠোরতর প্রবণতার সাথে সঙ্গতিপূর্ণ।

বড় ডিস্টিলেশন যুগের শেষ হয়ে যাচ্ছে!

২ সেপ্টেম্বর, এনথ্রোপিক একটি শক্তিশালী হামলা চালিয়ে API নিয়মগুলি পুনর্লিখন করে, কার্যকরভাবে কভারড মডেল এবং ডিস্টিলেটরদের পিছনের পথ কেটে দেয়।

ক্লড

একসময়, অসংখ্য কোম্পানি বিশাল কম্পিউটেশনাল খরচ এবং দীর্ঘ প্রশিক্ষণ সময় এড়ানোর জন্য API ব্যবহার করে শীর্ষ মডেলগুলির ইনফারেন্স প্রক্রিয়া নিয়ে নিজেদের 'ছোট মডেল' প্রশিক্ষণ দিয়েছিল।

কিন্তু আজ থেকে এই সম্ভাবনা অবসান ঘটেছে।

ক্লড ফেবল 5.1 এর "থিংকিং ব্লক" পরিবর্তন নিষিদ্ধ

এনথ্রোপিক এই বার ফেবল 5.1 প্রকাশ করেছে, যাতে সবচেয়ে কঠোরতম ডিস্টিলেশন বিরোধী মেকানিজম চালু করা হয়েছে।

মূল কার্যটি হল সঠিকভাবে "চিন্তা ব্লক" লক করে রাখা।

“থিংকিং ব্লক” কী?

সহজ কথায়, এটি হল এআই যে প্রক্রিয়াটি চালায় যখন সে চূড়ান্ত উত্তরটি দেওয়ার আগে তার মস্তিষ্কে কোটি (CoT) চলে।

ক্লড

ক্লড মানসিক গণনা করার সময় জটিল, সমান্তরাল পথের মাধ্যমে চিন্তা করে

API কলে, Claude এই যুক্তিপূর্ণ ধাপগুলিকে «চিন্তা ব্লক» হিসাবে ব্যবহারকারীকে ফিরিয়ে দেয়।

সাধারণ বহু-প্রতিক্রিয়া সংলাপে, ডেভেলপাররা এই চিন্তার ব্লকগুলিকে সিস্টেম প্রম্পট, টুল এবং ইতিহাসের বার্তাগুলির সাথে পুনরায় Claude-এর কাছে পাঠায়, যাতে মডেলটি প্রসঙ্গটি মনে রাখতে পারে এবং সংলাপটির সামঞ্জস্যতা বজায় রাখতে পারে।

কিন্তু ঠিক এই মেকানিজমটিই ডিস্টিলেটরদের জন্য সুযোগ হয়ে দাঁড়াল।

তারা একটি বিশাল দুর্বলতা আবিষ্কার করেছে: একাধিক সংলাপের মধ্যে, চিন্তার ব্লকের আগে ও পরের প্রসঙ্গটি চুপিচুপি পরিবর্তন করে (যেমন প্রাথমিক সিস্টেম নির্দেশ বা ইতিহাসের বার্তাগুলি পরিবর্তন করে), ক্লাউডের প্রতিরোধ ব্যবস্থা ভাঙা যায়, এমনকি ক্লাউডকে তার মূলত লুকিয়ে রাখা নীচের ধারণা প্রক্রিয়াকরণের যুক্তি বের করতে উৎসাহিতও করা যায়!

ক্লড

ক্লড

এই অব্যবস্থার প্রতিক্রিয়ায়, Anthropic Fable 5.1-এ "কনটেক্সট কনসিসটেনসি ভেরিফিকেশন" নিয়ম চালু করেছে।

1. মূল পথে ফিরে যান, একটি অক্ষরও পরিবর্তন করবেন না: API এখন ক্লায়েন্ট দ্বারা ফেরত পাঠানো «চিন্তার ব্লক» যাচাই করবে যে এটি প্রথমে যে সিস্টেম প্রম্পট, টুল এবং ইতিহাসের বার্তাগুলি দ্বারা উৎপন্ন হয়েছিল তার সাথে সম্পূর্ণরূপে একই কিনা।

2. হস্তক্ষেপ করা হয়েছে? সরাসরি ত্রুটি দেখানো হবে! যদি সিস্টেম বুঝতে পায় যে কনটেক্সট পরিবর্তন করা হয়েছে, এমনকি একটি অক্ষরও পয়েন্ট সব মিল ব্যর্থ হবে, API সরাসরি ত্রুটি বার্তা ফেরত দেবে এবং সেবা অস্বীকার করবে।

এছাড়াও, যারা আসলে কনটেক্সট পরিবর্তন করার প্রয়োজন রাখেন (যেমন: খরচ কমানোর জন্য কনটেক্সটের দৈর্ঘ্য সংকুচিত করা), তাদের জন্য Anthropic একটি “নন-স্ট্রিক্ট মোড” প্রদান করে।

এই মোডে, আপনার অনুরোধটি গ্রহণযোগ্য হবে, কিন্তু সিস্টেম সম্পূর্ণভাবে "চিন্তার ব্লক" মুছে ফেলবে! মডেলটি আগের যুক্তিপূর্ণ প্রক্রিয়াটি দেখার সম্ভাবনা ছাড়াই জবাব দেবে।

এটি সত্যিই মূল কারণ থেকে সমস্যা সমাধানের উপায়।

ক্লড

যখন ক্লডকে একটি সহজ এবং একটি কঠিন প্রশ্ন জিজ্ঞাসা করা হয়, তখন বিশ্বস্ত যুক্তি এবং অবিশ্বস্ত (উদ্দেশ্যমূলক) যুক্তির উদাহরণ

ইন্ডাস্ট্রিয়াল গ্রেড ডিস্টিলেশন, এটা কতটা পাগলামি?

অ্যানথ্রোপিক এত বড় রাগ কেন করল, এত কঠোর সীমাবদ্ধতা কেন চাপিয়ে দিল?

উত্তরটি হল: এবং অত্যন্ত প্রয়োজনীয়।

বর্তমান অবৈধ ডিস্টিলেশনটি শিল্প স্তরে পরিণত হয়েছে।

গত বছরে, অ্যানথ্রোপিকের নিরাপত্তা দল ভয়ঙ্কর দুর্ব্যবহারের সন্ধান পেয়েছে।

এই পেশাদার 'ডিস্টিলেশন হ্যাকারদের' একটি অ্যাকাউন্ট দিয়ে প্রতিদিন কয়েকটি প্রশ্ন করে না, বরং হাজার হাজার কৃত্রিম অ্যাকাউন্ট ব্যবহার করে অটোমেশন স্ক্রিপ্টের মাধ্যমে অপরিচ্ছন্নভাবে API এন্ডপয়েন্টে 'অ্যাপ' সংগ্রহ করে।

ক্লড

তাদের অপারেশনের পদ্ধতি অত্যন্ত গোপনীয় এবং আক্রমণাত্মক।

আগের আলোচনায় বলা হয়েছে যে, যদিও Anthropic দ্বারা Claude-এর কোর থিংকিং ব্লকগুলির এনক্রিপশন ইতিমধ্যেই করা হয়েছিল, হ্যাকাররা "কনটেক্সট ইনজেকশন" এবং "ডায়ালগ রিওয়াইটিং" প্রযুক্তি ব্যবহার করেছে।

এটি ঠিক তেমনই, যেন ক্লডকে "হাইপনোটাইজ" করা হচ্ছে, যাতে এটি যুক্তিহীন অবস্থায় নিজের এনক্রিপ্টেড যুক্তিবিদ্যা প্রক্রিয়াটি ডিক্রিপ্ট করে মুদ্রণ করে ফেলে।

অতএব, অনেক ছোট প্যারামিটার মডেল শূন্য থেকে ক্যালকুলেশন শক্তি এবং অ্যালগরিদমের উদ্ভাবনের অভিজ্ঞতা লাভ করেনি, শুধুমাত্র শীর্ষস্থানীয় AI-এর উত্তর দেওয়ার কৌশল মুখস্থ করে পারফরম্যান্সের সমতুল্যতা অর্জন করেছে।

আরও ভয়াবহ বিষয় হলো, এই পদ্ধতিটি সরাসরি লাল রেখা ছুঁয়ে ফেলেছে এবং নিরাপত্তা ব্যবস্থার পতন ঘটিয়েছে।

এআইয়ের নিয়ন্ত্রণহীনতার সর্বাধিক বিপদ

যদি ব্যবসায়িক লাভের ক্ষতি শুধুমাত্র Anthropic-কে "কষ্ট দেয়", তবে "ক্ষমতা এবং নিরাপত্তার বিচ্ছিন্নতা" সমগ্র AI নিরাপত্তা সম্প্রদায়কে ভয় পায়।

এটিই এনথ্রোপিকের জন্য কঠোর ব্যবস্থা গ্রহণের মূল প্রেরণা।

পরিচিতভাবে, Claude, GPT-4 এর মতো বড় মডেলগুলি অত্যন্ত উচ্চ বুদ্ধিবৃত্তির সাথে সাথে অত্যন্ত কঠোর "মূল্যবোধ সমন্বয়" এবং নিরাপত্তা প্রশিক্ষণও পেয়েছে। তারা জানে যে তারা বোমা তৈরির পদ্ধতি শেখাতে পারবে না, ক্ষতিকারক র্যানসমওয়্যার লিখতে পারবে না, এবং ঘৃণামূলক মন্তব্য প্রকাশ করতে পারবে না।

এই «ক্ষমতা + নিরাপত্তা গার্ডরেল» দ্বৈত বন্ধনটি বড় AI কোম্পানিগুলি এআরএইচএফ এবং লাল-নীল প্রতিদ্বন্দ্বিতায় কয়েক মিলিয়ন ডলার খরচ করে তৈরি করেছে।

ক্লড

কিন্তু, ডিস্টিলেশন মডেলটি এই সুরক্ষা নেটটিকে পুরোপুরি এড়িয়ে গেল!

যখন ডিস্টিলেটররা প্রেক্ষাপট পরিবর্তন করে ক্লাউডের «চিন্তার ব্লক» বাধ্য করে নেয়, তখন তারা শুধু সেই উচ্চ বুদ্ধিমত্তার «যুক্তিবাদী ক্ষমতা» বের করে নেয়, কিন্তু নীচের সুরক্ষা ব্যবস্থা কখনই উত্তরাধিকারসূত্রে পায় না।

একটি দুষ্ট সংগঠনের মতো, যেটি আইনস্টাইনের বুদ্ধিমত্তা ক্লোন করেছে, কিন্তু আইনস্টাইনের নৈতিকতা এবং সহানুভূতি ক্লোন করেনি।

এই অবৈধ ডিস্টিলেশন পদ্ধতিতে প্রশিক্ষিত সিস্টেমগুলি অচেনা ভাবে তাদের আসলে থাকা উচিত না এমন উন্নত যুক্তি এবং কোডিং দক্ষতা অর্জন করে।

কিন্তু যেহেতু এগুলি নিজেদের ভিত্তি হিসাবে একটি «কম গ্যারান্টিযুক্ত, দুর্বল সুরক্ষা» মডেল, তাই এগুলি হ্যাকারদের অনুরোধে নির্দ্বিধায় নেটওয়ার্ক আক্রমণ স্ক্রিপ্ট তৈরি করতে বা জৈব অস্ত্রের উন্নয়নে সহায়তা করবে।

ক্ষমতা এবং নিরাপত্তার বিচ্ছিন্নতা হল বর্তমানে এআই-এর সবচেয়ে বড় ঝুঁকি।

নতুন নিয়ম কার্যকর: কারা প্রভাবিত হচ্ছেন?

এই আক্রমণটি বৈধ ডেভেলপারদের প্রভাবিত করবে কি?

ভয় পাবেন না, Anthropic সূক্ষ্ম পর্যায়ক্রমিক বাস্তবায়ন কৌশল অনুসরণ করছে যাতে অপ্রাসঙ্গিক ক্ষতি ন্যূনতম হয়।

প্রথমে, একটি নতুন অ্যাকাউন্ট।

ঔপনিবেশিক নথি অনুযায়ী, এই সীমাবদ্ধতা সর্বাধিক দুর্ব্যবহারের নতুন অ্যাকাউন্টগুলি থেকে শুরু হবে। Fable 5.1 মডেলের জন্য, এই আপডেটটি কেবলমাত্র 2026 সালের 31 আগস্ট 12:00:00 AM UTC-এর পরে তৈরি করা নতুন API অ্যাকাউন্টগুলিকে প্রযোজ্য।

নিম্নলিখিত ব্যক্তিদের জন্য, আপনারা সম্পূর্ণভাবে নিরাপদ, আপনাদের কোনও প্রভাব পড়েনি।

1. বিদ্যমান API অ্যাকাউন্ট: বিদ্যমান পুরানো অ্যাকাউন্টগুলি Fable 5.1-এ এখনও প্রভাবিত হয় না। এটি আইনগত ডেভেলপারদের সামঞ্জস্য করার জন্য যথেষ্ট সময় দেয়।

2. শেষ ব্যবহারকারী: আপনি যদি শুধুমাত্র ওয়েবসাইট ভার্সনের Claude.ai, Claude Code, Claude Cowork বা অন্যান্য অফিসিয়াল পণ্যের শেষ ব্যবহারকারী হন বা তৃতীয় পক্ষের প্রোডাক্টের মাধ্যমে স্বাভাবিকভাবে চ্যাট করেন, তাহলে আপনি কোনও বিঘ্নের সম্মুখীন হবেন না।

ক্লড

প্রভাবিত API ডেভেলপারদের জন্য আপনাকে কী মনোযোগ দিতে হবে?

যদি আপনার আগের অ্যাপ্লিকেশন ইন্টিগ্রেশনে আপনি কোনোভাবে “কথোপকথনের মধ্যে পূর্ববর্তী রাউন্ডগুলি পুনর্লিখন” করার পদ্ধতি ব্যবহার করেছেন (যেমন পরিস্থিতি সংকুচিত করার জন্য খরচ কমানো, অথবা কথোপকথনের মধ্যে নতুন সিস্টেম নোটিফিকেশন জোর করে যোগ করা), তাহলে আপনাকে তৎক্ষণাৎ আপনার কোড লজিক সামঞ্জস্য করতে হবে।

ক্লড

এই পরিবর্তনের জন্য অ্যানথ্রোপিক একটি সম্পূর্ণ মাইগ্রেশন গাইড প্রদান করেছে। ডেভেলপারদের দুটি বিকল্প রয়েছে।

একটি বিকল্প নির্বাচন করুন: প্রেক্ষাপটটি পুরোপুরি একই রাখুন। মূল চিন্তা ব্লক, সিস্টেম নির্দেশ এবং টুলগুলি এক অক্ষরও পরিবর্তন না করে পুনরায় পাঠান।

বিকল্প দুই: API রিকোয়েস্টে "নন-স্ট্রিক্ট মোড" সিলেক্ট করুন। এই মোডে, আপনি যদি কনটেক্সট পরিবর্তন করেন, তবুও API ত্রুটি দেখাবে না বা বন্ধ হবে না, বরং এটি স্বয়ংক্রিয়ভাবে এবং নিশ্চব্দে রিকোয়েস্টের প্রভাবিত থিংকিং ব্লকগুলি মুছে ফেলবে।

এটি পরবর্তী কথোপকথনে মডেলকে আগের বিশদ যুক্তি ভুলে যেতে বাধ্য করবে, তবে অন্তত আপনার কথোপকথন বা কাজটি বিচ্ছিন্ন হবে না।

এটি মনে রাখা প্রয়োজন: যদিও বর্তমানে এই নিয়মের জন্য ব্যতিক্রমের সময়কাল রয়েছে, অ্যানথ্রোপিক স্পষ্টভাবে ঘোষণা করেছে—「রিফ্লেকশন」 মেকানিজমটি ভবিষ্যতের মডেল সংস্করণগুলিতে সমস্ত অ্যাকাউন্টের জন্য প্রযোজ্য হবে!

বর্তমান বাফার উইন্ডোটি সীমিত।

অপ্রত্যাশিত সুখ: সৎ মানুষদের জন্য সুবিধা

এছাড়াও, এই নতুন নিয়মের পরে, আইনগত ডেভেলপারদের জন্য একটি সুবিধা লুকিয়ে আছে—খরচের ব্যাপক হ্রাস এবং প্রতিক্রিয়ার গতির বিপুল বৃদ্ধি।

এটা কিভাবে সম্ভব?

মূল বিষয় হলো "কনটেক্সট কনসিসটেনসি"।

গতকাল, ডেভেলপারদের প্রসঙ্গ যেকোনোভাবে পরিবর্তন করার সুযোগ ছিল, যার ফলে মডেলটি প্রতিবার একটি "নতুন" অনুরোধ পেয়েছিল। এটি শুধুমাত্র কম্পিউটিং ক্ষমতা ব্যয় করেছিল, বরং এটি অত্যন্ত ধীর ছিল।

এখন, নতুন নিয়ম সবাইকে «চিন্তা ব্লক» এবং এর চারপাশের সিস্টেম প্রম্পট, ইতিহাসের বার্তা সম্পূর্ণরূপে একই রাখতে বাধ্য করে, এগুলি পরিবর্তন করা যাবে না।

এটি প্রযুক্তিগতভাবে একটি আদর্শ পরিস্থিতি তৈরি করে: প্রম্পট ক্যাশে অত্যন্ত উচ্চ ফ্রিকোয়েন্সিতে হিট করতে পারে!

এখন, API সার্ভার আগের কথোপকথনের প্রেক্ষাপটকে সহজেই ক্যাশে করতে পারে। যখন পরবর্তী কথোপকথনের অনুরোধ আসে, তখন সিস্টেম ক্যাশে থেকে ডেটা সরাসরি আনে এবং মিলিয়ে ফেলে।

ফলাফল হলো: API-এর রেসপন্স টাইম অনেক কমে গেছে, ল্যাটেন্সি সরাসরি কমে গেছে, এবং ডেভেলপারদের API কল খরচও উল্লেখযোগ্যভাবে কমে গেছে!

এই "অনিচ্ছাকৃতভাবে গাছ লাগানো" কৌশলটি সততা নিয়ে কাজ করা ডেভেলপারদের প্রকৃত সোনার-পয়সা দিয়ে সাবসিডি প্রদান করেছে।

সর্বসাধারণভাবে, এই নতুন নিয়মগুলি সম্পূর্ণ এআই শিল্পের জন্য একটি মilestone হয়ে উঠেছে।

ছোট প্যারামিটারের হামলায় বড় মডেলের গল্প কম হবে।

প্রবাহ চলে যাওয়ার পর, কে নগ্ন ভাবে সাঁতার কাটছে?

প্রসঙ্গ:

https://support.claude.com/zh-CN/articles/16761192-%E4%BF%9D%E7%95%99%E6%80%9D%E8%80%83-%E6%94%B9%E5%8F%98messages-api%E5%A4%84%E7%90%86%E6%80%9D%E8%80%83%E5%9D%97%E7%9A%84%E6%96%B9%E5%BC%8F%E4%BB%A5%E9%98%B2%E6%AD%A2%E8%92%B8%E9%A6%8F

সম্পাদনা: এনিয়াস

এই লেখাটি ওয়েইচ্যাট গ্রুপ "নিউজিয়ুয়ান" (ID: AI_era) থেকে এসেছে, লেখক: ASI প্রতিজ্ঞা

দাবিত্যাগ: এই পৃষ্ঠার তথ্য তৃতীয় পক্ষের কাছ থেকে প্রাপ্ত হতে পারে এবং অগত্যা KuCoin এর মতামত বা মতামত প্রতিফলিত করে না। এই বিষয়বস্তু শুধুমাত্র সাধারণ তথ্যগত উদ্দেশ্যে প্রদান করা হয়, কোন ধরনের প্রতিনিধিত্ব বা ওয়ারেন্টি ছাড়াই, বা এটিকে আর্থিক বা বিনিয়োগ পরামর্শ হিসাবে বোঝানো হবে না। KuCoin কোনো ত্রুটি বা বাদ পড়ার জন্য বা এই তথ্য ব্যবহারের ফলে যে কোনো ফলাফলের জন্য দায়ী থাকবে না। ডিজিটাল সম্পদে বিনিয়োগ ঝুঁকিপূর্ণ হতে পারে। আপনার নিজের আর্থিক পরিস্থিতির উপর ভিত্তি করে একটি পণ্যের ঝুঁকি এবং আপনার ঝুঁকি সহনশীলতা সাবধানে মূল্যায়ন করুন। আরও তথ্যের জন্য, অনুগ্রহ করে আমাদের ব্যবহারের শর্তাবলী এবং ঝুঁকি প্রকাশ পড়ুন।