২০২৬ সালের জুলাইয়ে, কিছু ব্যবহারকারী গুগল সাইট অনুসন্ধান সিনট্যাক্স ব্যবহার করে ক্লাউডের ব্যবহারকারীদের শেয়ার করা কথোপকথনের রেকর্ড ব্যাচ প্রক্রিয়াকরণ করতে সক্ষম হন। কারণটি হল ক্লাউডের শেয়ারিং ফাংশনটি গোপনীয় লিঙ্কের পরিবর্তে পাবলিক ওয়েবপেজ তৈরি করে, যদিও পেজটিতে robots.txt প্রতিরোধ ছিল, কিন্তু noindex মেটা ট্যাগটি অনুপস্থিত ছিল, যার ফলে সার্চ ইঞ্জিনগুলি পেজের URL এবং কনটেন্ট উভয়ই ইনডেক্স করে। অনুসন্ধানের ফলাফলগুলিতে ব্যবহারকারীদের ক্রিপ্টোকারেন্সি ওয়ালেট কী, সামাজিক নিরাপত্তা নম্বরসহ সংবেদনশীল তথ্যগুলি পাওয়া যায়। বর্তমানে Anthropic জরুরিভাবে সমস্যাটি সমাধান করেছে, noindex ট্যাগটি যোগ করে আরও ইনডেক্সিং বন্ধ করেছে। এই সমস্যা এককেরও নয়; OpenAI-এর ChatGPT এবং xAI-এর Grok-এও আগেই একইভাবের গোপনীয়তা দুর্বলতা দেখা গিয়েছিল।লেখক এবং উৎস: লেইফেঙ্গোয়েন

এনক্রিপ্টেড ক্রিপ্টোকারেন্সি প্রাইভেট কী থেকে শুরু করে পরিচয়ের তথ্য পর্যন্ত, রেডিট এখন অন্যদের প্রতি দেখার একটি উৎসবে পরিণত হয়েছে।
এমবডিড ইন্টেলিজেন্স, ধোঁয়াশায় ভরা রান্নাঘরে প্রবেশ করছে
মিলিয়ন ট্রাফিকের অধীনে রোবটের চাকরি
পূর্ব কোভেরিয়ান এআই-এর উপাধ্যক্ষ এবং জুয়ানপু ডেটা-এর সিটিও ডা. মু ওয়েই প্রতিষ্ঠানটির সিটিও হিসেবে যোগদান করেছেন।
প্রতিষ্ঠাতা দল সম্প্রতি প্রকাশিত হয়েছে, এবং এই ফিজিক্যাল এআই স্টার্টআপের ফান্ডিং এবং শেয়ারহোল্ডার অবস্থানও প্রকাশিত হয়েছে।
Beta Infinity ট্রিলিয়ন ডলারের কনজুমার রোবোটিক্সের অন্বেষণ করবে।
26 বছর শরীরবাদী বুদ্ধিমত্তার জন্য হলো 23 বছর বড় ভাষা মডেলের জন্য।
২০২৬ সালের ২৬ জুলাই, একজন রেডিট ব্যবহারকারী সম্প্রদায়ে পোস্ট করেন যে, গুগল সাইট অনুসন্ধান সিনট্যাক্স site:claude.ai/share ব্যবহার করে হাজার হাজার ক্লাউড ব্যবহারকারীর শেয়ার করা কথোপকথনের রেকর্ড ব্যাচ হিসেবে পুনরুদ্ধার করা যায়।
ক্লেড এ ব্যবহারকারী "শেয়ার" বোতামে ক্লিক করার পর, সিস্টেম শুধুমাত্র নির্দিষ্ট পাঠকদের জন্য সীমাবদ্ধ গোপন লিঙ্কের পরিবর্তে লগইন বা পরিচয় যাচাইয়ের প্রয়োজন ছাড়াই একটি পাবলিক ওয়েবপেজ তৈরি করে।
এই ধরনের পৃষ্ঠা এবং ইন্টারনেটের সাধারণ ওয়েবসাইটের পৃষ্ঠার মধ্যে কোনও মৌলিক পার্থক্য নেই, এগুলি সার্চ ইঞ্জিন ক্রলার দ্বারা স্ক্র্যাপ এবং ইনডেক্স করার জন্য উপযুক্ত। তবে, শেয়ারিং ফাংশন ব্যবহার করেছে এমন অধিকাংশ ব্যবহারকারী কখনও সংশ্লিষ্ট ঝুঁকির সতর্কবার্তা পাননি।
পোস্টটি প্রকাশের পর দ্রুত বিদেশি সোশ্যাল মিডিয়ায় ছড়িয়ে পড়ে, "শেয়ার করলেই প্রকাশ্য" মechanism-এর বিতর্ক তীব্রতর হচ্ছে, এবং জনসাধারণের প্রত্যাশার চেয়ে অনেক বেশি গোপনীয়তা লঙ্ঘনের কেসগুলি ধারাবাহিকভাবে সামনে আসছে।

আরও বেশি মানুষ অনুসন্ধানে যোগ দেওয়ার সাথে সাথে কিছু অত্যন্ত নাটকীয় মামলা উদ্ধার করা হয়েছে। একসময়, অন্যান্য ইন্টারনেট ব্যবহারকারীদের চ্যাট রেকর্ড খোঁজা সম্প্রদায়ের একটি বড় আনন্দের বিষয় হয়ে উঠেছিল। মানুষ অন্যান্য ব্যবহারকারীদের ব্যক্তিগত তথ্য খুঁজছিল, কখনও কখনও আলোচনা করছিল এবং অবাক হচ্ছিল, এবং এটির সাথে আনন্দিত হচ্ছিল।

প্রাপ্ত তথ্যের মধ্যে দুটি ধরনের তথ্যের ঝুঁকি সবচেয়ে বেশি।
একটি হল ক্রিপ্টো সম্পদের তথ্য। কেউ একজন ব্যবহারকারীর ওয়ালেট এবং পাসওয়ার্ড খুঁজে পেয়েছিল। অনলাইন ব্যবহারকারীরা চ্যাট হিস্ট্রি অনুসরণ করে সংশ্লিষ্ট ওয়ালেটটি খুঁজে পেয়েছিলেন, যার মধ্যে মাত্র 2.73 ডলার ব্যালেন্স ছিল। আরও হাস্যকর বিষয় হল, একজন ভালোমানুষ অনলাইন ব্যবহারকারী ব্যবহারকারীকে তাঁর কী প্রকাশিত হওয়ার বিষয়ে সতর্ক করতে চেয়েছিলেন, কিন্তু তিনি সম্পূর্ণ কথোপকথনটি খুঁজেও কোনও যোগাযোগের তথ্য পাননি—এখনও সম্ভবত ব্যবহারকারীটি জানেননা যে তাঁর ওয়ালেটের কীটি এইভাবে সম্পূর্ণ ওয়েবের জন্য প্রকাশিত হয়েছে।

দ্বিতীয়টি হল মূল পরিচয়ের তথ্য। কিছু ব্যবহারকারী নিশ্চিত করেছেন যে তাদের অনুসন্ধানের ফলাফলে সামাজিক নিরাপত্তা সংখ্যা (SSN) সহ পূর্ণাঙ্গ কথোপকথন পাওয়া গেছে। এই ধরনের তথ্য যদি কালো বাজারে চলে যায়, তবে এটি সরাসরি পরিচয় চুরি, আর্থিক প্রতারণা ইত্যাদির মতো বাস্তবিক ক্ষতির কারণ হতে পারে।

এছাড়াও, অনুসন্ধান করা কনটেন্টগুলির মধ্যে রয়েছে প্রমাণিত পেশাদারদের প্রকল্প নথি, আইনি পরামর্শের কথোপকথন, ব্যক্তিগত চাকরির রিজিউমে, প্রাপ্তবয়স্কদের জন্য কনটেন্ট ইত্যাদি বিভিন্ন ধরনের গোপনীয় তথ্য। ছোট পরিসরে শেয়ার হওয়ার জন্য উপযুক্ত ব্যক্তিগত কনটেন্টগুলি এখন বিনা বাধায় পাবলিক সার্চ ইঞ্জিনের ইনডেক্সে চলে এসেছে।
কেন robots.txt ইনডেক্সিং বন্ধ করতে পারছে না?
ঘটনাটি বড় হওয়ার পর, একজন সতর্ক ইন্টারনেট ব্যবহারকারী ক্লডের robots.txt ফাইল খুঁজে পান, যেখানে স্পষ্টভাবে উল্লেখ করা হয়েছে Disallow: /share/*, অর্থাৎ নিয়ম অনুযায়ী /share পথের উপর ডাটা সংগ্রহকারী প্রোগ্রামের অ্যাক্সেস নিষিদ্ধ।

যেহেতু পরিষ্কার নিয়ম আছে, তবে কেন সংলাপটি সার্চ ইঞ্জিনে সংগ্রহ করা হল? এটিই এই ঘটনার সবচেয়ে গুরুত্বপূর্ণ প্রযুক্তিগত বিস্তার।
এই সমস্যাটি পরিষ্কার করতে, প্রথমে দুটি ধারণা পার্থক্য করতে হবে: স্ক্র্যাপিং এবং ইনডেক্সিং:
robots.txtএর কাজ হলো ক্রলারদের সাথে চুক্তি করা: এই পথের পৃষ্ঠার কনটেন্ট অ্যাক্টিভলি গ্রাব করবেন না। এটি শুধুমাত্র ওয়েবসাইটের অভ্যন্তরীণ লিঙ্কের মাধ্যমে ক্রলারদের সক্রিয়ভাবে ক্রল করার কাজকে বাধা দিতে পারে, কিন্তু এটির কোনো বাধ্যবাধকতা নেই, এবং সার্চ ইঞ্জিনগুলিকে URL-টিকেই সার্চ রেজাল্টে যোগ করতে বাধা দিতে পারে না।- সার্চ ইঞ্জিন একটি লিঙ্ক খুঁজে পায়, এবং আরেকটি পথ রয়েছে: বাহ্যিক পাবলিক ওয়েবপেজের আউটবাউন্ড লিঙ্ক থেকে খুঁজে পাওয়া। যতক্ষণ কোনও ব্যবহারকারী Claude-এর শেয়ার লিঙ্কটি Reddit, X, পাবলিক ফোরাম, GitHub ডকুমেন্ট ইত্যাদি যেকোনও ক্রলার-অ্যাক্সেসযোগ্য পাবলিক পেজে শেয়ার করবে, গুগল সেই পেজটি ক্রল করার সময় সেই /share লিঙ্কটি খুঁজে পাবে।
যদিও robots.txt পেজের বডি স্ক্র্যাপিং থেকে বাধা দেয়, গুগল এই URL টি সার্চ রেজাল্টে ইন্ডেক্স করে, শুধুমাত্র পেজের সারাংশ প্রদর্শন করে না। পেজটিকে সম্পূর্ণভাবে সার্চ রেজাল্ট থেকে বাদ দেওয়ার জন্য প্রকৃতপক্ষে HTML-এর মধ্যে noindex মেটা ট্যাগটি প্রয়োজন, যা সরাসরি সার্চ ইঞ্জিনকে নির্দেশ দেয়: এই পেজটিকে ইন্ডেক্স ব্যাঙ্কে অন্তর্ভুক্ত করবেন না।
ঘটনার সময়, ক্লডের সমস্ত শেয়ার করা পৃষ্ঠাগুলিতে এই গুরুত্বপূর্ণ noindex কনফিগারেশনটি অনুপস্থিত ছিল। প্ল্যাটফর্মটি কেবল robots.txt-এর উপর নির্ভর করে অর্ধেক সুরক্ষা প্রদান করেছিল, বাস্তবিকভাবে কার্যকরী ইনডেক্সিং প্রতিরোধ মেকানিজমের অভাব ছিল। সম্প্রদায়ের ব্যবহারকারীদের অনুসন্ধানের মাধ্যমে পাওয়া যায় যে, 2025 সালের সেপ্টেম্বরে ক্লডের একটি ছোট পরিসরের অনুরূপ ইনডেক্সিং ঘটনা ঘটেছিল, যখন গুগল আনুমানিক 600-এরও কম কথোপকথনকে ইনডেক্স করে তা সরিয়ে ফেলেছিল, তবে প্ল্যাটফর্মটিকে সম্পূর্ণভাবে সুরক্ষা কনফিগারেশনগুলি পূরণের জন্য উত্সাহিত করা হয়নি।

এই ইভেন্টের আরেকটি সমস্যা হলো, এই র্যান্ডম UUID দিয়ে তৈরি শেয়ার লিঙ্কগুলি গুগল কিভাবে খুঁজে পেল?
কিছু ব্যবহারকারী প্রকাশ্য ফোরাম, সোশ্যাল মিডিয়া প্ল্যাটফর্ম, ওপেন সোর্স প্রজেক্ট ডকুমেন্টেশন ইত্যাদি স্ক্র্যাপার দ্বারা অ্যাক্সেসযোগ্য প্রকাশ্য পৃষ্ঠায় শেয়ার লিঙ্ক পোস্ট করেছিলেন, যার ফলে গুগল এই পৃষ্ঠাগুলি স্ক্র্যাপ করার সময় সংশ্লিষ্ট /share লিঙ্কগুলি একসাথে খুঁজে পেয়েছে।
অন্যান্য ব্যবহারকারীরা প্রস্তাব করেছেন যে গুগলের কমিউনিকেশন পণ্যগুলি যেমন Gmail, Google Chat এটির লিঙ্কের একটি সম্ভাব্য উৎস হতে পারে। তবে এই অনুমানটি শুধুমাত্র সম্প্রদায়ের অনুমান, এখনও এটির কোনো প্রমাণ নেই।

এই ঘটনার জন্য, Anthropic প্রতিক্রিয়া হিসাবে জরুরি প্রতিকার ব্যবস্থা নিয়েছে। ব্যবহারকারীদের পরীক্ষায় দেখা গেছে যে, site:claude.ai/share কমান্ড চালানোর ফলে গুগল এখন "মিলনকারী কোনো ডকুমেন্ট পাওয়া যায়নি" ফলাফল দেখাচ্ছে। বাইরের বিশ্লেষকদের মতে, প্ল্যাটফর্মটি সমস্ত শেয়ার করা সেশন পেজে noindex ট্যাগ যোগ করে নতুন ইনডেক্সিংয়ের প্রতিরোধ করেছে।
কিন্তু সংশোধনের মধ্যে প্রাকৃতিক বিলম্ব রয়েছে: বিং, ব্রেভ ইত্যাদি অন্যান্য সার্চ ইঞ্জিনগুলির ক্যাশ আপডেটের স্বতন্ত্র চক্র রয়েছে, এবং ইতিমধ্যে স্ক্র্যাপ করা ইতিহাসের পৃষ্ঠাগুলির ক্যাশ তাৎক্ষণিকভাবে মুছে ফেলা হবে না।

OpenAI এবং Grok-এর গোপনীয়তা ব্যতিক্রম
বাস্তবে, এই ধরনের ইনডেক্স কনফিগারেশন সমস্যা শুধুমাত্র Anthropic-এর জন্য নয়।
কয়েক বছর আগে, ChatGPT-এর শেয়ার করা কথোপকথন ফিচারটি সম্পূর্ণ একই প্রাইভেসি ডিজাইন সমস্যার সম্মুখীন হয়েছিল। ঘটনার পর OpenAI দ্রুত পৃষ্ঠার noindex কনফিগারেশন পূরণ করেছিল এবং শেয়ারিং পপ-আপে ঝুঁকির সতর্কবার্তা যোগ করেছিল, তবে এর শেয়ারিং মেকানিজমের মূল ডিজাইনটি অপরিবর্তিত রয়েছে।


এখন এনথ্রোপিকে একই ধরনের সমস্যা দেখা দিয়েছে, যা মূলত দুটি শীর্ষস্থানীয় ফির্ম একই সুরক্ষা ডিজাইন ধারণা ব্যবহার করার ফলে।
একই প্রতিযোগিতামূলক ক্ষেত্রের Grok ও একই ধরনের সমস্যায় পড়েছিল। 2025 সালে, Grok প্ল্যাটফর্মের লক্ষ লক্ষ শেয়ার করা কথোপকথন গুগল দ্বারা ব্যাচ পদ্ধতিতে সংগ্রহ করা হয়েছিল, যা একই পরিমাণের গোপনীয়তা বিবাদের সৃষ্টি করেছিল।
দুর্ঘটনার পর, xAI আর্কিটেকচার স্তরে একাধিক স্তরের প্রাক-সুরক্ষা স্থাপন করেছে, যেমন সমস্ত শেয়ার পেজে noindex ট্যাগ বাধ্যতামূলকভাবে যোগ করা হয়েছে এবং সম্পূর্ণ ওয়েবসাইটের robots.txt ক্রলিং নিয়মগুলি একসাথে কঠোর করা হয়েছে; দুটি সুরক্ষা একসাথে বাস্তবায়িত হয়েছে, যা ক্রলিং এবং ফলাফল সংগ্রহ উভয় ধাপেই স্পষ্ট সীমাবদ্ধতা নির্ধারণ করেছে।
এই সমাধানের মূল সুবিধা হলো সুরক্ষা ব্যবস্থা ব্যবহারকারীর ব্যবহারের অভ্যাসের উপর নির্ভর করে না, বরং এটি আগে থেকেই প্রয়োগ করা হয়। তবে সমগ্র শিল্পের দৃষ্টিকোণ থেকে দেখলে, এই ধরনের সমস্যাগুলির মৌলিক ডিজাইন যুক্তি এখনও সাধারণভাবে সংশোধন করা হয়নি।
কিভাবে ইন্ডেক্স কনফিগারেশন এবং শেয়ারিং ডিজাইনের সীমাবদ্ধতা পূরণ করবেন
OpenAI এবং Anthropic-এ পুনরাবৃত্তি হওয়া এই ধরনের ভুলগুলি সম্প্রদায়কে শিল্পের সাধারণ পণ্য ডিজাইন চিন্তাভাবনার প্রতি পুনর্বিচারের জন্য উদ্বুদ্ধ করেছে।
কথোপকথন শেয়ার ফাংশনটি কন্টেন্ট প্রচারে সহায়তা করে এবং পণ্যের বৃদ্ধিকে উৎসাহিত করে, তাই প্রস্তুতকারকরা সাধারণত ব্যবহারের অভিজ্ঞতা নিশ্চিত করাকে অগ্রাধিকার দেয়; তবে রিভার্স ইনডেক্সিং, গ্রেডেড পারমিশন এর মতো গোপনীয়তা সুরক্ষা পদ্ধতিগুলি প্রায়শই সুরক্ষা দুর্ঘটনা ঘটে, প্রচারণা বাড়ার পরেই অস্থায়ী প্যাচের মাধ্যমে দ্রুত যোগ করা হয়।
অনেক ব্যবহারকারী আলোচনায় দাবি করেছেন যে প্ল্যাটফর্মটিকে একটি আরও সম্পূর্ণ সুরক্ষা ব্যবস্থা নির্মাণ করা উচিত। সাধারণ ব্যবহারকারীদের বেশিরভাগই noindex, ওয়েবস্ক্র্যাপার ক্যাশে এই ধরনের ওয়েব প্রযুক্তি সম্পর্কে অজানা, তাই লিঙ্ক শেয়ার করার অন্তর্নিহিত ঝুঁকি বুঝতে পারেন না।
পণ্য প্রযুক্তির দৃষ্টিকোণ থেকে, বর্তমানে সম্ভাব্য অপ্টিমাইজেশন কৌশলগুলি পরিপক্ক এবং বাস্তবায়ন খরচ নিয়ন্ত্রিত, যার মধ্যে সবচেয়ে মৌলিক স্তরটি হল noindex শেয়ারিং পেজের ডিফল্ট কনফিগারেশন হিসাবে সেট করা, যাতে সার্চ ইঞ্জিনের ইনডেক্সিংয়ের পথ থেকে বাধা দেওয়া যায়।
এর উপর ভিত্তি করে, লগইন অ্যাক্সেস যাচাই যোগ করে, ব্যবহারকারীকে লিঙ্কের জন্য অ্যাক্সেস পাসওয়ার্ড সেট করতে এবং কাস্টমাইজড বৈধ সময়কাল নির্ধারণের সুযোগ দিয়ে ঝুঁকি আরও সীমিত করা যায়, যাতে শেয়ারিংয়ের পরিসর এবং সময়কাল আরও নিয়ন্ত্রিত হয়।
শেয়ার অপারেশনের পাশে সরাসরি ঝুঁকির প্রতিবেদন দিন, জটিল শব্দ ব্যবহার না করে সরাসরি বলুন যে লিঙ্কটি সার্চ ইঞ্জিনে সংগ্রহ করা যেতে পারে, যাতে ব্যবহারকারীরা ক্লিক করার আগে এর প্রকাশ্য প্রকৃতি সম্পর্কে স্পষ্ট ধারণা পান।
এই সংশোধনগুলি পণ্যের আর্কিটেকচারকে বড় পরিমাণে পরিবর্তন করার প্রয়োজন নেই, কিন্তু ব্যবহারকারীদের গোপনীয়তা প্রত্যাশা এবং পণ্যের বাস্তব কার্যপ্রণালীর মধ্যে ব্যবধান কমিয়ে আনতে পারে।


