Pada Julai 2026, pengguna mendapati bahawa sintaks carian laman web Google boleh digunakan untuk mengambil rekod perbualan yang dikongsi oleh pengguna Claude secara beramai-ramai. Punca masalahnya ialah fungsi kongsi Claude menghasilkan laman web awam, bukan pautan peribadi; walaupun laman tersebut dilindungi oleh robots.txt, ia kekurangan meta tag noindex yang penting, menyebabkan enjin carian mengindeks URL dan kandungan laman tersebut. Hasil carian mengandungi maklumat sensitif seperti kunci dompet kripto pengguna dan nombor keselamatan sosial. Kini, Anthropic telah membaiki masalah ini secara segera dengan menambahkan tag noindex untuk menghalang pengindeksan lanjutan. Masalah ini bukanlah kes terasing; OpenAI's ChatGPT dan xAI's Grok sebelum ini juga mengalami lubang privasi yang sama sepenuhnya.Penulis artikel, sumber: Leifengwang

Dari kunci peribadi kripto hingga maklumat identiti, Reddit sedang menjadi pusat perayaan memata-matai orang lain.
Artificial intelligence embodied, infiltrating the greasy kitchen
Kisah robot bekerja di bawah laluan sejuta
Dr. Mu Wei, bekas Naib Presiden Covariant AI dan CTO Zhoupu Data, dilantik sebagai CTO «Shu Tu Technology».
Pasukan pengasas baru sahaja diperkenalkan, dan pendanaan serta senarai pemegang saham syarikat rintisan AI fizikal ini turut terbongkar.
Beta Infinity akan menargetkan pasaran biru robot pengguna akhir bernilai trilion.
26 tahun bagi kecerdasan berbadan adalah seperti 23 tahun bagi model bahasa besar.
26 Julai 2026, seorang pengguna Reddit memposting di komuniti bahawa dengan menggunakan sintaks carian laman web Google site:claude.ai/share, seseorang boleh memanggil ribuan rekod perbualan yang dikongsi oleh pengguna Claude.
Selepas pengguna mengklik butang "Kongsi" di Claude, sistem akan menghasilkan laman web awam yang tidak memerlukan log masuk atau pengesahan identiti, bukan pautan peribadi yang hanya boleh diakses oleh pihak tertentu.
Laman jenis ini tidak berbeza secara asas daripada laman biasa di internet, dan memenuhi syarat untuk dirayap dan direkodkan oleh crawler enjin carian. Namun, kebanyakan pengguna yang pernah menggunakan fungsi kongsi tidak pernah menerima amaran risiko berkaitan.
Post tersebut dengan cepat menjadi viral di platform media sosial luar negara, perdebatan mengenai reka bentuk mekanisme "bahagikan untuk mendedahkan" terus meningkat, dan banyak kes kebocoran privasi yang melampaui jangkaan awam turut muncul berturut-turut.

Semakin ramai yang menyertai pencarian, beberapa kes yang sangat dramatis telah ditemui. Pada satu masa, mencari rekod perbualan pengguna lain menjadi keseronokan utama dalam komuniti. Orang-orang mencari privasi pengguna lain, sering membincangkan dan memikirkan dengan penuh perhatian, serta terus menikmatinya.

Dua jenis maklumat dalam hasil carian mempunyai risiko paling ketara.
Satu ialah maklumat aset kripto. Sesetengah orang berjaya mencari dompet dan kata laluan seorang pengguna. Pengguna internet mengikuti catatan perbualan untuk mencari dompet yang berkaitan, yang hanya mempunyai baki sebanyak $2.73. Lebih lucu lagi, pengguna internet yang baik hati ingin memperingatkan pengguna tersebut bahawa kunci mereka bocor, tetapi setelah menyemak seluruh perbualan, mereka tidak dapat menemui sebarang maklumat hubungan. Pengguna ini mungkin masih tidak sedar bahawa kunci dompet mereka telah diungkapkan secara global dengan cara ini.

Kedua ialah maklumat identiti utama. Seorang pengguna telah mengesahkan bahawa mereka menemui perbualan lengkap yang mengandungi nombor keselamatan sosial (SSN) dalam keputusan carian. Maklumat sebegini, sekiranya masuk ke tangan industri gelap, boleh menyebabkan kehilangan identiti, penipuan kewangan, dan kerosakan nyata.

Selain itu, kandungan yang ditemui juga merangkumi dokumen projek pelaku yang telah mengesahkan identiti, perbualan perkhidmatan perundangan, resume kerjaya peribadi, kandungan dewasa, dan pelbagai jenis maklumat peribadi lain. Banyak kandungan peribadi yang sepatutnya hanya diedarkan dalam lingkungan kecil, kini masuk ke dalam indeks enjin carian awam tanpa sebarang penghalang.
Mengapa robots.txt tidak dapat menghalangi pengindeksan?
Selepas peristiwa itu membesar, seorang pengguna yang teliti menemui fail robots.txt Claude, yang secara jelas menyatakan Disallow: /share/*, iaitu peraturan melarang robot merayapi laluan /share.

Dengan adanya peraturan yang jelas, mengapa perbincangan masih dirakam oleh enjin carian? Ini adalah butiran teknikal paling penting dalam insiden ini.
Untuk memperjelas masalah ini, pertama-tama perlu membezakan dua konsep: pengambilan dan pendaftaran:
robots.txtberfungsi untuk bersepakat dengan crawler: jangan secara aktif mengambil kandungan halaman di bawah laluan ini. Ia hanya boleh menghalang crawler daripada secara aktif menggali halaman melalui pautan dalaman laman web, tetapi tidak mempunyai kuasa memaksa, dan tidak boleh menghalang enjin carian memasukkan URL itu sendiri ke dalam keputusan carian.- Mesin carian menemui satu pautan, serta satu laluan lain: melalui pautan luar dari halaman awam luar. Selagi pengguna berkongsi pautan Claude ke Reddit, X, forum awam, dokumen GitHub, atau sebarang halaman awam yang boleh diakses oleh crawler, Google akan menemui pautan /share semasa meng-crawl halaman tersebut.
Walaupun robots.txt melarang crawler membaca isi halaman, Google masih akan memasukkan URL ini ke dalam hasil carian, hanya sahaja tidak menunjukkan ringkasan halaman. Yang benar-benar boleh menjadikan halaman itu tidak masuk ke dalam hasil carian sama sekali ialah tag meta noindex dalam HTML halaman, yang secara langsung mengarahkan enjin carian: jangan masukkan halaman ini ke dalam pangkalan data indeks.
Pada masa kejadian, semua halaman berkongsi Claude secara tepat kehilangan konfigurasi noindex yang penting ini. Platform hanya melakukan perlindungan separuh jalan melalui robots.txt, tanpa mekanisme anti-pengindeksan yang berkesan. Menurut penelusuran pengguna komuniti, pada September 2025, Claude pernah mengalami kejadian pengindeksan sejenis dalam skala kecil, di mana Google menganggarkan bahawa kurang daripada 600 perbualan telah diindeks dan kemudian dikeluarkan, tetapi ia tidak mendorong platform untuk melengkapkan sepenuhnya konfigurasi perlindungan.

Masalah lain dalam peristiwa ini ialah, bagaimanakah Google menemui pautan kongsi yang terdiri daripada UUID rawak?
Seorang pengguna menyatakan dengan jelas bahawa kemungkinan untuk menebak secara kasar miliaran kombinasi aksara hampir mustahil, dan laluan utama pastinya melalui pautan luar. Teori utama ialah, sebahagian pengguna telah mempublikasikan pautan perkongsian di forum awam, platform sosial, dokumen projek sumber terbuka, dan halaman awam lain yang boleh diakses oleh crawler, di mana Google secara serentak menemui pautan /share yang berkaitan semasa menggali halaman-halaman tersebut.
Sebilangan pengguna juga mencadangkan bahawa produk komunikasi milik Google seperti Gmail dan Google Chat mungkin merupakan salah satu sumber pautan. Namun, dakwaan ini hanya spekulasi komuniti dan tidak disokong oleh bukti semasa ini.

Untuk insiden ini, Anthropic kelihatannya juga telah mengambil tindakan segera. Pengguna yang menguji secara langsung mendapati bahawa apabila menjalankan arahan site:claude.ai/share, Google telah menunjukkan hasil "dokumen yang sesuai tidak ditemui". Secara umum, pihak luar berpendapat bahawa platform telah segera menambahkan tag noindex ke semua halaman sesi yang dibahagikan, untuk menghentikan penerangan baru yang berterusan.
Namun, pembaikan mempunyai keterlambatan semula jadi: cache pada enjin carian lain seperti Bing dan Brave mempunyai kitaran pembaharuan yang berasingan, dan cache laman web sejarah yang telah diraih tidak akan hilang segera.

Kekeliruan privasi OpenAI dan Grok
Sebenarnya, masalah konfigurasi indeks semacam ini bukan hanya milik Anthropic.
Beberapa tahun lalu, fungsi perkongsian perbualan ChatGPT mengalami masalah reka bentuk privasi yang sama sekali serupa. Selepas kejadian itu, OpenAI segera memperbaiki konfigurasi noindex laman web dan menambahkan amaran risiko dalam tetingkap perkongsian, tetapi reka bentuk asas mekanisme perkongsian mereka tidak berubah.


Sekarang Anthropic menghadapi masalah yang sama, pada dasarnya kedua pengeluar terkemuka ini menggunakan pendekatan reka bentuk keselamatan yang sama.
Grok di pasaran yang sama juga pernah mengalami masalah yang sama. Pada tahun 2025, puluhan ribu percakapan yang dibagikan di platform Grok dikumpulkan secara besar-besaran oleh Google, memicu kontroversi privasi yang seukuran.
Walaupun selepas insiden, xAI telah membina pertahanan berlapis di peringkat arsitektur, seperti memaksa menambah tag noindex ke semua halaman perkongsian, serta secara serentak memperketat peraturan pengambilan robots.txt keseluruhan laman web, dua langkah perlindungan ini dilaksanakan serentak, menetapkan sekatan jelas pada kedua-dua peringkat pengambilan oleh crawler dan peneriman hasil.
Kelebihan utama penyelesaian ini ialah perlindungan dilakukan sejak awal, bukan bergantung kepada kebiasaan pengguna. Namun, dari perspektif keseluruhan industri, logik reka bentuk asas bagi masalah-masalah ini belum diperbaiki secara meluas.
Bagaimana untuk memperbaiki kelemahan dalam konfigurasi indeks dan reka bentuk perkongsian
Lubang serupa yang berulang kali berlaku pada OpenAI dan Anthropic juga mendorong komuniti untuk merefleksikan semula pendekatan reka bentuk produk yang biasa digunakan dalam industri.
Fungsi kongsi dialog memudahkan penyebaran kandungan dan dapat mendorong pertumbuhan produk, oleh itu kebanyakan pengeluar memberi keutamaan kepada pengalaman pengguna; namun, langkah-langkah perlindungan privasi seperti penarikan balik indeks dan kebenaran berperingkat sering kali hanya ditambah secara mendadak melalui pampasan sementara selepas kejadian keselamatan berlaku dan isu memanas.
Banyak netizen dalam perbincangan itu menyeru agar platform membina sistem perlindungan yang lebih lengkap dari asas. Pengguna biasa kebanyakannya tidak memahami teknologi web seperti noindex dan cache web crawler, sehingga sukar menyedari bahawa perkongsian pautan menyembunyikan risiko.
Dari sudut pandang teknologi produk, idea pengoptimuman yang boleh dilaksanakan pada masa ini relatif matang dan kos pelaksanaannya boleh dikawal, di mana lapisan paling asas ialah menetapkan noindex sebagai konfigurasi lalai untuk halaman kongsi, untuk menghalang laluan penerangan enjin carian dari sumbernya.
Di samping itu, risiko juga boleh dikurangkan lebih lanjut melalui reka bentuk keizinan, seperti menambahkan pengesahan akses log masuk, menyokong pengguna menetapkan kata laluan akses untuk pautan, serta menentukan tempoh berkuat kuasa secara tersuai, supaya lingkungan dan tempoh perkongsian lebih terkawal.
Sambil memberikan pilihan berkongsi, berikan amaran risiko yang lebih jelas tanpa istilah rumit — terangkan secara langsung bahawa pautan berpotensi diindeks oleh enjin carian, supaya pengguna memahami sifat awalnya sebelum mengklik.
Penyesuaian-penyesuaian ini tidak memerlukan perubahan besar terhadap arsitektur produk, tetapi berkesan dalam menyeimbangkan harapan privasi pengguna dengan mekanisme sebenar produk.


