В июле 2026 года пользователи обнаружили, что с помощью поискового оператора Google можно массово извлекать общие записи диалогов пользователей Claude. Причина заключалась в том, что функция обмена Claude создавала публичные веб-страницы, а не закрытые ссылки. Хотя страницы были защищены файлом robots.txt, в них отсутствовал ключевой мета-тег noindex, из-за чего поисковые системы индексировали как URL, так и содержимое страниц. В результатах поиска были обнаружены чувствительные данные, такие как ключи к криптовалютным кошелькам пользователей и номера социального страхования. В настоящее время Anthropic срочно устранила проблему, добавив мета-тег noindex для предотвращения дальнейшей индексации. Эта проблема не является единственной: аналогичная уязвимость в приватности ранее была обнаружена у ChatGPT от OpenAI и Grok от xAI.Автор статьи, источник: LeFeng.com

От криптовалютных приватных ключей до личной информации — Reddit охватила волна любопытства к чужой жизни.
Embodied intelligence enters the greasy kitchen
Работа робота при миллионе просмотров
Доктор Му Вэй, бывший вице-президент Covariant AI и технический директор Zhoupu Data, назначен техническим директором «Shu Tu Technology».
Команда основателей только что представлена, и вместе с этим раскрылись информация о финансировании и составе акционеров этой стартап-компании в области физического ИИ.
Beta Infinity will target the trillion-dollar consumer robotics blue ocean market.
26 лет для физически реализованных ИИ — это то же, что 23 года для крупных языковых моделей.
26 июля 2026 года пользователь Reddit опубликовал сообщение в сообществе, в котором заявил, что с помощью поискового оператора Google site:claude.ai/share можно массово извлекать тысячи совместно используемых записей диалогов пользователей Claude.
После нажатия пользователем кнопки "Поделиться" в Claude система генерирует публичную веб-страницу, доступную без входа в систему и без проверки личности, а не закрытую ссылку, доступную только для указанных лиц.
Эти страницы не отличаются по сути от обычных веб-страниц в интернете и соответствуют условиям для индексации поисковыми роботами. Однако большинство пользователей, использовавших функцию совместного доступа, никогда не получали соответствующих предупреждений о рисках.
После публикации поста он быстро распространился в зарубежных социальных сетях, дискуссии вокруг механизма «разделение — это публикация» продолжают усиливаться, и за этим последовала серия случаев утечки конфиденциальной информации, превысивших ожидания общественности.

По мере того как все больше людей присоединялись к поиску, были обнаружены некоторые крайне драматичные случаи. На некоторое время поиск чатов других пользователей стал большим развлечением в сообществе. Люди искали приватную информацию других пользователей, обсуждали и восхищались ею, не уставая от этого.

Наиболее заметными рисками среди извлеченных данных являются два типа информации.
Первое — это информация о криптоактивах. Некоторые пользователи нашли кошелек и пароль одного пользователя. Следуя по переписке, интернет-пользователи нашли соответствующий кошелек, в котором оставалось всего 2,73 доллара США. Еще более абсурдно то, что добросердечные пользователи хотели предупредить владельца о утечке ключей, но не смогли найти ни одного способа связи в переписке — этот пользователь, возможно, до сих пор не знает, что его ключи от кошелька были раскрыты всему миру.

Во-вторых, это ключевая личная информация. Некоторые пользователи подтвердили, что в результатах поиска обнаружили полные диалоги, содержащие номера социального страхования (SSN). Если такая информация попадет в черный рынок, это может непосредственно привести к краже личности, финансовым мошенничествам и другим реальным ущербам.

Кроме того, в извлеченных данных содержатся различные типы конфиденциальной информации, включая проектные документы именных специалистов, диалоги с юридическими консультантами, личные резюме и контент для взрослых. Большое количество частных материалов, которые должны были распространяться в узком круге, попали в индекс публичных поисковых систем без каких-либо барьеров.
Почему robots.txt не может заблокировать индексирование?
После того как событие набрало обороты, внимательные пользователи нашли файл robots.txt Claude, в котором явно указано Disallow: /share/*, то есть правило запрещает веб-паукам доступ к пути /share.

Если есть четкие правила, почему диалог все еще был проиндексирован поисковыми системами? Это наиболее важный технический аспект данного инцидента.
Чтобы разобраться в этом вопросе, сначала необходимо различить два понятия: сканирование и индексация:
robots.txtслужит для договорённости с веб-пауками: не извлекайте содержимое страниц в этом пути. Он может только помешать паукам активно сканировать страницы по внутренним ссылкам сайта, но не имеет принудительной силы и не может препятствовать поисковым системам включать сам URL в результаты поиска.- Поисковая система обнаруживает ссылку, а также другой путь: через внешние ссылки с публичных веб-страниц. Как только пользователь размещает ссылку на Claude на Reddit, X, публичных форумах, документах GitHub или любых других публичных страницах, доступных для веб-скрейпинга, Google обнаружит эту ссылку /share при сканировании этой страницы.
Даже если robots.txt запрещает веб-паукам считывать текст страницы, Google все равно включит этот URL в результаты поиска, просто не отображая аннотацию страницы. Единственный способ полностью исключить страницу из результатов поиска — это метатег noindex в HTML-коде страницы, который напрямую указывает поисковым системам не включать эту страницу в индекс.
В момент инцидента все общие страницы Claude как раз отсутствовали с этой ключевой noindex настройкой. Платформа обеспечивала лишь частичную защиту через robots.txt, не имея действительно эффективного механизма предотвращения индексации. Согласно информации, восстановленной пользователями сообщества, в сентябре 2025 года Claude уже сталкивалась с небольшим инцидентом подобного рода, когда Google оценил, что было проиндексировано и затем удалено менее 600 диалогов, однако это не привело к полному устранению пробелов в настройках защиты платформы.

Другая проблема этого события заключается в том, как именно Google обнаружил эти ссылки для обмена, состоящие из случайных UUID?
Некоторые пользователи отметили, что перебор десятков миллиардов комбинаций символов практически невозможен, и основной путь — это внешние ссылки. Основная версия заключается в том, что некоторые пользователи разместили ссылки для обмена на открытых форумах, социальных платформах, документации открытых проектов и других публичных страницах, доступных для веб-скрейпинга, и Google обнаружил соответствующие ссылки /share при сканировании этих страниц.
Некоторые пользователи также предположили, что такими источниками ссылок могут быть коммуникационные продукты Google, такие как Gmail и Google Chat. Однако это лишь предположение сообщества, и на данный момент нет никаких доказательств.

В ответ на это событие Anthropic, похоже, также предприняла срочные меры по устранению проблемы. Пользователи протестировали команду site:claude.ai/share, и Google теперь показывает результат «Совпадающие документы не найдены». Широко считается, что платформа срочно добавила тег noindex ко всем страницам общих сессий, чтобы предотвратить дальнейшее индексирование.
Однако устранение имеет естественную задержку: кэш других поисковых систем, таких как Bing и Brave, обновляется в отдельном цикле, и кэшированные исторические страницы, уже проиндексированные, не исчезнут мгновенно.

Утечки конфиденциальности OpenAI и Grok
На самом деле, такие проблемы с конфигурацией индексов не являются исключительными для Anthropic.
Несколько лет назад функция обмена диалогами в ChatGPT столкнулась с точно такой же проблемой проектирования конфиденциальности. После инцидента OpenAI срочно добавила настройку noindex на страницу и включила предупреждение о рисках в всплывающее окно при обмене, но базовый дизайн механизма обмена остался неизменным.


Сейчас у Anthropic возникла аналогичная проблема, что по сути связано с тем, что оба ведущих производителя используют один и тот же подход к безопасности.
Тот же самый косяк ранее допустила Grok. В 2025 году десятки тысяч общих диалогов на платформе Grok были массово проиндексированы Google, что вызвало аналогичный скандал в сфере конфиденциальности.
После инцидента xAI внедрило многоуровневую предварительную защиту на архитектурном уровне, например, принудительно добавило метку noindex ко всем страницам совместного доступа и одновременно ужесточило правила извлечения в robots.txt для всего сайта; оба уровня защиты были реализованы одновременно, установив четкие ограничения как на этапе сбора данных ботами, так и на этапе индексации результатов.
Основное преимущество этой схемы заключается в том, что защита реализована заранее, а не полагается на привычки пользователей. Однако с точки зрения всей отрасли базовая логика проектирования таких проблем пока не была普遍 исправлена.
Как устранить недостатки конфигурации индекса и дизайна обмена
Повторяющиеся уязвимости, вновь проявившиеся в OpenAI и Anthropic, побуждают сообщество переосмыслить общепринятые подходы к проектированию продуктов в отрасли.
Функция обмена диалогами облегчает распространение контента и способствует росту продукта, поэтому производители в первую очередь обеспечивают удобство использования; однако такие меры защиты конфиденциальности, как обратная индексация и градуированные права доступа, часто добавляются лишь после инцидентов с безопасностью и усиления общественного резонанса, в виде срочных патчей.
Многие пользователи в обсуждениях призывают платформу создать более надежную систему защиты на базовом уровне. Обычные пользователи обычно не знают таких сетевых технологий, как noindex или кэширование веб-пауков, и трудно осознают, что совместимые ссылки могут скрывать риски.
С точки зрения продукта и технологий, текущие возможные направления оптимизации относительно зрелы, а стоимость реализации контролируема; самой базовой мерой является установка noindex в качестве настройки по умолчанию для страниц обмена, чтобы блокировать индексацию поисковыми системами на源头.
На этой основе риск можно дополнительно снизить с помощью дизайна прав доступа, например, добавив проверку при входе в систему, поддержку установки пароля доступа для ссылок и настройки пользовательской продолжительности действия, чтобы контролировать объем и сроки распространения.
Также рядом с кнопкой分享 добавьте более простое предупреждение о рисках — без сложных терминов, прямо укажите, что ссылка может быть проиндексирована поисковыми системами, чтобы пользователь четко понимал ее публичный характер перед кликом.
Эти изменения не требуют значительных изменений архитектуры продукта, но эффективно устраняют разрыв между ожиданиями пользователей в отношении конфиденциальности и реальными механизмами продукта.


