Сотни частных сессий чата Claude AI стали общедоступными через запросы поисковых систем, поскольку в общих ссылках отсутствовали соответствующие теги noindex. С тех пор Anthropic предприняла шаги по удалению этих журналов из результатов поиска, хотя инцидент вызвал споры об ответственности за защиту конфиденциального веб-контента.
Масштаб утечки данных
В последние выходные июля 2026 года интернет-пользователи обнаружили серьезную уязвимость конфиденциальности, связанную с искусственным интеллектом чат-бота Anthropic Клода. Используя конкретных поисковых операторов, исследователи обнаружили, что многочисленные сеансы приватного чата были проиндексированы основными поисковыми системами, включая Google и Bing. Обнаруженные журналы содержали широкий спектр конфиденциальной информации, начиная от личных расспросов о политических взглядах и эротических ролевых играх и заканчивая потенциально запатентованными корпоративными исследованиями и медицинской документацией. В некоторых случаях просочившиеся расшифровки включали подробную контактную информацию и профессиональный опыт, содержащиеся в резюме пользователей. Хотя некоторые из затронутых страниц были удалены их владельцами вскоре после обнаружения, широкая видимость этих тем подчеркивает опасности, связанные с созданием общедоступных URL-адресов для частных генеративных сеансов ИИ.
Технические сбои и протоколы индексирования
Основная причина индексации, по-видимому, заключается в несоответствии мер безопасности, применяемых Anthropic, требованиям современных поисковых систем. В то время как Anthropic пыталась ограничить работу сканеров с помощью своего файла robots.txt — давнего отраслевого стандарта, указывающего, какие области сайта должны оставаться конфиденциальными, — и Google, и Bing утверждают, что одного этого часто бывает недостаточно. В технической документации этих поисковых систем поясняется, что инструкции robots.txt можно игнорировать, если на страницу есть ссылка в другом месте в Интернете. Чтобы эффективно предотвратить индексирование, разработчики должны реализовать HTML-тег noindex или x-robots-tag в заголовках страниц. Анализ затронутых страниц Claude подтвердил отсутствие этих конкретных тегов, которые позволяли алгоритмам поисковых систем сканировать и сохранять данные разговоров, несмотря на директивы Anthropic robots.txt.
Отраслевые прецеденты и ответственность
Этот инцидент отражает аналогичные нарушения конфиденциальности, с которыми столкнулись другие крупные разработчики ИИ, включая OpenAI и создателей X's Grok, журналы чат-ботов которых в последние годы появлялись в результатах публичного поиска. Эти повторяющиеся проблемы вызвали споры о том, кто несет основную ответственность за защиту данных. Представитель Google заявил, что компания не диктует, какие страницы станут общедоступными, подчеркнув, что бремя внедрения необходимых мер контроля для ограничения сканеров лежит на владельце веб-сайта. Между тем, представитель Anthropic отметил, что пользователям предоставляются четкие предупреждения о том, что общие ссылки могут быть просмотрены любым, имеющим доступ, рассматривая публичную доступность как естественное следствие функции «поделиться», которая по своей сути рассматривает контент так же, как и другие общедоступные веб-архивы.
Более широкие последствия для конфиденциальности ИИ
Эта ситуация служит ярким напоминанием о сложностях, связанных с балансировкой простоты обмена результатами ИИ с необходимостью строгой конфиденциальности пользователей. Хотя пользователи часто полагаются на инструменты искусственного интеллекта для обработки конфиденциальных профессиональных и личных данных, цифровой след этих взаимодействий может стать постоянным, если не обрабатывать их точными настройками безопасности. В функции общего доступа Anthropic в настоящее время отсутствует явное предупреждение о том, что эти ссылки могут быть обработаны поисковыми системами, что приводит к путанице пользователей относительно долговечности и доступности их данных. Поскольку лаборатории искусственного интеллекта конкурируют за интеграцию своих технологий в повседневные рабочие процессы, необходимость в надежной защите конфиденциальности, включая упреждающие меры по блокированию поисковой индексации, стала критическим вопросом, вызывающим беспокойство как для разработчиков, так и для более широкой технологической индустрии.
⚖ The Balanced View
Supporting view
Anthropic утверждает, что функция общего доступа работает так, как задумано, понимая, что любой, у кого есть ссылка, может получить доступ к разговору, сравнивая его со стандартным общедоступным веб-контентом.
Concerns & criticism
Критики утверждают, что использование только файла robots.txt является недостаточной стратегией безопасности и что отсутствие тегов noindex в общедоступных ссылках на чат напрямую способствует несанкционированному раскрытию личных данных пользователей.
→What's next
Anthropic уже инициировала удаление этих журналов чатов из индексов поисковых систем, чтобы минимизировать дальнейшее раскрытие информации. Пользователи, обеспокоенные своим общим контентом, должны перейти к настройкам конфиденциальности своей учетной записи, чтобы управлять, просматривать или отзывать доступ к ранее созданным ссылкам чата.