27 июля Anthropic вместе с поисковыми системами Google, Bing и DuckDuckGo убрали из поисковых индексов материалы с сайта Claude после того, как в публичную плоскость вылилось массовое раскрытие личных данных пользователей Claude; при этом поисковые системы одновременно забыли удалить данные о пользователях другой AI-услуги Perplexity, которые также были раскрыты.
Пропуск после исправления уязвимости Claude
25 июля 2026 года пост в Reddit раскрыл проблему с поиском у Claude: утверждалось, что некоторые проиндексированные диалоги содержали учетные данные, резюме, внутреннюю корпоративную информацию и частные обсуждения; после того как новость быстро разлетелась, поисковые системы удалили из индекса каталог публичных публикаций Claude. Однако при разборе проблемы с Claude поисковые системы не синхронизировали аналогичную обработку для Perplexity: запрос «Claude» сейчас дает нулевой результат, но запрос «Perplexity» все еще возвращает список на несколько страниц.
Корень проблемы уязвимости Claude в том, что ссылки, которыми можно делиться, были настроены неправильно — отсутствовал тег noindex или иные соглашения о защите приватности, из‑за чего поисковые системы автоматически проиндексировали клиентские ссылки и содержимое связанных документов.
Механизм утечки данных Perplexity Computer
Protos получил доступ к десяткам полных файлов Perplexity Computer от разных клиентов, используя стандартную URL‑структуру по доступным ссылкам: достаточно выполнить поиск в Google, Bing и DuckDuckGo. Эти документы — не просто кэш поисковых движков, они реально хранятся в домене Perplexity.ai и содержат названия по конкретным темам.
Отдельно стоит отметить, что Perplexity предоставила клиентам, которые хотят добровольно публиковать контент в сети, отдельный домен pplx.app — это не связано с описанным инцидентом утечки. Поскольку при более точных запросах с другими ключевыми словами можно получить больше результатов, охват затронутого контента может оказаться шире, чем то, что известно на данный момент.
История проблем с приватностью у AI-компаний
Этот инцидент — не первый случай, когда у AI-компаний возникли проблемы с приватностью. История выглядит так:
OpenAI (июль 2025): ее руководитель по безопасности заявил, что компания удалила опциональную функцию, позволяющую находить в поисковых системах общие диалоги ChatGPT
Anthropic (сентябрь 2025): Forbes сообщила, что до удаления из результатов поиска сотни общих диалогов Claude отображались в выдаче Google
Anthropic (25 июля 2026): Reddit-пост раскрыл проблему с поиском у Claude, утверждая, что там содержались учетные данные, резюме, внутренние корпоративные сведения и частные обсуждения
Perplexity (27 июля 2026): Protos обнаружила, что пользовательские данные Perplexity Computer все еще можно публично искать, и поисковые системы еще не убрали связанные индексы
Частые вопросы
Почему пользовательские данные Perplexity появляются в результатах поисковых систем?
Согласно отчету Protos, ключевая причина в том, что доступные для шаринга ссылки Perplexity используют предсказуемую стандартную URL‑структуру и не имеют надлежащих соглашений защиты приватности (например, тега noindex). Из‑за этого поисковые системы автоматически включают в индекс эти ссылки и их содержимое; интерфейс шаринга Perplexity лишь указывает: «любой, у кого есть ссылка, может посмотреть», но не сообщает явно, что контент могут найти пользователи любых поисковых систем.
При исправлении уязвимости Claude поисковые системы синхронно устранили проблему Perplexity?
Согласно отчету Protos, по состоянию на 27 июля 2026 года после удаления поисковыми системами каталога публичных публикаций Claude они не синхронно обработали аналогичную проблему для Perplexity: запрос «Perplexity» по‑прежнему возвращает несколько страниц со списком, связанным с пользовательскими данными. Protos уже передала информацию об этой уязвимости Perplexity и трем крупнейшим поисковым системам.
Связаны ли доменное имя pplx.app и данный инцидент утечки?
Согласно описанию в статье, pplx.app — это отдельный домен, который Perplexity предоставляет клиентам, желающим добровольно публиковать контент в сети; он не связан с инцидентом утечки, из‑за которого поисковые системы проиндексировали пользовательские данные Perplexity Computer.