27 липня Anthropic разом із Google, Bing і DuckDuckGo, після того як було викрито масштабну витік персональних даних користувачів Claude, видалили з пошукових індексів відповідний контент із вебсайту Claude; однак пошукові системи водночас забули видалити інший витік даних користувачів AI-сервісу Perplexity.
Прогалина після виправлення вразливості Claude
25 липня 2026 року допис на Reddit розкрив проблему з пошуком у Claude, стверджуючи, що деякі проіндексовані діалоги містять облікові дані, резюме, внутрішню інформацію компаній і приватні обговорення; після того як новина швидко поширилась, пошукові системи прибрали публічний каталог спільного доступу Claude з індексу. Однак під час усунення проблеми Claude пошукові системи не синхронізували опрацювання подібного випадку з Perplexity: пошук «Claude» наразі повертає нуль результатів, тоді як пошук «Perplexity» досі показує кілька сторінок зі списками.
Суттєва причина вразливості в Claude полягає в тому, що посилання, яке можна поширювати, було налаштовано неправильно — відсутній тег noindex або інші домовленості щодо захисту приватності, через що пошукові системи автоматично індексували клієнтські посилання та відповідний контент документів.
Механізм витоку даних Perplexity Computer
Protos використовує стандартну URL-структуру посилань, які можна ділитися: достатньо виконати запит у Google, Bing і DuckDuckGo, щоб отримати доступ до десятків повних файлів Perplexity Computer від різних клієнтів. Ці документи не є просто кешем пошукової системи — вони фактично зберігаються в домені Perplexity.ai, містять різні теми й мають відповідні конкретні назви.
Варто зазначити, що Perplexity для клієнтів, які добровільно хочуть опублікувати контент в інтернеті, надає окремий домен pplx.app, який не має стосунку до описаної події витоку. Оскільки при використанні різних ключових слів для більш конкретних запитів може повертатися більше результатів, обсяг охопленого контенту може перевищувати те, що відомо наразі.
Історія проблем із приватністю в AI-компаніях
Це сталося не вперше, коли AI-компанії стикалися з проблемами приватності; історія виглядає так:
OpenAI (липень 2025 року): її директор з безпеки заявив, що компанія прибрала опціональну функцію, яка дозволяла знаходити спільні діалоги ChatGPT пошуковими системами
Anthropic (вересень 2025 року): у матеріалі Forbes повідомлялося, що до моменту видалення зі сторінок пошукових результатів сотні спільних діалогів Claude з’являлися в Google
Anthropic (25 липня 2026 року): допис на Reddit розкрив проблему пошуку в Claude, стверджуючи, що там присутні облікові дані, резюме, внутрішня інформація компаній і приватні обговорення
Perplexity (27 липня 2026 року): Protos виявив, що дані користувачів Perplexity Computer і досі можна публічно шукати, а пошукові системи ще не прибрали відповідні індекси
Питання та відповіді
Чому дані користувачів Perplexity з’являються в результатах пошукових систем?
Згідно з повідомленням Protos, ключова проблема в тому, що спільні посилання Perplexity використовують передбачувану стандартну URL-структуру і не мають належних домовленостей захисту приватності (зокрема, тега noindex), через що пошукові системи автоматично індексують ці посилання та їхній вміст; інтерфейс спільного доступу Perplexity лише пояснює «будь-хто, хто має посилання, може переглянути», а не чітко повідомляє, що контент може бути знайдений будь-яким користувачем пошукової системи.
Під час виправлення вразливості Claude чи одночасно були виправлені проблеми Perplexity?
Згідно з повідомленням Protos, станом на 27 липня 2026 року, після того як пошукові системи прибрали публічний каталог спільних матеріалів Claude, вони не синхронно опрацювали подібну проблему з Perplexity; пошук «Perplexity» досі повертає кілька сторінок зі списками, пов’язаними з даними користувачів. Protos повідомив про цю вразливість Perplexity та трьом ключовим пошуковим системам.
Чи пов’язаний домен pplx.app Perplexity з цією подією витоку?
Згідно з поясненням у статті, pplx.app — це окремий домен, який Perplexity надає клієнтам, що добровільно хочуть публікувати контент в інтернеті, і він не має стосунку до події витоку, коли дані користувачів Perplexity Computer були проіндексовані пошуковими системами.