Бизнесу и службам безопасности
- Ввести политику в отношении Shadow AI: явно определить, какие данные нельзя вставлять в потребительские ИИ-сервисы (код с доступами, ПД клиентов, внутренние документы).
- Для рабочих задач использовать корпоративные/enterprise-варианты, где шаринг не индексируется, либо локальные модели.
- Проверить собственную экспозицию: поискать, не попали ли в индекс страницы шаринга, связанные с вашими данными, и запросить их удаление.
- Помнить, что удаление чата ≠ удаление публичной ссылки: дополнительно работать с кешем и архивами.
Сервисам с ИИ-чатами
- Показывать явное предупреждение при создании публичной ссылки: «наличие ссылки только у вас не гарантирует приватность».
- Закрывать страницы шаринга от индексации по умолчанию (noindex, robots.txt, X-Robots-Tag), а не полагаться на один метод.
- Проверять, что защита работает во всех поисковых системах, а не только в Google, — директивы индексации у разных поисковиков расходятся.
На момент подготовки материала DeepSeek уже начал закрывать страницы шаринга от индексации — по сценарию, знакомому по ChatGPT: сначала функция работает без ограничений, затем, после огласки, сервис спохватывается. Но, как и в случае с ChatGPT, это не отменяет уже случившегося: страницы, попавшие в индекс и кеш ранее, остаются доступными.
Методология исследования- Собран срез ~200 публичных share-страниц DeepSeek, попавших в индекс поисковых систем.
- Повторные ссылки на один чат схлопнуты.
- Из каждой страницы извлекались только метаданные и факты (язык, тема, наличие кода/файла, булевы признаки чувствительных данных) — содержимое сообщений не сохранялось; чувствительные данные фиксировались как факт, а не как значение.
- Язык определялся автоматически по объёму пользовательского текста; тема и признаки чувствительных данных — эвристически (оценка, не точное значение).
- Совпадения по ключам и картам верифицировались вручную.
- Два аномально длинных диалога исключены из подсчётов по объёму.
- Проценты по языкам и темам считаются от числа распознанных чатов, выборка не претендует на репрезентативность всего индекса.