Исследователь в области ИИ и основатель компании Peec AI Давид Коницны (David Konitzny) сообщил о потенциальной проблеме с конфиденциальностью в китайском сервисе DeepSeek. По его словам, опубликованные пользователями ссылки на диалоги с чат-ботом могут индексироваться поисковыми системами, из-за чего часть переписок становится доступной любому желающему.
Исследователь обнаружил проблему во время обычного тестирования сервиса в выходные дни. Его внимание привлёк механизм публикации диалогов: при использовании функции «Поделиться» DeepSeek создаёт постоянную ссылку, которую, как выяснилось, могут индексировать поисковые системы.
По словам автора исследования, в открытом доступе оказались самые разные разговоры с ИИ — от безобидных запросов до потенциально чувствительной информации. Среди найденных материалов встречались фрагменты рабочих обсуждений, программный код, деловые документы и даже примеры файлов, загруженных пользователями в чат. Коницны подчёркивает, что не утверждает, будто DeepSeek самостоятельно публикует личные переписки. Проблема связана именно с тем, что пользователи создают публичные ссылки, не всегда осознавая, что они могут попасть в поисковую выдачу.
Исследователь считает, что подобная ситуация демонстрирует растущую проблему безопасности экосистемы вокруг генеративного ИИ. По его мнению, сегодня основное внимание уделяется качеству языковых моделей, тогда как механизмы обмена данными, хранения информации и управления доступом зачастую остаются в тени. «Возможно, нам стоит спрашивать не только, насколько мощная эта модель, но и насколько безопасно всё, что построено вокруг неё», — отмечает автор.
Это не первый случай, когда по поводу безопасности DeepSeek возникают вопросы. В начале 2025 года специалисты компании Wiz обнаружили открытую базу данных DeepSeek, содержавшую более миллиона записей, включая журналы работы системы, пользовательские запросы и API-ключи. После уведомления компании доступ к базе был оперативно закрыт. Этот случай вызвал широкую дискуссию о зрелости процессов информационной безопасности в быстрорастущих ИИ-проектах.
Эксперты отмечают, что аналогичные риски потенциально существуют и в других сервисах генеративного ИИ. Если пользователь сознательно или случайно публикует ссылку на переписку, а разработчики не ограничивают её индексацию с помощью технических средств, такой контент может попасть в поисковые системы. В результате информация, которую автор считал доступной лишь ограниченному кругу лиц, становится значительно более заметной.
Сам Коницны рекомендует пользователям внимательно относиться к функциям публикации диалогов и не делиться ссылками, содержащими коммерческую, персональную или иную чувствительную информацию. Организациям, внедряющим генеративный ИИ в рабочие процессы, следует разработать внутренние правила использования подобных сервисов. Также необходимо объяснить сотрудникам различия между приватными чатами и общедоступными ссылками.
Источник: habr.com