Новый закон об ИИ не запрещает бизнесу DeepSeek, но две утечки данных за полтора года показывают, где на самом деле риск
В июле 2026 года достаточно было набрать в поиске обрывок фразы на русском, чтобы наткнуться на чужую переписку с DeepSeek — расшаренную через встроенную функцию «Поделиться» и проиндексированную Google. Исследователь Дэвид Конитцны из Peec AI прогнал такие запросы системно и получил распределение: 31% найденных ссылок — на русском языке, 20% — на английском, среди содержимого — рабочие документы, финансовый анализ, исходный код. По его словам, сервис предупреждает, что ссылка становится публичной, но нигде явно не говорит, что её проиндексируют поисковики. Коммерсантъ подтвердил инцидент отдельно, компания комментарий не дала. Для российского читателя это уже случившийся факт с заметной долей русскоязычного контента.
Платите в рублях за AI-модели без наценки на токены через provod.ai
Чей дипсик и где он живёт
Юридически ответ простой. DeepSeek — сервис компании, основанной в 2023 году Лян Вэньфэном, до этого управлявшим китайским хедж-фондом High-Flyer с пиковыми активами около 14 млрд долларов в 2021 году — фонд частично финансировал разработку модели (Wikipedia). Собственная политика конфиденциальности DeepSeek прямо указывает: данные пользователей хранятся и обрабатываются на территории КНР, а ввод используется «to train and improve our technology», хотя формально предусмотрен отказ от использования данных для обучения — правда, без пошагового описания механизма для API-трафика. Всё перечисленное компания пишет о себе сама, в публичном документе.
Российский регулятор к этому юрисдикционному факту относится спокойно. После недоступности сервиса без VPN в мае 2026 года Роскомнадзор заявил, что не получал решений уполномоченных органов и ограничений не вводил. После утечки диалогов в июле того же года позиция не изменилась: «Доступ к информации, нарушающей закон, может быть ограничен только на основании решений уполномоченных органов. Решений в отношении DeepSeek не поступало» — так цитирует ведомство региональное издание (цитата приведена там по-английски, здесь — в переводе). Для сравнения: в США конгрессмены Джош Готтхаймер и Дарин Лахуд писали губернаторам, что при использовании DeepSeek сотрудники «unknowingly sharing highly sensitive, proprietary information with the CCP» (пресс-релиз офиса Готтхаймера) — заявление политическое, независимой технической экспертизы за ним нет, а внесённый ими законопроект S.765 до сих пор не принят, полтора года провисев в комитете. В России юрисдикционный запрет DeepSeek остаётся анекдотическим опасением; действующей нормы за ним нет.
Риск создаёт не Китай, а сама компания

Здесь и разворачивается ключевой тезис статьи: проблема не в стране хостинга, а в том, как DeepSeek обращается с чужими данными у себя дома. В январе 2025 года команда Wiz Research нашла полностью открытую базу ClickHouse DeepSeek без аутентификации — свыше миллиона строк логов, включая историю чатов и служебные ключи; компания закрыла доступ в течение часа после уведомления, но сам факт открытой базы говорит о базовом уровне гигиены. Через месяц NowSecure разобрала мобильное приложение для iOS и обнаружила, что оно глобально отключает App Transport Security и гоняет данные без шифрования на инфраструктуру Volcengine — облако ByteDance, а не самой DeepSeek. А в июле 2026-го — уже описанная утечка через индексацию расшаренных ссылок. Три инцидента за полтора года, три разные причины: открытая база, слабое шифрование в приложении, дырявый дизайн функции «Поделиться». Ни один не имеет отношения к юрисдикции КНР как таковой — все три про операционную небрежность конкретного вендора.
Что на самом деле требует новый закон
8 июля 2026 года Госдума приняла закон об ИИ, вводящий понятия суверенной и национальной модели; 17 июля его одобрил Совфед, вступление в силу — 1 сентября 2026 года (Медуза). Ключевая деталь для рядового бизнеса: юридический разбор текста закона показывает, что прямого запрета на использование ChatGPT или DeepSeek в облаке для частной компании нет — требования локализации данных касаются только критической инфраструктуры и госсектора, причём с переходным периодом до 1 сентября 2032 года для систем, введённых до 1 марта 2027-го (разбор на chelidze-d.com). Практическая рекомендация юристов созвучна: закон вводит две категории разрешённых российских моделей, но бизнесу советуют провести аудит используемых ИИ-сервисов, а не спешить с миграцией — перечень «чувствительных» сфер, где потребуется только суверенная или национальная модель, ещё не утверждён подзаконными актами (Клерк.ру). То есть паника про «блокировку с 2027 года», которую в марте пересказывали некоторые издания, не соответствует финальной редакции — но и точку в вопросе ставить рано: конкретный список отраслей появится позже, и до тех пор разумный максимум — аудит.
Возражение, которое нельзя игнорировать

Открытые веса DeepSeek-R1 распространяются по лицензии MIT, разрешающей коммерческое использование и модификацию; у DeepSeek-V3 код тоже под MIT, а веса — по отдельной модельной лицензии (HuggingFace). Казалось бы, локальный запуск снимает вопрос юрисдикции целиком. Управляющий партнёр коллегии адвокатов «Регионсервис» Анна Жолобова называет саму возможность локального использования без постоянного выхода в интернет «обнадёживающим» фактором с точки зрения защиты данных бизнеса — эту оценку приводит корпоративный блог ИТ-консалтера, что стоит учитывать как источник с коммерческим интересом в продвижении внедрения (КОРУС Консалтинг).
Но лицензия MIT распространяется на код и веса; ответственность за инфраструктуру остаётся на компании, которая разворачивает модель у себя. Wiz и NowSecure настаивают ровно на этом: сама DeepSeek не обеспечивала базовую защиту данных даже в собственной инфраструктуре, значит доверие к открытым весам не автоматически означает доверие к облачному сценарию вендора. Локальное развёртывание закрывает вопрос юрисдикции хранения и одновременно перекладывает бремя безопасности с DeepSeek на вашу команду. Если ресурса на это бремя нет, локальный запуск оборачивается просто другим набором обязанностей.
Что делать сегодня
Практический чек-лист перед тем, как открыть DeepSeek для рабочей задачи:
- Содержит ли запрос коммерческую тайну, персональные данные или конфиденциальные документы клиента? Если да — облачный вариант отпадает сразу.
- Не собираетесь ли вы использовать функцию «Поделиться»? После июльской истории с индексацией это единственный доказанный канал утечки в открытый поиск — просто не создавайте публичные ссылки.
- Относится ли компания к критической инфраструктуре или госсектору по новому закону? Если да, готовьтесь к локализации данных к 2032 году уже сейчас, не дожидаясь подзаконных актов.
- Если сомневаетесь — используйте локальный запуск открытых весов через собственную инфраструктуру, но закладывайте ресурс на её защиту, а не только на GPU.
Для промежуточного сценария — когда команде нужен быстрый доступ без своего железа, но с контролем над персональными данными — рабочий вариант держать запрос под маскированием прямых идентификаторов до того, как он уйдёт во внешнюю модель: такую функцию для 152-ФЗ-контуров предлагает, например, provod.ai. Это не отменяет пункт про коммерческую тайну из чек-листа, но снижает риск для менее чувствительных задач.
Гайд DTF для частных пользователей описывает ещё один путь — доступ через российского посредника вроде Umnik.AI с оплатой рублями и русским интерфейсом (DTF). Для рабочих задач это не решает вопрос из чек-листа: где физически обрабатываются данные при проходе через реселлера, гайд не раскрывает — юрисдикция остаётся такой же непрозрачной, как и при прямом облачном доступе, только с лишним посредником в цепочке доверия.
provod.ai — единый контур для растущего числа команд и сценариев
Добавляйте сотрудников, продукты и новые модели без отдельной закупки для каждого направления: общий API и рабочее пространство снижают операционный хаос по мере роста.
В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.
Рост использования не включает процент агрегатора поверх модели: провайдерская цена сохраняется 1:1, без собственной маржи provod.ai.
Подготовьте AI-контур к росту: форма регистрации · цены на модели · защита данных по 152-ФЗ · API и интеграции
Источники
- DeepSeek Privacy Policy
- Wiz Research Uncovers Exposed DeepSeek Database Leaking Sensitive Information
- NowSecure Uncovers Multiple Security and Privacy Flaws in DeepSeek iOS App
- S.765 — No DeepSeek on Government Devices Act, Congress.gov
- Пресс-релиз офиса конгрессмена Джоша Готтхаймера
- Роскомнадзор опроверг блокировку DeepSeek, Интерфакс
- Переписки пользователей с DeepSeek попали в Google, Коммерсантъ
- Google is indexing DeepSeek's shared chats, Cybernews
- Запретят ли бизнесу ChatGPT и DeepSeek, Клерк.ру
- Госдума приняла закон о регулировании ИИ в России, Медуза
- Дипсик в России: работает ли DeepSeek, DTF
- Как DeepSeek повлияет на российский бизнес, блог КОРУС Консалтинг
- High-Flyer, Wikipedia
- LICENSE, deepseek-ai/DeepSeek-R1 на HuggingFace
- Закон об ИИ: что на самом деле приняли, разбор на chelidze-d.com
- Роскомнадзор: предписаний по DeepSeek не было даже после утечки диалогов, Тут Новости
