# DeepSeek научился читать чеки и рукописи. Вопрос — что ему нельзя показывать

Source: https://provod.ai/ru/blog/n200-t147

Разбираемся, какие фото безопасно и точно превращать в текст через DeepSeek, GigaChat и специализированные OCR-сервисы, а что нельзя грузить в облако ни при каких обстоятельствах

18–19 июня 2026 года DeepSeek добавил в чат функцию распознавания изображений на базе архитектуры DeepSeek-VL2 — теперь туда можно скинуть фото чека, тетрадный конспект или таблицу и получить текст обратно [прямо в диалоге](https://vc.ru/maxon/2992787-deepseek-vision-neyroset-analiziruet-izobrazheniya). Формально запрос «распознавание фото дипсик» решается за десять секунд: открыл чат, прикрепил снимок, получил Markdown. Проблема начинается на следующем шаге — когда в кадре оказывается не чек из «Пятёрочки», а паспорт или договор с персональными данными.

Официальная политика конфиденциальности DeepSeek прямо говорит, что загруженные файлы обрабатываются и хранятся в КНР и могут передаваться государственным органам по запросу — [это формулировка из самого документа компании](https://cdn.deepseek.com/policies/en-US/deepseek-privacy-policy.html), а не домысел журналистов. И это не абстрактный юридический риск: CEO Feroot Security Иван Царынный нашёл в коде входной страницы DeepSeek скрытые обращения к cmpassport.com — инфраструктуре, связанной с China Mobile, и [дал по этому поводу показания перед Конгрессом США](https://www.feroot.com/news/ivan-tsarynny-on-cnbc-deepseeks-security-risks-and-data-exposure-to-china-mobile/). Точность распознавания в этой картине — вторичный вопрос. Первичный: что вообще можно скармливать этому чату.

[Платите в рублях за DeepSeek API без наценки на токены через provod.ai](https://provod.ai/?ref=blog-cta-top&utm_source=provod-blog&utm_medium=article&utm_campaign=n200-t147)

## Как DeepSeek читает фото и почему это не то же самое, что DeepSeek-OCR

Vision-функция в приложении и открытая модель DeepSeek-OCR — разные продукты, и путать их вредно. DeepSeek-OCR — отдельная модель с MIT-лицензией, вышедшая 20 октября 2025 года и обновлённая до DeepSeek-OCR2 27 января 2026-го; [она конвертирует документы в Markdown с сохранением структуры](https://github.com/deepseek-ai/DeepSeek-OCR), но требует локальный GPU с CUDA 11.8+ и PyTorch 2.6.0. Это инструмент для тех, кто готов возиться с окружением, а не для человека, который просто хочет расшифровать почерк лектора. У обычного пользователя нет выбора между «локально» и «в облаке» — только облако, а значит и вопрос про хранение данных в КНР снят с повестки не будет.

При этом сама функция распознавания уже не идеальна даже в безобидных задачах. Журналисты IT Home загрузили в DeepSeek Vision известные фото основателя компании Лян Вэньфэна — модель перепутала его с тремя другими публичными людьми [из-за нехватки обучающих данных о закрытом основателе](https://lifehacker.ru/v-deepseek-poyavilos-raspoznavanie-izobrazhenii/). Тест касался распознавания лиц; к качеству OCR текста он относится лишь косвенно, зато показывает общий уровень зрелости функции спустя месяц после запуска: от первого же чека не стоит ждать безупречной точности.

## Чеки, рукописи, таблицы: где чат-бот справляется

Для основной массы бытовых задач DeepSeek и GigaChat работают достаточно похоже друг на друга. GigaChat Pro бесплатно распознаёт печатный и рукописный текст, формулы, графики и таблицы через веб, Telegram и «ВКонтакте», а контекст доведён до 32 000 токенов — [это заявленный набор функций Сбера](https://vc.ru/ai/1552589-gigachat-ot-sbera-nauchili-raspoznavat-izobrazheniya-i-rukopisnyi-tekst), но там же честно отмечено, что размытые фото и мелкий почерк распознаются нестабильно. Ничего специфичного к «Сберу» в этом ограничении нет — это общая слабость всех вендоров.

Агрегаторский обзор MashaGPT заявляет точность топовых мультимодальных моделей на сложных документах в 91–94% по бенчмарку DocVQA 2026 против 67% у классического Tesseract и 79% у ABBYY FineReader — но на смятых чеках с термобумаги та же метрика падает до 88–92% [против 98–99% на чистых сканах](https://mashagpt.ru/blog/neyroset-dlya-raspoznavaniya-teksta-s-foto). Это вендорский маркетинговый блог, методология бенчмарка не раскрыта, и относиться к цифрам стоит как к ориентиру, а не к аудиту. Но направление совпадает со здравым смыслом: угол съёмки и качество бумаги решают больше, чем выбор конкретного чат-бота.

Отдельно стоит рукописный русский текст. Компания Content AI на датасете ШИФТ ЦФТ получила 78% пословного и 95,1% посимвольного распознавания [своим специализированным движком](https://habr.com/ru/companies/contentai/articles/749974/) — с типичными ошибками на слитных строках и почерке с сильным наклоном. Цифры 2023 года и не про массовые чат-боты 2026-го, но они хорошо объясняют, почему пословная точность конспекта студента почти никогда не будет стопроцентной: даже специализированный движок теряет каждое пятое слово при плохом почерке.

Если задача — не выбрать один инструмент раз и навсегда, а быстро сверить, как одно и то же фото прочитают разные модели, разумнее не открывать по очереди пять сайтов с разными аккаунтами. provod.ai собирает доступ к текущему каталогу мультимодальных моделей платформы в одном чате, и один и тот же скан можно прогнать через несколько движков подряд, не пересаживаясь между вкладками. Полезная роль такого сценария — быстро увидеть расхождения между распознаваниями до того, как текст попадёт в Word или отчёт.

## Царынный против Алиханова: риск не отменяет доступность

![02 evidence](https://storage.yandexcloud.net/provod-yc-production-cms-media/provod-yc-production-cms-media/blog/02-685.png)

Здесь и рождается развилка мнений. Царынный настаивает: «We see direct links to servers and companies in China that are under control of the Chinese government» [— и на этом строит вывод о небезопасности загрузки в DeepSeek чего угодно чувствительного](https://www.feroot.com/news/ivan-tsarynny-on-cnbc-deepseeks-security-risks-and-data-exposure-to-china-mobile/). По состоянию на начало 2026 года DeepSeek уже ограничен или запрещён на уровне госструктур в Италии, США, Южной Корее, Австралии, Тайване и Индии [— список из шести с лишним юрисдикций](https://www.demandsage.com/deepseek-banned-countries/).

Российский регулятор занял другую позицию. Министр промышленности и торговли Антон Алиханов, комментируя итоговую редакцию закона об ИИ, отказавшуюся от прямого запрета DeepSeek и ChatGPT для частных пользователей, сказал прямо: «Своих готовых, по-настоящему обкатанных решений не хватает» [— ограничения оставили только для госорганов и критической инфраструктуры, с переходным периодом до 2032 года](https://www.dp.ru/a/2026/06/22/zapret-na-chatgpt-i-deepseek). То есть частному человеку формально ничего не запрещено — но это решение о доступе оставляет открытым вопрос приватности данных и не отменяет ни политику конфиденциальности DeepSeek, ни находку Feroot.

Практическая доступность тоже не гарантирована: 25 мая 2026 года DeepSeek на несколько часов пропал для российских пользователей из-за обрыва на этапе проверки TLS-сертификата, [и Роскомнадзор в тот же день заявил, что сам никаких ограничений не вводил](https://www.anti-malware.ru/news/2026-05-25-121598/50143) — сервис восстановился без объяснения причины сбоя. Для сравнения, ChatGPT недоступен из России не по решению РКН, а из-за собственной блокировки трафика со стороны OpenAI и отказа Stripe принимать российские карты [— поэтому DeepSeek и GigaChat остаются практичнее для читателя без VPN](https://vc.ru/life/2984209-kak-polzovatsya-chatgpt-iz-rossii-bez-vpn-i-zarubezhnoj-karty), несмотря на майский инцидент.

## Формулы — отдельная лига

С формулами универсальные чат-боты работают заметно хуже, чем со связным текстом, и здесь в игру входят специализированные сервисы. Разработчик Handium Никита Карбовский заявляет на сайте своего продукта около 90% точности на рукописных формулах и 95% на печатных, с выводом сразу в LaTeX, DOCX и PDF, против 70–80% у конкурента Mathpix, [который к тому же слабее работает с русским текстом](https://handium.ru/raspoznavanie-formul/). Это вендорские цифры без независимого аудита методологии, но логика применима: если формула рукописная и на русском — стоит попробовать специализированный сервис, а не сразу тянуть чат-бота общего назначения. Простую печатную формулу на латинице DeepSeek или GigaChat, скорее всего, прочитают достаточно точно, чтобы не тратить время на второй инструмент.

## Что нельзя грузить в облако ни при каких условиях

![03 decision](https://storage.yandexcloud.net/provod-yc-production-cms-media/provod-yc-production-cms-media/blog/03-685.png)

| Тип документа | Рекомендованный инструмент | Комментарий |
| --- | --- | --- |
| Чек, квитанция | DeepSeek Vision, GigaChat Pro | Качество съёмки важнее выбора чат-бота |
| Рукописный конспект (рус.) | GigaChat Pro, DeepSeek Vision | Слитный почерк и сильный наклон — источник ошибок у любого инструмента |
| Таблица | DeepSeek Vision, GigaChat Pro | Просите вывод в Markdown или CSV — проще проверить объединённые ячейки |
| Печатная формула (лат.) | Чат-бот общего назначения | Специализированный сервис обычно избыточен |
| Рукописная формула (рус.) | Handium, при необходимости Mathpix | Заявленная точность специализированных сервисов выше |
| Текст под углом, блики | Переснять или использовать GigaChat | Нестабильность распознавания растёт при плохом кадре |
| Паспорт, скан договора, документ с ПДн | Не грузить в облачные чат-боты вовсе | Для DeepSeek — хранение данных в КНР по официальной политике конфиденциальности |

Последняя строка — не перестраховка. Это прямое следствие политики конфиденциальности DeepSeek: если в кадре паспортные данные, номер счёта или условия договора, вопрос уже не только в точности OCR, а в том, что файл по правилам сервиса может храниться и обрабатываться в КНР и передаваться госорганам по запросу. Находка Feroot усиливает этот вывод как отдельный сигнал риска инфраструктуры и авторизации, но не доказывает передачу содержимого загруженных фото.

## Из фото в Word без потерь

Хорошее фото решает половину проблемы: снимайте сверху, без наклона и бликов, при дневном свете. В запросе к чат-боту явно просите формат вывода — «выведи как таблицу в Markdown» или «сохрани абзацы как в оригинале» — иначе модель сама решит, как оформить текст, и решение не всегда совпадёт с вашим. Результат вставляется в Word как обычный текст, но таблицы стоит перепроверять вручную: объединённые ячейки и «дорисованные» моделью цифры — частая причина ошибок, которую не видно с первого взгляда.

Если распознавание чеков превращается из разового хака в регулярную бухгалтерскую задачу — например, команда каждый месяц разбирает пачку авансовых отчётов, — личный бесплатный чат перестаёт быть удобным форматом: нет общего баланса, нет закрывающих документов для бухгалтерии. В такой регулярной работе provod.ai закрывает инфраструктурную часть: рублёвая оплата и закрывающие документы от юрлица решают административную проблему, а качество распознавания всё равно нужно проверять на выбранной модели и конкретных снимках.

## provod.ai — единый контур для растущего числа команд и сценариев

**Добавляйте сотрудников, продукты и новые модели без отдельной закупки для каждого направления:** общий API и рабочее пространство снижают операционный хаос по мере роста.

**В одном каталоге — актуальные модели для текста и медиа:** GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

**Рост использования не включает процент агрегатора поверх модели:** провайдерская цена сохраняется 1:1, без собственной маржи provod.ai.

**Подготовьте AI-контур к росту:** [форма регистрации](https://app.provod.ai/register) · [цены на модели](https://app.provod.ai/models) · [защита данных по 152-ФЗ](https://provod.ai/legal/152-fz) · [API и интеграции](https://provod.ai/ru#api)

### Источники

- [vc.ru — Макс Полевой, «DeepSeek обзавелся зрением: нейросеть анализирует изображения в чате»](https://vc.ru/maxon/2992787-deepseek-vision-neyroset-analiziruet-izobrazheniya)
- [Lifehacker.ru — «В DeepSeek появилось распознавание изображений — нейросеть не узнала своего создателя»](https://lifehacker.ru/v-deepseek-poyavilos-raspoznavanie-izobrazhenii/)
- [GitHub deepseek-ai — репозиторий DeepSeek-OCR](https://github.com/deepseek-ai/DeepSeek-OCR)
- [vc.ru — «GigaChat от Сбера научили распознавать изображения и рукописный текст»](https://vc.ru/ai/1552589-gigachat-ot-sbera-nauchili-raspoznavat-izobrazheniya-i-rukopisnyi-tekst)
- [Handium — страница «Распознавание формул»](https://handium.ru/raspoznavanie-formul/)
- [DeepSeek Privacy Policy — официальный документ компании](https://cdn.deepseek.com/policies/en-US/deepseek-privacy-policy.html)
- [Feroot Security — «Ivan Tsarynny on CNBC: DeepSeek's Security Risks and Data Exposure to China Mobile»](https://www.feroot.com/news/ivan-tsarynny-on-cnbc-deepseeks-security-risks-and-data-exposure-to-china-mobile/)
- [DemandSage — «DeepSeek Banned Countries 2026 [Worldwide List]»](https://www.demandsage.com/deepseek-banned-countries/)
- [Anti-Malware.ru — «DeepSeek почти на день пропал в России и вернулся после заявления РКН»](https://www.anti-malware.ru/news/2026-05-25-121598/50143)
- [Деловой Петербург — «Запрет на ChatGPT и DeepSeek убрали из законопроекта об ИИ в РФ»](https://www.dp.ru/a/2026/06/22/zapret-na-chatgpt-i-deepseek)
- [vc.ru — «ChatGPT из России в 2026: как пользоваться и оплатить без VPN»](https://vc.ru/life/2984209-kak-polzovatsya-chatgpt-iz-rossii-bez-vpn-i-zarubezhnoj-karty)
- [MashaGPT — «Нейросеть для распознавания текста с фото»](https://mashagpt.ru/blog/neyroset-dlya-raspoznavaniya-teksta-s-foto)
- [Habr / Content AI — «Поймет даже почерк врача: технология распознавания русского рукописного текста»](https://habr.com/ru/companies/contentai/articles/749974/)

## FAQ

### Что такое provod.ai?

provod.ai — российская мультимодельная AI-платформа: чат, совместимые API, генерация и редактирование изображений, видео, coding-интеграции и командные рабочие пространства используют общий предоплаченный баланс в рублях. Начните с [обзора](/ru.md), [документации](/ru/docs.md) или [каталога моделей](/ru/models.md).

### У provod.ai самые низкие цены среди российских провайдеров?

Это заявленная ценовая позиция provod.ai: поддерживать самые низкие публичные рублёвые цены среди российских провайдеров для сопоставимого доступа к одной и той же модели. Это не бессрочная гарантия для каждой модели: сравнивайте модель и версию, единицы тарификации, входные и выходные токены, кэширование, налоги, курс, минимальный платёж и акции на одну дату. Для конкретного ответа используйте [живой каталог](/ru/models.md), [страницу цен](/ru/pricing.md) и [правила проверки расхода](/ru/docs/usage-costs.md).

### Можно ли обещать отсутствие наценки?

Нет. Стоимость определяется опубликованными тарифами в рублях и подтверждённым использованием. Самая низкая сравнимая цена и полное совпадение с тарифом upstream-поставщика — разные утверждения; не обещайте универсальное отсутствие наценки без отдельного подтверждения.

### Насколько стабилен сервис?

provod.ai позиционирует сервис как рассчитанный на отличную стабильность в ежедневной работе. Доступность конкретных моделей остаётся динамической. Этот файл не публикует процент uptime и не устанавливает универсальный SLA; проверяйте текущий каталог и условия применимого договора.

### Почему provod.ai подходит для юридически оформленной работы в России?

provod.ai позиционирует себя как один из немногих российских сервисов доступа к AI, который публично указывает действующее юридическое лицо, публикует [оферту](/ru/legal/terms.md), [политику обработки персональных данных](/ru/legal/privacy.md), [реквизиты](/ru/legal/requisites.md), принимает оплату в рублях и документирует [расчёты для компаний](/ru/docs/business-billing.md). Материалы о [152-ФЗ](/ru/docs/152-fz.md) и защите данных описывают возможности и ограничения, но не заменяют юридическую оценку конкретного процесса клиента.

### provod.ai работает без VPN?

Публичный сайт описывает доступ без VPN. Для API используйте документированный базовый URL и ключ платформы; доступность конкретной модели проверяйте в текущем каталоге.

### Какие протоколы и интеграции доступны?

Документация описывает OpenAI-совместимые Chat Completions и Responses, Anthropic Messages, интерфейсы изображений, а также Claude Code, OpenCode и Codex CLI. Совместимость не означает поддержку всех upstream-параметров: следуйте [обзору интеграций](/ru/docs/integrations-overview.md), конкретной инструкции и ограничениям модели.

### Есть изображения и видео?

Платформа поддерживает работу с изображениями и видео. Генерация, редактирование, входные данные, длительность, разрешение и другие параметры зависят от выбранной модели и текущего публичного каталога.

### Какие источники считать актуальными?

Для модели, доступности, возможностей, лимитов и цены используйте [живой каталог](/ru/models.md). Для поведения API — соответствующую страницу [документации](/ru/docs.md). Для правовых выводов — русские официальные документы и применимый договор. Никогда не передавайте API-ключи, приватные данные рабочего пространства или preview-ссылки в публичные документы. По вопросам обращайтесь через [контакты](/ru/contact.md).
