Разбираем ценник DeepSeek для тех, кто вставляет ключ в готовый клиент или Telegram-бота без кода, но может заплатить вдвое больше расчётного.
Реальный недельный лог: восемь черновиков постов, 80 ответов в поддержке, документ на 90 тысяч токенов, полсотни промптов. Счёт за неделю на DeepSeek-V4-Flash — $0.27. За тот же объём подписка ChatGPT Plus пропорционально стоит около $5 в неделю при $20 в месяц. Разница — почти в двадцать раз.
Но сам чат DeepSeek бесплатен, поэтому ключ API имеет смысл сравнивать не с ним, а с платными обёртками и агрегаторами, которые продают тот же API с наценкой за интерфейс. А 24 июля, за два дня до проверки 26 июля, DeepSeek изменил правила так, что тот же диалог может стать втрое дороже.
Платите в рублях за DeepSeek API без наценки на токены через provod.ai
Где на самом деле тикает счётчик
Официальный прайс на 26 июля: DeepSeek-V4-Flash стоит $0.14 за 1 млн входных токенов при промахе кэша, $0.0028 при попадании в кэш и $0.28 за 1 млн выходных. V4-Pro — примерно втрое дороже по основным ставкам: $0.435/$0.003625/$0.87. Для личной переписки и документов разница между Flash и Pro часто сводится к тому, какая модель включена по умолчанию у клиента.
Главная деталь: выходные токены дороже входных. Цена диалога зависит не только от вашего текста, но и от длины ответа модели, а этот параметр в готовом интерфейсе может быть скрыт.
24 июля: тихая ловушка на reasoning
В 15:59 UTC 24 июля DeepSeek отключил старые имена моделей deepseek-chat и deepseek-reasoner: работают только явные deepseek-v4-flash и deepseek-v4-pro. Прямая замена deepseek-chat на deepseek-v4-flash без явного отключения рассуждений включает reasoning по умолчанию, и число выходных токенов, а с ним счёт, может вырасти в 2-3 раза за те же диалоги. Это качественная оценка независимого разбора, не контролируемый замер, но механизм понятен: рассуждение — тоже выходные токены, только скрытые внутри клиента.
После обновления Chatbox или Telegram-бота проверьте: в поле модели стоит deepseek-v4-flash, а не унаследованный alias; reasoning отключён, если задача не требует пошагового рассуждения.
Наценка на пиковые часы: то ли есть, то ли нет

29 июня DeepSeek сообщил подписчикам, что в пиковые часы — с 9:00 до 12:00 и с 14:00 до 18:00 по Пекину — тариф API удваивается; SCMP назвал это первой привязкой цены DeepSeek ко времени суток. Но ручная проверка официальной страницы цен от 25 июля показывает единый плоский тариф без временных надбавок. Статус спорный: если наценка вернётся, при равномерной круглосуточной нагрузке она добавит до ~29% к месячному счёту. Перед переходом на ключ откройте api-docs.deepseek.com/quick_start/pricing заново: цены DeepSeek за 2026 год менялись минимум дважды.
Что говорят те, кто уже считал
Саймон Уиллисон, независимый аналитик рынка LLM и автор Datasette, назвал V4 моделью, «почти на фронтире, за долю цены» — в апреле, когда Pro стоил $1.74/$3.48 за 1М токенов, вчетверо выше июльской цены после скидки. Здесь важна динамика: статьи о тарифах DeepSeek устаревают быстро.
Шаша Белламконда, Principal Research Director в Info-Tech Research Group, возражает иначе: дешёвый токен не включает стоимость контроля данных и комплаенс-документации, а у проприетарных вендоров это уже зашито в тариф. «Runtime guardrails answer the first question. They cannot answer the second», — пишет он. Аргумент адресован регулируемому бизнесу, но частного пользователя он тоже касается.
Статья расходов, которую не показывает счётчик токенов

Witness AI в обзоре рисков DeepSeek приводит положение политики конфиденциальности о том, что персональные данные обрабатываются и хранятся на территории КНР без выбора региона. Для документа с чужими персональными данными, который вы разбираете через бота, это конкретное условие, а не абстрактный риск.
Счётчик токенов раздувают три вещи: reasoning по умолчанию может утроить счёт, роутинг на Pro поднимает базовую ставку примерно втрое, спорная наценка добавляет почти треть при круглосуточной нагрузке. Юрисдикция обработки данных в биллинг не попадает: это отдельная управленческая статья расходов рядом с тремя денежными.
Есть и бытовые ограничения. Официальный каталог DeepSeek перечисляет Chatbox, NextChat, LobeChat и ботов для Telegram, Discord, WeChat, Lark как настройку без кода. Но в NextChat есть открытый баг-репорт об ошибках аутентификации при отдельных прокси-конфигурациях. Публичный API DeepSeek V4 остаётся чисто текстовым: распознавание изображений программно недоступно, даже если клиент работает с картинками через другие модели.
Сколько выйдет у вас
Формула: (входные токены × цена входа) + (выходные токены × цена выхода), умноженное на число диалогов в месяц. Введите число сообщений, документов и среднюю длину ответа, затем выберите Flash или Pro и включите только риски, относящиеся к вашему клиенту. Дефолтные поля калькулятора — отдельный месячный пример для ручной настройки, а не пересчёт недельного лога FindSkill.
<div class="deepseek-cost-calculator"> <label>Сообщений в месяц <input type="number" min="0" value="320" data-role="messages"></label> <label>Входных токенов на сообщение <input type="number" min="0" value="500" data-role="message-input"></label> <label>Выходных токенов на ответ <input type="number" min="0" value="700" data-role="message-output"></label> <label>Документов в месяц <input type="number" min="0" value="4" data-role="docs"></label> <label>Токенов в одном документе <input type="number" min="0" value="90000" data-role="doc-input"></label> <label>Токенов в ответе по документу <input type="number" min="0" value="3000" data-role="doc-output"></label> <label>Модель <select data-role="model"><option value="flash">deepseek-v4-flash</option><option value="pro">deepseek-v4-pro</option></select></label> <label><input type="checkbox" data-role="reasoning"> reasoning включён: выходные токены ×2–3</label> <label><input type="checkbox" data-role="peak"> считать спорную пиковую наценку: итог ×1.29</label> <output data-role="result">При ставках Flash без reasoning и без пиковой надбавки этот пример даёт около $0.14 за месяц: (520 000 входных токенов × $0.14/1М) + (236 000 выходных × $0.28/1М). Это не месячная экстраполяция лога FindSkill с фактическим счётом $0.27 за неделю; ниже он показан отдельно. На Pro тот же ввод будет около $0.43; с reasoning считайте диапазон по выходу ×2–3, с пиковой надбавкой — ещё ×1.29.</output> </div> <script> (() => { const root = document.querySelector('.deepseek-cost-calculator'); if (!root) return; const rates = { flash: [0.14, 0.28], pro: [0.435, 0.87] }; const money = value => '$' + value.toFixed(value < 1 ? 2 : 1); const n = role => Number(root.querySelector(`[data-role="${role}"]`).value || 0); const recalc = () => { const input = n('messages') \* n('message-input') + n('docs') \* n('doc-input'); const output = n('messages') \* n('message-output') + n('docs') \* n('doc-output'); const [inRate, outRate] = rates[root.querySelector('[data-role="model"]').value]; const baseInput = input \* inRate / 1000000; const baseOutput = output \* outRate / 1000000; let low = baseInput + baseOutput; let high = low; if (root.querySelector('[data-role="reasoning"]').checked) { low = baseInput + baseOutput \* 2; high = baseInput + baseOutput \* 3; } if (root.querySelector('[data-role="peak"]').checked) { low \*= 1.29; high \*= 1.29; } const total = low === high ? money(low) : `${money(low)}–${money(high)}`; root.querySelector('[data-role="result"]').textContent = `Итого: ${total} за месяц. Учтено ${input.toLocaleString('ru-RU')} входных и ${output.toLocaleString('ru-RU')} выходных токенов; ставка модели ${inRate}/${outRate} за 1М. Reasoning меняет только выходные токены, пиковая надбавка умножает итог.`; }; root.addEventListener('input', recalc); recalc(); })(); </script>Ниже — отдельная месячная экстраполяция недельного лога: фактические $0.27 за неделю умножены на четыре, а затем показаны поправки на модель, reasoning и спорную пиковую наценку.
| Сценарий | Что меняется | Итог в месяц |
|---|---|---|
| Базовая нагрузка из отчёта, Flash, reasoning выключен | ×4 недели к $0.27 | ≈ $1.1 |
| Та же нагрузка, но на V4-Pro | цена входа/выхода выше в ~3–4 раза | ≈ $3.3–4.3 |
| Та же нагрузка, alias заменён на Flash без отключения reasoning | выходные токены ×2–3 | ≈ $2.2–3.3 |
| Та же нагрузка + гипотетическая пиковая наценка при круглосуточной работе | +29% | ≈ $1.4 |
| Худший случай: Pro + reasoning включён + пиковая наценка | комбинация трёх факторов | до $15–17 |
| Подписка на AI-чат для сравнения | фиксированная плата | $20 |
Даже худший сценарий из таблицы не превышает подписку, но разброс между $1 и $17 показывает: «дешевле подписки» — не гарантия, а результат настроек, которые проверяют вручную: deepseek-v4-flash, reasoning выключен там, где не нужен, время суток не совпадает с заявленным пиком.
Отдельно стоит знать структуру баланса: DeepSeek делит его на «granted balance» — бонус вендора с ограниченным сроком действия — и «topped-up balance», оплаченный пользователем; поле is_available показывает, хватает ли денег на вызов. Минимальная сумма пополнения и срок сгорания бонуса официально не раскрыты — уточняйте их в личном кабинете.
Если не хочется пересобирать проверку после каждого переименования модели или пересмотра тарифа, клиент с протоколом OpenAI можно направить на provod.ai, заменив только базовый URL и ключ, а сравнение вести по текущему каталогу моделей и параметров provod.ai. Если решающей становится юрисдикция обработки данных, у provod.ai есть контур с маскированием прямых персональных идентификаторов до отправки запроса во внешнюю модель; в 152-ФЗ-сценарии это снижает риск передачи прямых идентификаторов, но не заменяет проверку процесса и не превращает цену за токен в ответ на комплаенс-вопрос.
Решение по цене — это три проверки перед сохранением настроек клиента: модель, режим рассуждений, время суток относительно спорной наценки. Пропустить любую — и разница между $1 и $17 в месяц становится личной, а не гипотетической.
provod.ai — не переплачивайте мощной моделью за простую задачу
Разделяйте быстрые массовые запросы и сложные случаи: компактные модели берут рутину, флагманские — задачи, где критичны reasoning, контекст и качество результата.
В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.
Оптимизация опирается на реальную стоимость: цены всех вариантов соответствуют официальным тарифам провайдеров 1:1, без наценки provod.ai.
Подберите модель под свою нагрузку: форма регистрации · цены на модели · защита данных по 152-ФЗ · главная provod.ai
Источники
- DeepSeek — официальная страница тарифов и лимитов
- DeepSeek — журнал изменений API с датой отключения алиасов
- DeepSeek — справочник по эндпоинту баланса пользователя
- DeepSeek AI (GitHub) — каталог готовых интеграций и ботов
- Simon Willison — обзор DeepSeek V4 на старте линейки
- Shashi Bellamkonda — о скрытой цене комплаенса для дешёвого API
- South China Morning Post — репортаж о наценке на пиковые часы
- TECHi — разбор рисков миграции с deepseek-chat на V4
- FindSkill.ai — недельный отчёт о расходах на DeepSeek V4 против ChatGPT Plus
- Digital Applied — проверка официальной страницы цен от 25 июля 2026
- NextChat (GitHub Issues) — баг-репорт об ошибке аутентификации с ключом DeepSeek
- DeepSeekV4Pro.com — проверка статуса vision в API DeepSeek
- Witness AI — обзор политики конфиденциальности и рисков DeepSeek
