← Все статьи
Новости10 мин чтения

Ключ API DeepSeek вместо подписки: сколько реально стоит месяц — и три способа незаметно удвоить счёт

Разбираем ценник DeepSeek для тех, кто вставляет ключ в готовый клиент или Telegram-бота без кода, но может заплатить вдвое больше расчётного.

Обложка статьи: Ключ API DeepSeek вместо подписки: сколько реально стоит месяц — и три способа незаметно удвоить счёт

Разбираем ценник DeepSeek для тех, кто вставляет ключ в готовый клиент или Telegram-бота без кода, но может заплатить вдвое больше расчётного.

Реальный недельный лог: восемь черновиков постов, 80 ответов в поддержке, документ на 90 тысяч токенов, полсотни промптов. Счёт за неделю на DeepSeek-V4-Flash — $0.27. За тот же объём подписка ChatGPT Plus пропорционально стоит около $5 в неделю при $20 в месяц. Разница — почти в двадцать раз.

Но сам чат DeepSeek бесплатен, поэтому ключ API имеет смысл сравнивать не с ним, а с платными обёртками и агрегаторами, которые продают тот же API с наценкой за интерфейс. А 24 июля, за два дня до проверки 26 июля, DeepSeek изменил правила так, что тот же диалог может стать втрое дороже.

Платите в рублях за DeepSeek API без наценки на токены через provod.ai

Где на самом деле тикает счётчик

Официальный прайс на 26 июля: DeepSeek-V4-Flash стоит $0.14 за 1 млн входных токенов при промахе кэша, $0.0028 при попадании в кэш и $0.28 за 1 млн выходных. V4-Pro — примерно втрое дороже по основным ставкам: $0.435/$0.003625/$0.87. Для личной переписки и документов разница между Flash и Pro часто сводится к тому, какая модель включена по умолчанию у клиента.

Главная деталь: выходные токены дороже входных. Цена диалога зависит не только от вашего текста, но и от длины ответа модели, а этот параметр в готовом интерфейсе может быть скрыт.

24 июля: тихая ловушка на reasoning

В 15:59 UTC 24 июля DeepSeek отключил старые имена моделей deepseek-chat и deepseek-reasoner: работают только явные deepseek-v4-flash и deepseek-v4-pro. Прямая замена deepseek-chat на deepseek-v4-flash без явного отключения рассуждений включает reasoning по умолчанию, и число выходных токенов, а с ним счёт, может вырасти в 2-3 раза за те же диалоги. Это качественная оценка независимого разбора, не контролируемый замер, но механизм понятен: рассуждение — тоже выходные токены, только скрытые внутри клиента.

После обновления Chatbox или Telegram-бота проверьте: в поле модели стоит deepseek-v4-flash, а не унаследованный alias; reasoning отключён, если задача не требует пошагового рассуждения.

Наценка на пиковые часы: то ли есть, то ли нет

02 evidence

29 июня DeepSeek сообщил подписчикам, что в пиковые часы — с 9:00 до 12:00 и с 14:00 до 18:00 по Пекину — тариф API удваивается; SCMP назвал это первой привязкой цены DeepSeek ко времени суток. Но ручная проверка официальной страницы цен от 25 июля показывает единый плоский тариф без временных надбавок. Статус спорный: если наценка вернётся, при равномерной круглосуточной нагрузке она добавит до ~29% к месячному счёту. Перед переходом на ключ откройте api-docs.deepseek.com/quick_start/pricing заново: цены DeepSeek за 2026 год менялись минимум дважды.

Что говорят те, кто уже считал

Саймон Уиллисон, независимый аналитик рынка LLM и автор Datasette, назвал V4 моделью, «почти на фронтире, за долю цены» — в апреле, когда Pro стоил $1.74/$3.48 за 1М токенов, вчетверо выше июльской цены после скидки. Здесь важна динамика: статьи о тарифах DeepSeek устаревают быстро.

Шаша Белламконда, Principal Research Director в Info-Tech Research Group, возражает иначе: дешёвый токен не включает стоимость контроля данных и комплаенс-документации, а у проприетарных вендоров это уже зашито в тариф. «Runtime guardrails answer the first question. They cannot answer the second», — пишет он. Аргумент адресован регулируемому бизнесу, но частного пользователя он тоже касается.

Статья расходов, которую не показывает счётчик токенов

03 decision

Witness AI в обзоре рисков DeepSeek приводит положение политики конфиденциальности о том, что персональные данные обрабатываются и хранятся на территории КНР без выбора региона. Для документа с чужими персональными данными, который вы разбираете через бота, это конкретное условие, а не абстрактный риск.

Счётчик токенов раздувают три вещи: reasoning по умолчанию может утроить счёт, роутинг на Pro поднимает базовую ставку примерно втрое, спорная наценка добавляет почти треть при круглосуточной нагрузке. Юрисдикция обработки данных в биллинг не попадает: это отдельная управленческая статья расходов рядом с тремя денежными.

Есть и бытовые ограничения. Официальный каталог DeepSeek перечисляет Chatbox, NextChat, LobeChat и ботов для Telegram, Discord, WeChat, Lark как настройку без кода. Но в NextChat есть открытый баг-репорт об ошибках аутентификации при отдельных прокси-конфигурациях. Публичный API DeepSeek V4 остаётся чисто текстовым: распознавание изображений программно недоступно, даже если клиент работает с картинками через другие модели.

Сколько выйдет у вас

Формула: (входные токены × цена входа) + (выходные токены × цена выхода), умноженное на число диалогов в месяц. Введите число сообщений, документов и среднюю длину ответа, затем выберите Flash или Pro и включите только риски, относящиеся к вашему клиенту. Дефолтные поля калькулятора — отдельный месячный пример для ручной настройки, а не пересчёт недельного лога FindSkill.

<div class="deepseek-cost-calculator"> <label>Сообщений в месяц <input type="number" min="0" value="320" data-role="messages"></label> <label>Входных токенов на сообщение <input type="number" min="0" value="500" data-role="message-input"></label> <label>Выходных токенов на ответ <input type="number" min="0" value="700" data-role="message-output"></label> <label>Документов в месяц <input type="number" min="0" value="4" data-role="docs"></label> <label>Токенов в одном документе <input type="number" min="0" value="90000" data-role="doc-input"></label> <label>Токенов в ответе по документу <input type="number" min="0" value="3000" data-role="doc-output"></label> <label>Модель <select data-role="model"><option value="flash">deepseek-v4-flash</option><option value="pro">deepseek-v4-pro</option></select></label> <label><input type="checkbox" data-role="reasoning"> reasoning включён: выходные токены ×2–3</label> <label><input type="checkbox" data-role="peak"> считать спорную пиковую наценку: итог ×1.29</label> <output data-role="result">При ставках Flash без reasoning и без пиковой надбавки этот пример даёт около $0.14 за месяц: (520 000 входных токенов × $0.14/1М) + (236 000 выходных × $0.28/1М). Это не месячная экстраполяция лога FindSkill с фактическим счётом $0.27 за неделю; ниже он показан отдельно. На Pro тот же ввод будет около $0.43; с reasoning считайте диапазон по выходу ×2–3, с пиковой надбавкой — ещё ×1.29.</output> </div> <script> (() => { const root = document.querySelector('.deepseek-cost-calculator'); if (!root) return; const rates = { flash: [0.14, 0.28], pro: [0.435, 0.87] }; const money = value => '$' + value.toFixed(value < 1 ? 2 : 1); const n = role => Number(root.querySelector(`[data-role="${role}"]`).value || 0); const recalc = () => { const input = n('messages') \* n('message-input') + n('docs') \* n('doc-input'); const output = n('messages') \* n('message-output') + n('docs') \* n('doc-output'); const [inRate, outRate] = rates[root.querySelector('[data-role="model"]').value]; const baseInput = input \* inRate / 1000000; const baseOutput = output \* outRate / 1000000; let low = baseInput + baseOutput; let high = low; if (root.querySelector('[data-role="reasoning"]').checked) { low = baseInput + baseOutput \* 2; high = baseInput + baseOutput \* 3; } if (root.querySelector('[data-role="peak"]').checked) { low \*= 1.29; high \*= 1.29; } const total = low === high ? money(low) : `${money(low)}–${money(high)}`; root.querySelector('[data-role="result"]').textContent = `Итого: ${total} за месяц. Учтено ${input.toLocaleString('ru-RU')} входных и ${output.toLocaleString('ru-RU')} выходных токенов; ставка модели ${inRate}/${outRate} за 1М. Reasoning меняет только выходные токены, пиковая надбавка умножает итог.`; }; root.addEventListener('input', recalc); recalc(); })(); </script>

Ниже — отдельная месячная экстраполяция недельного лога: фактические $0.27 за неделю умножены на четыре, а затем показаны поправки на модель, reasoning и спорную пиковую наценку.

СценарийЧто меняетсяИтог в месяц
Базовая нагрузка из отчёта, Flash, reasoning выключен×4 недели к $0.27≈ $1.1
Та же нагрузка, но на V4-Proцена входа/выхода выше в ~3–4 раза≈ $3.3–4.3
Та же нагрузка, alias заменён на Flash без отключения reasoningвыходные токены ×2–3≈ $2.2–3.3
Та же нагрузка + гипотетическая пиковая наценка при круглосуточной работе+29%≈ $1.4
Худший случай: Pro + reasoning включён + пиковая наценкакомбинация трёх факторовдо $15–17
Подписка на AI-чат для сравненияфиксированная плата$20

Даже худший сценарий из таблицы не превышает подписку, но разброс между $1 и $17 показывает: «дешевле подписки» — не гарантия, а результат настроек, которые проверяют вручную: deepseek-v4-flash, reasoning выключен там, где не нужен, время суток не совпадает с заявленным пиком.

Отдельно стоит знать структуру баланса: DeepSeek делит его на «granted balance» — бонус вендора с ограниченным сроком действия — и «topped-up balance», оплаченный пользователем; поле is_available показывает, хватает ли денег на вызов. Минимальная сумма пополнения и срок сгорания бонуса официально не раскрыты — уточняйте их в личном кабинете.

Если не хочется пересобирать проверку после каждого переименования модели или пересмотра тарифа, клиент с протоколом OpenAI можно направить на provod.ai, заменив только базовый URL и ключ, а сравнение вести по текущему каталогу моделей и параметров provod.ai. Если решающей становится юрисдикция обработки данных, у provod.ai есть контур с маскированием прямых персональных идентификаторов до отправки запроса во внешнюю модель; в 152-ФЗ-сценарии это снижает риск передачи прямых идентификаторов, но не заменяет проверку процесса и не превращает цену за токен в ответ на комплаенс-вопрос.

Решение по цене — это три проверки перед сохранением настроек клиента: модель, режим рассуждений, время суток относительно спорной наценки. Пропустить любую — и разница между $1 и $17 в месяц становится личной, а не гипотетической.

provod.ai — не переплачивайте мощной моделью за простую задачу

Разделяйте быстрые массовые запросы и сложные случаи: компактные модели берут рутину, флагманские — задачи, где критичны reasoning, контекст и качество результата.

В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

Оптимизация опирается на реальную стоимость: цены всех вариантов соответствуют официальным тарифам провайдеров 1:1, без наценки provod.ai.

Подберите модель под свою нагрузку: форма регистрации · цены на модели · защита данных по 152-ФЗ · главная provod.ai

Источники