provod.ai / docs
Оплата и контроль

Использование и стоимость запросов

Разберитесь в оплате входных, выходных, кэшированных токенов, рассуждений, работы агентов и прерванных ответов.

Обновлено

В provod.ai действует предоплата по фактическому использованию, а не отдельная месячная подписка на каждую модель. Текущая цена для клиента указана в каталоге моделей, а итоговое списание в рублях — в разделах Использование и баланса.

Из чего складывается стоимость

В итоговую стоимость могут входить:

  • обычные входные токены, отправленные модели;
  • выходные токены, созданные моделью;
  • токены чтения из кэша и записи в кэш, если модель сообщает их отдельно;
  • токены рассуждений (reasoning), если они присутствуют в данных об использовании.

Если модель сообщает токены рассуждений, они всегда входят в стоимость. При настроенном отдельном тарифе применяется он, иначе действует цена выходных токенов модели. Текущий каталог и раздел использования могут не показывать отдельный тариф или счётчик рассуждений для каждой модели и каждого запроса. Отсутствие такой строки не означает нулевой расход; не пытайтесь восстановить скрытую детализацию. Ориентируйтесь на итоговую сумму запроса.

Цены кэша также зависят от модели. Отдельные тарифы чтения, записи, записи на 5 минут или на 1 час применяются только там, где они настроены. Если отдельного тарифа кэша нет, эти токены оплачиваются как обычные входные. Для расчёта используйте текущую цену provod.ai для клиента, а не цену из другого каталога.

Учитывайте каждый запрос агента

Для одной видимой задачи агент может выполнить много запросов к API. На каждом шаге он может заново отправлять историю диалога, описания инструментов и их результаты, поэтому повторно переданный контекст снова входит в стоимость. Оценивайте весь журнал запросов, а не только токены в последнем окне клиента.

Создавайте отдельный API-ключ для каждого проекта или агента, если нужна понятная разбивка. Затем в разделе Использование можно отфильтровать расходы по ключу и задать ему лимит.

Проверьте итоговое списание

Откройте раздел Использование, выберите активное рабочее пространство, период и API-ключ, затем сравните:

  • состояние и время запроса;
  • точный идентификатор модели, название ключа и видимый маскированный префикс;
  • входные и выходные токены, чтение из кэша и запись в кэш;
  • количество запросов, длительность и итоговое списание.

Сравнивайте итоговую сумму запроса со своей оценкой. Они могут различаться из-за фактического ответа, категорий кэша, рассуждений, тарифа длинного контекста или фактических данных о расходе. Если сумма всё ещё вызывает вопросы, передайте поддержке идентификатор запроса, точное время с часовым поясом, модель, название ключа и видимый маскированный префикс. Не отправляйте полный ключ или конфиденциальный текст запроса.

Проверьте пользу кэша

Откройте раздел Модели и проверьте, опубликованы ли для выбранной модели цены кэша и нужные параметры. Не меняйте повторяющееся начало запроса, используйте только параметры из supported_parameters и сравните счётчики кэша у двух последовательных запросов.

Нулевой счётчик означает, что обращение к кэшу не зафиксировано. Ненулевой счётчик не гарантирует скидку: если отдельной цены кэша у модели нет, применяется обычная цена входных токенов.

Учитывайте прерванные запросы

Если запрос завершился ошибкой до ответа модели и до подтверждённых данных о расходе, резерв освобождается без списания. Если часть потокового ответа уже доставлена или сервис получил подтверждённые данные о расходе, эта часть может быть оплачена. Не повторяйте запрос автоматически после начала ответа: сначала проверьте, получил ли клиент полезный результат и появилась ли запись в разделе использования.

Решение проблем

На этой странице