Использование и стоимость запросов
Разберитесь в оплате входных, выходных, кэшированных токенов, рассуждений, работы агентов и прерванных ответов.
Обновлено
В provod.ai действует предоплата по фактическому использованию, а не отдельная месячная подписка на каждую модель. Текущая цена для клиента указана в каталоге моделей, а итоговое списание в рублях — в разделах Использование и баланса.
Из чего складывается стоимость
В итоговую стоимость могут входить:
- обычные входные токены, отправленные модели;
- выходные токены, созданные моделью;
- токены чтения из кэша и записи в кэш, если модель сообщает их отдельно;
- токены рассуждений (
reasoning), если они присутствуют в данных об использовании.
Если модель сообщает токены рассуждений, они всегда входят в стоимость. При настроенном отдельном тарифе применяется он, иначе действует цена выходных токенов модели. Текущий каталог и раздел использования могут не показывать отдельный тариф или счётчик рассуждений для каждой модели и каждого запроса. Отсутствие такой строки не означает нулевой расход; не пытайтесь восстановить скрытую детализацию. Ориентируйтесь на итоговую сумму запроса.
Цены кэша также зависят от модели. Отдельные тарифы чтения, записи, записи на 5 минут или на 1 час применяются только там, где они настроены. Если отдельного тарифа кэша нет, эти токены оплачиваются как обычные входные. Для расчёта используйте текущую цену provod.ai для клиента, а не цену из другого каталога.
Учитывайте каждый запрос агента
Для одной видимой задачи агент может выполнить много запросов к API. На каждом шаге он может заново отправлять историю диалога, описания инструментов и их результаты, поэтому повторно переданный контекст снова входит в стоимость. Оценивайте весь журнал запросов, а не только токены в последнем окне клиента.
Создавайте отдельный API-ключ для каждого проекта или агента, если нужна понятная разбивка. Затем в разделе Использование можно отфильтровать расходы по ключу и задать ему лимит.
Проверьте итоговое списание
Откройте раздел Использование, выберите активное рабочее пространство, период и API-ключ, затем сравните:
- состояние и время запроса;
- точный идентификатор модели, название ключа и видимый маскированный префикс;
- входные и выходные токены, чтение из кэша и запись в кэш;
- количество запросов, длительность и итоговое списание.
Сравнивайте итоговую сумму запроса со своей оценкой. Они могут различаться из-за фактического ответа, категорий кэша, рассуждений, тарифа длинного контекста или фактических данных о расходе. Если сумма всё ещё вызывает вопросы, передайте поддержке идентификатор запроса, точное время с часовым поясом, модель, название ключа и видимый маскированный префикс. Не отправляйте полный ключ или конфиденциальный текст запроса.
Проверьте пользу кэша
Откройте раздел Модели и проверьте, опубликованы ли для выбранной модели цены кэша и нужные параметры. Не меняйте повторяющееся начало запроса, используйте только параметры из supported_parameters и сравните счётчики кэша у двух последовательных запросов.
Нулевой счётчик означает, что обращение к кэшу не зафиксировано. Ненулевой счётчик не гарантирует скидку: если отдельной цены кэша у модели нет, применяется обычная цена входных токенов.
Учитывайте прерванные запросы
Если запрос завершился ошибкой до ответа модели и до подтверждённых данных о расходе, резерв освобождается без списания. Если часть потокового ответа уже доставлена или сервис получил подтверждённые данные о расходе, эта часть может быть оплачена. Не повторяйте запрос автоматически после начала ответа: сначала проверьте, получил ли клиент полезный результат и появилась ли запись в разделе использования.