← Все статьи
Новости13 мин чтения

api yandexgpt — первый запрос и расчёт стоимости

Как разработчику Yandex Cloud сделать первый запрос к YandexGPT через сервисный аккаунт и сразу связать его с честной сметой стоимости на дату проверки.

Обложка статьи: api yandexgpt — первый запрос и расчёт стоимости

Привычный порядок действий такой: получил ключ, отправил первый запрос, увидел ответ модели, поставил галочку «работает». Ошибка прячется именно в этой галочке. Рабочий ответ доказывает, что у тебя есть доступ. Он ничего не говорит о том, во сколько этот доступ обойдётся под нагрузкой продукта.

Дальше я предлагаю не разделять две проверки, которые обычно делают порознь: технический старт и финансовый расчёт. Соберём один паспорт функции «учётная запись — endpoint — тариф — сценарий» и потребуем, чтобы у одного контрольного сценария было и техническое, и денежное описание.

Ниже - где именно образуется разрыв между ответом и сметой, как выглядит заполненный паспорт и почему тарифные цифры здесь живут только вместе с датой проверки. Ближе к концу - отдельный случай: когда одного вендора команде мало и нужен рублёвый маршрут сразу к нескольким моделям.

Платите в рублях за GPT API без наценки на токены через provod.ai

Почему рабочий ответ - это ещё не смета

Спорное по умолчанию убеждение звучит так: «первый ответ достаточно доказывает пригодность функции». Он доказывает меньше, чем кажется. Авторизация и тарификация - это два разных этапа. По документации Yandex Cloud, если сервисному аккаунту не выдана роль на нужный каталог, запрос отклоняется на этапе авторизации, а не на этапе тарификации. То есть «ошибка доступа» и «дорого» - это сообщения из разных подсистем, и пройти первую не значит понять вторую.

Есть и обратная ловушка. Документация AI Studio отдельно различает квоты (организационные ограничения, которые меняются через обращение в поддержку) и лимиты (технические ограничения архитектуры платформы). Оба типа живут отдельно от тарифной таблицы. Поэтому «запрос прошёл» и «квота выдержит продакшн» - тоже не одно и то же.

Мой тезис прямой и его можно опровергнуть: первый YandexGPT-запрос вместе со сценарием тарифа позволяет подтвердить технический и финансовый контур одной функции - но только если один и тот же сценарий описан и с той, и с другой стороны. Если тариф не подтверждён на дату, или смета построена под другую нагрузку, паспорт недействителен - каким бы зелёным ни был первый ответ.

С чего начинается доступ: сервисный аккаунт, роль и folder_id

Первый запрос требует двух вещей: идентификатора каталога (folder_id) и учётных данных сервисного аккаунта. По документации Yandex Cloud, на этот каталог сервисному аккаунту должна быть присвоена роль ai.languageModels.user или выше. Без неё запрос не доходит до модели.

Важна физическая связь, которая пригодится при расчёте. modelUri для текстовой генерации строится по шаблону gpt://<folder_id>/yandexgpt (или .../yandexgpt-lite для облегчённой модели). Тот же folder_id, где выдана роль, попадает в тело запроса. Архитектура доступа и будущий тарифный сценарий указывают на один и тот же каталог - это удобно, потому что смету можно привязать ровно к тому folder_id, доступ к которому ты только что проверил.

Практический минимум перед первым вызовом выглядит так. Создать сервисный аккаунт. Назначить ему роль ai.languageModels.user на конкретный каталог. Запомнить folder_id этого каталога. Выпустить средство авторизации - об этом ниже отдельно, потому что тут чаще всего путаются. И только потом собирать HTTP-запрос: сначала право, потом endpoint.

Схема доступа YandexGPT: сервисный аккаунт, роль, folder_id и modelUri сходятся к одной развилке доступа и стоимости

Как собрать контрольный запрос

Авторизацию в заголовке официально можно передать двумя способами. Первый - Authorization: Api-Key <ключ> с API-ключом сервисного аккаунта. Второй - Authorization: Bearer <IAM-токен>. folder_id при этом допустимо передавать отдельным заголовком x-folder-id. Оба способа рабочие, но у них разный жизненный цикл, и для одноразового теста и для продакшна подходят разные.

Ниже - структура контрольного вызова. Точный HTTP-адрес эндпоинта возьми из quickstart AI Studio: документация переехала под бренд Yandex Cloud AI Studio, старые адреса вида cloud.yandex.ru/docs/yandexgpt/quickstart отдают редирект на aistudio.yandex.ru/docs/..., поэтому именно там сейчас лежит актуальный URL. Я намеренно не зашиваю host в текст - он менялся вместе с переездом.

# host эндпоинта берём из quickstart AI Studio (aistudio.yandex.ru) curl -s \
  -H "Authorization: Api-Key ${YANDEX\_API\_KEY}" \
  -H "x-folder-id: ${FOLDER\_ID}" \
  -H "Content-Type: application/json" \
  -d '{ "modelUri": "gpt://'"${FOLDER\_ID}"'/yandexgpt", "completionOptions": {"temperature": 0.3, "maxTokens": 200}, "messages": [{"role": "user", "text": "Проверка контрольного запроса"}] }' \
  "${YC\_ENDPOINT}"

Обрати внимание: modelUri содержит тот же ${FOLDER_ID}, что и заголовок x-folder-id и каталог, на который выдана роль. Это не косметика, а якорь сметы: считать стоимость ты будешь для того же каталога и той же модели, которую только что вызвал. Разрыв «проверил на одном, считаю на другом» закрывается на уровне переменной окружения.

Разбор контрольного запроса YandexGPT: заголовок авторизации, x-folder-id и modelUri используют один и тот же folder_id

Ключ, а не токен: что выпускать для продакшна

Здесь чаще всего спотыкаются. API-ключ и IAM-токен - разные сущности. По документации Yandex Cloud, API-ключ создаётся один раз, его секрет показывается только при создании (облако не может его восстановить), может быть ограничен по сроку действия и по scope - например, yc.ai.foundationModels.execute. IAM-токен, в свою очередь, короткоживущий. Поэтому для разового теста в консоли годится Bearer с IAM, а для продакшн-интеграции основным инструментом становится именно API-ключ со scope и сроком.

Практический вывод: не выпускай безлимитный ключ «на всё» ради первого запроса. Ограничь scope до исполнения foundation-моделей и поставь срок действия. Секрет запиши сразу - второй попытки посмотреть не будет.

Отдельная трудность на этом шаге - названия. Продукт переехал под бренд AI Studio, документация переименовалась вместе с ним, и один и тот же шаг сегодня описан десятком имён: латиницей и кириллицей, через «ключ», через «подключить», через «активировать». Чужие инструкции и ответы на форумах перемешаны между старой и новой терминологией. Таблица ниже разводит имена по существу: слева то, как шаг называют, справа - что за этим стоит на самом деле.

Как это называютОдин и тот же шагЧто за этим стоит
api yandexgpt, yandexgpt api, api yandex gpt, yandex gpt apiкак называется endpoint генерацииmodelUri gpt://<folder_id>/yandexgpt
яндекс gpt api, яндекс гпт апи, api яндекс гпт, яндекс гпт apiто же самое кириллицейтот же endpoint
yandexgpt api key, yandex gpt api key, api ключ yandexgpt, api ключ яндекс gpt, yandex gpt api ключ, яндекс гпт апи ключ, yandexgpt ключ, ai yandexgpt apikeyсоздать API-ключ сервисного аккаунтастраница get-api-key
яндекс gpt получить api, как получить api яндекс gpt, как получить api yandexgpt, как получить api ключ яндекс gptполучить доступ с нуляроль + folder_id + ключ
yandexgpt как подключить, как подключить яндекс gpt, подключить яндекс gpt, подключить яндекс гпт, подключение yandexgpt, как активировать api yandexgpt в каталогесвязать роль, каталог и запросquickstart AI Studio

Практический вывод из таблицы один. Если одна инструкция называет шаг яндекс гпт апи, а другая - yandex gpt api, это не два разных механизма: за обоими стоят та же роль на каталоге и тот же endpoint. Расходятся только скриншоты консоли, потому что часть из них снята до переезда на AI Studio.

Сколько стоит один вызов

Теперь денежная сторона. По официальной странице тарификации AI Studio на дату проверки 18 июля 2026 базовые модели считаются по токенам: YandexGPT Lite - 0.20 ₽ за 1000 токенов, YandexGPT Pro 5.1 - 0.80 ₽ за 1000 токенов. Сам Tokenizer для подсчёта токенов до отправки запроса - бесплатно.

И сразу поправка к самой постановке вопроса. yandexgpt api цена, yandex gpt api цена, яндекс gpt api цена, yandex gpt api стоимость, yandexgpt api стоимость - формулировки разные, вопрос один, и корректного ответа в рублях за вызов у него нет. Цена привязана к модели и к тысяче токенов, поэтому смета начинается не с прайса, а с оценки средней длины запроса и ответа в твоём сценарии.

Две честные оговорки. Первая - вендорская цифра требует ручной сверки. Страницы aistudio.yandex.ru закрыты антибот-проверкой для автоматического обращения, поэтому часть тарифа зафиксирована по индексированным фрагментам именно этих официальных URL, а не по полному рендеру страницы. Вторая - независимые агрегаторы в параллельных источниках называли для «Pro» разные числа (0.40 против 0.80 ₽), что похоже на недавнее изменение прайса или путаницу версий Pro/Pro 5.1. Это ровно тот тип волатильности, который надо фиксировать «на дату», а не заучивать как константу. Перед публикацией сметы открой тарифную страницу руками.

И тонкость, которая ломает наивный расчёт. Единица тарификации округляется вверх до целого биллингового юнита. Значит даже короткий тестовый запрос тарифицируется не пропорционально факту, а по минимальному оплачиваемому шагу. Смета «мой контрольный вызов стоил X, умножаю на число вызовов» занижает результат на коротких сообщениях.

Соберём паспорт в одну таблицу. Слева - элемент, справа - что он доказывает и откуда цифра.

Элемент паспортаЧто проверяетЗначение / источникКонтур
Сервисный аккаунт + роль ai.languageModels.userправо вызвать модельYandex Cloud, quickstartдоступ
modelUri gpt://<folder_id>/yandexgptадрес моделиYandex Cloudдоступ
Авторизация Api-Key или Bearer IAMспособ входаYandex Cloudдоступ
Тариф Lite 0.20 ₽ / Pro 5.1 0.80 ₽ за 1000 токеновцена за объёмAI Studio pricing, 2026-07-18стоимость
Округление до целого billing unitминимальный шаг оплатыAI Studio pricingстоимость
Квоты sync/asyncграницы нагрузкиAI Studio limitsсценарий

Контур подтверждён только тогда, когда заполнены все три колонки «контур» для одного и того же сценария. Одна пустая клетка в столбце «стоимость» - и функция технически работает, но её цена не посчитана ни под один реальный сценарий.

Столбчатая диаграмма тарифа YandexGPT: Lite 0.20 рубля и Pro 5.1 0.80 рубля за тысячу токенов

Иной рублёвый маршрут, если моделей должно быть несколько

Yandex Cloud - это один вендор и один каталог. Если продукту нужен именно YandexGPT внутри контура Яндекса, оставайся в AI Studio: здесь ничего не подменяется, и частную или on-prem инфраструктуру тоже никто не отменяет.

Но у паспорта есть неприятное свойство: он собирается заново под каждого вендора. Вторая модель - это второй сервисный аккаунт, второй ключ, второй счёт и своя единица тарификации, которую придётся приводить к общему знаменателю вручную. На эту задачу отвечает provod.ai, российский аналог OpenRouter: один API к Claude, GPT, Gemini, DeepSeek, Qwen и другим моделям. Он совместим с OpenAI-протоколом, поэтому смена маршрута стоит двух строк, а не переписывания клиента:

client = OpenAI( api\_key="<provod\_key>", base\_url="https://api.provod.ai/v1", )

Для сметы существенно одно: баланс остаётся один и рублёвый - карта, СБП или счёт для юрлица, - а модели идут по ценам провайдеров без наценки сверху. Колонка «стоимость» перестаёт размножаться по числу вендоров. Паспорт это не отменяет: у любого маршрута остаётся свой proof-of-access и свой proof-of-cost - просто считать их приходится в одном месте, а не в консоли каждого вендора по отдельности.

Чего смета из одного запроса не покрывает

Один контрольный вызов - это синхронный режим. По документации, синхронная генерация текста ограничена квотой 10 одновременных запросов. Асинхронный режим устроен иначе: до 10 запросов в секунду на создание задачи и до 5000 запросов в час, а результат асинхронной генерации хранится 3 дня. Смета, построенная на «одном контрольном запросе», физически не описывает асинхронный или пакетный сценарий: там другая единица нагрузки и другие границы.

Отсюда правило: если продукт пойдёт в пакетную обработку, паспорт нужно пересобрать под асинхронный сценарий, а не масштабировать цифру синхронного теста. И помни про разницу квот и лимитов - квоты Yandex оставляет изменяемыми по обращению в поддержку, то есть значения не гарантированно статичны для конкретного аккаунта.

Сравнение синхронного и асинхронного режимов YandexGPT по квотам и хранению результата

Чего этот сценарий вообще не решает

Паспорт «доступ плюс стоимость» - узкий инструмент, и очертить его границы честнее, чем расширить обещания.

Он не содержит действующих тарифов как вечных констант: цифры 0.20 и 0.80 ₽ живут только с датой сверки. Он не подтверждает продуктовую пригодность сам по себе - рабочий endpoint без сметы её не доказывает, а пройденная квота не равна выдержанной нагрузке. Он не покрывает дообучение: открытого подтверждения тарифа на fine-tuning в проверенных источниках нет, поэтому никаких цифр по нему здесь не будет.

И он не про архитектуру всего продукта. Это проверка одной функции до внедрения - чтобы финансовая ошибка всплыла сейчас, а не после интеграции, когда она стоит дороже.

Итог: не разделяй proof-of-access и proof-of-cost

Решение, к которому я пришёл: считать сценарий готовым к внедрению только после того, как один и тот же вызов описан с двух сторон - доступ и стоимость - в одном паспорте. Первый ответ ставит галочку «работает». Паспорт ставит галочку «понятно, во сколько работает». Пока вторая пустая, функция работает, но её стоимость не посчитана, - и это самый дорогой вид готовности.

Следующий конкретный шаг: открой тарифную страницу AI Studio руками, сверь 0.20 и 0.80 ₽ на сегодняшнюю дату, привяжи их к тому же folder_id, на котором проверял доступ, - и только тогда закрывай задачу.

FAQ

yandexgpt api это языковая модель или нет?

Да. Это доступ по HTTP к большой языковой модели Yandex Cloud: endpoint принимает modelUri и возвращает текстовую генерацию. Отдельного «не-модельного» режима у этого адреса нет.

Есть ли бесплатный режим?

То, что ищут как yandexgpt api бесплатно или yandex gpt api бесплатно, упирается в Tokenizer: подсчёт токенов до отправки бесплатен, сама генерация тарифицируется по токенам. Бесплатного продакшн-объёма из проверенных фактов не следует - актуальные условия смотри на странице тарификации.

Какую модель указывать в интеграции с no-code?

Для связки yandexgpt n8n и подобных клиентов важны те же три вещи - folder_id, роль и API-ключ; сам modelUri в поле модели строится так же. Конкретно yandexgpt 5 pro api в паспорте - это строка тарифа Pro 5.1 (0.80 ₽ за 1000 токенов на дату проверки) и .../yandexgpt в URI.

Как быстрее всего сделать интеграцию?

Любая интеграция yandexgpt начинается не с кода, а с роли на каталоге: без ai.languageModels.user запрос не пройдёт авторизацию, и никакой клиент это не обойдёт.

provod.ai - рублёвый доступ к нескольким моделям в одном API с командными workspace и оплатой из России

provod.ai — сократите интеграционный зоопарк вокруг AI

Один совместимый API заменяет отдельную обвязку каждого вендора: разработчики быстрее добавляют AI-функции, а продуктовая команда свободнее выбирает модель под качество, скорость и задачу.

В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

За удобство роутинга нет отдельной ценовой надбавки: стоимость остаётся 1:1 с официальной ценой поставщика, а расчёты собираются на одном рублёвом балансе.

Упростите AI-архитектуру продукта: форма регистрации · цены на модели · защита данных по 152-ФЗ · главная provod.ai

Источники