Одна полезная ссылка в ответе бывает дешёвой в демо и непредвиденной в ежедневном потоке. Ты нажимаешь «добавить поиск в фичу», прогоняешь двадцать тестовых запросов, видишь центы в консоли и ставишь галочку «дёшево». Через месяц та же фича под реальной нагрузкой генерирует счёт, который никто не закладывал в юнит-экономику. Причина не в жадности вендора, а в том, что поисковый ответ - это не обычный вызов языковой модели, и тарифицируется он иначе.
Эта статья - не сравнение чат-моделей и не обзор «кто умнее». Это операционная смета: как продакту поиска до интеграции посчитать, выдержит ли бюджет ожидаемую поисковую активность, и где поставить порог, за которым функцию просто нельзя включать. Все цифры ниже взяты из живых страниц docs.perplexity.ai по состоянию на 18 июля 2026 года. Это датированный снимок, а не зафиксированный контракт: Perplexity уже один раз перестраивала эту поверхность, так что перед запуском калькулятора с точными числами сверься с консолью заново.
Сразу оговорю границу, чтобы дальше не путаться. Непоисковая часть продукта - обычные ответы модели - оплачивается отдельным маршрутом: из России это provod.ai (российский аналог OpenRouter) с рублёвым балансом. Поисковый контракт Perplexity он не заменяет, и вся смета ниже - про Perplexity.
Подключите модели для поиска и баз знаний с оплатой в рублях на provod.ai
Чем поисковый ответ отличается от обычного LLM-вызова?
Спорное допущение, из-за которого ломаются сметы: поисковый ответ можно считать обычным запросом к модели. По интерфейсу так и кажется - тот же chat-completions, те же токены на входе и выходе. Но в тарифах Perplexity у поисковых моделей Sonar есть вторая статья, которой нет у голого генеративного вызова.
Первая статья - токены, как везде. По ценнику Perplexity (docs.perplexity.ai, 18.07.2026): Sonar - $1 за 1M входных и $1 за 1M выходных, Sonar Pro - $3/$15, Sonar Reasoning Pro - $2/$8. Вторая статья - отдельный сбор за тысячу запросов, который зависит от параметра search_context_size со значениями low, medium, high. Для Sonar это $5/$8/$12 за 1000 запросов, для Sonar Pro и Sonar Reasoning Pro - $6/$10/$14 за 1000 запросов. Этот сбор существует помимо токенов и начисляется на каждый вызов.
Здесь спрятана ловушка по умолчанию. Perplexity документирует, что search_context_size по умолчанию равен «low», если вызывающий код не задал значение явно. Как только ты поднимаешь контекст до medium или high ради качества ответа, ты увеличиваешь сбор за каждый последующий запрос - при этом токенная цена не меняется. Решение «сделаем ответы поумнее» умножает постоянную статью расходов на всю будущую частоту.
Практический вывод простой: любой perplexity sonar api вызов надо считать как «токены плюс сбор за запрос», а не как один токенный счёт. В демо на двадцати запросах сбор за тысячу почти незаметен. На потоке в десятки тысяч запросов в день он становится основной строкой сметы, и именно он превращает поисковую функцию в регулярную операционную статью.
Соберём это в наглядную вилку, прежде чем перейти к цифрам под нагрузкой.

Калькулятор: тип запроса, частота, стоимость, лимит
Дальше начинается моё моделирование, а не факт от Perplexity. Вендор публикует тарифы; сколько запросов в день сделает твоя фича - это твоя гипотеза, и калькулятор нужен именно для того, чтобы проверить её на выживаемость. Четыре входа: тип запроса (какая модель и какой search_context_size), частота (запросов в день), стоимость (токены плюс сбор), лимит (потолок, который ты готов терпеть).
Возьмём сценарий. Модель - Sonar Pro, контекст medium, сбор $10 за 1000 запросов. Частоту я задаю сам - пусть 10 000 поисковых ответов в день; это модельное число, а не наблюдение. Тогда только сбор за запросы даёт 10 000 × $10 / 1000 = $100 в день. Добавим токены: допустим, 500 входных и 800 выходных токенов на ответ. Вход - 5M токенов × $3 = $15, выход - 8M × $15 = $120. Итого около $235 в день, из которых почти половина - тот самый сбор за запросы, которого в обычном чат-вызове просто нет.
Теперь тот же объём на «low» контексте: сбор $6 за 1000 даёт $60 в день вместо $100. Одно значение параметра - разница в $40 в сутки на этом сценарии, или больше тысячи долларов в месяц. Это и есть управляемый рычаг: качество контекста стоит денег линейно по частоте, и его надо назначать осознанно, а не оставлять на дефолте.
Важная методическая оговорка. Perplexity в документации по лимитам публикует только потолки запросов в минуту (RPM); ни лимита токенов в минуту, ни токенов в сутки для моделей Sonar в доке нет. Значит, модель нагрузки строится на объёме запросов, а не на объёме токенов. Это удобно для калькулятора: частота запросов - твоя главная переменная, и именно её нельзя экстраполировать за пределы того, что ты реально измерил.
Отдельно посчитай автоматизацию. Поиск редко висит на живом пользователе: чаще это интеграция n8n perplexity в рабочий процесс, бот в ватсапе perplexity для клиентских вопросов или подключение инструмента через perplexity web api mcp. Во всех трёх случаях частоту задаёт сценарий, а не человек. Один вопрос разворачивается в три-четыре поисковых шага, и каждый шаг - отдельный оплаченный запрос со своим сбором. Считать надо вызовы, а не диалоги, иначе смета занижена ровно во столько раз, сколько шагов в цепочке.
Прежде чем строить смету на кодовом уровне, стоит увидеть, как одно значение контекста двигает дневной счёт.

Смета на уровне кода: явный контекст и ключи
Считать в голове бесполезно: смету задают параметры в вызове. На уровне кода perplexity api - это OpenAI-совместимый chat-completions, где ты явно задаёшь модель и search_context_size, чтобы не платить за дефолт, которого не выбирал. Ниже - минимальный набросок вызова с явным контекстом; ключ (perplexity api key) держим в переменной окружения, а не в коде.
import os from openai import OpenAI
client = OpenAI( api\_key=os.environ["PERPLEXITY\_API\_KEY"], base\_url="https://api.perplexity.ai", )
resp = client.chat.completions.create( model="sonar-pro", messages=[{"role": "user", "content": "Сравни два тарифа поиска"}], extra\_body={"search\_context\_size": "low"}, # явный дефолт против скрытого сбора )
Обрати внимание на форму вызова: это ровно тот же клиент OpenAI, у которого подменили base_url. Поэтому непоисковую часть продукта - обычные ответы Claude, GPT, Gemini, DeepSeek или Qwen - можно увести на другой платёжный маршрут той же правкой двух строк. provod.ai совместим с SDK OpenAI и Anthropic и считает по официальным ценам провайдеров без наценки, с оплатой в рублях.
from openai import OpenAI
client = OpenAI( api\_key="PROVOD\_KEY", base\_url="https://api.provod.ai/v1", # тот же SDK, другой маршрут оплаты )
Так две статьи разводятся по разным контурам: поисковый perplexity ai api - по договору с Perplexity и его сбору за запросы, а генеративная часть - там, где удобнее платить из России. Смешивать их в одной смете нельзя: у них разные единицы тарификации.
Какие лимиты и тарифы прячет демо?
Частота упирается не только в бюджет, но и в потолок. RPM-лимиты Sonar привязаны к суммарной сумме купленных кредитов за всё время - шесть тиров от Tier 0 при $0 до Tier 5 при $5000 и выше. Для sonar-pro потолок растёт по лестнице тиров 50 → 150 → 500 → 1000 → 4000 → 4000 запросов в минуту, а sonar-deep-research упёрт заметно ниже - 5–100 RPM (docs.perplexity.ai, 18.07.2026). То есть чем интенсивнее поиск, тем раньше ты обязан «докупить» лимит - и это ещё один вход в калькулятор.
Оговорка по данным: в сверенной таблице RPM были расписаны sonar-pro, sonar-reasoning-pro и sonar-deep-research, а собственный потолок базовой модели «sonar» отдельно не выделен. Для калькулятора, который моделирует именно базовый трафик, это число надо переподтвердить в живой консоли, а не додумывать.
Теперь про самый жёсткий отказ. Биллинг API предоплатный: он списывается с кредитного баланса, и когда баланс достигает нуля, ключи блокируются полностью - это жёсткая остановка, а не троттлинг. Perplexity в документации по биллингу прямо рекомендует включить авто-пополнение на заданном пороге, чтобы не наступить на этот сценарий. Для продакта это значит: без наблюдаемого бюджета и порога поисковая фича может не «подорожать», а просто выключиться в проде посреди дня.
Из предоплатной механики следует и терминологическая поправка, на которой спотыкаются при закупке. Когда ищут perplexity api купить, на деле ищут способ пополнить кредитный баланс: ключ выпускается в консоли и сам по себе ничего не стоит. Формулировка «купить ключи perplexity» описывает ту же операцию неточно - платишь ты за кредиты, а не за ключ, и именно сумма купленных кредитов за всё время двигает тебя по лестнице тиров выше.
Отсюда моя нормативная позиция: не встраивать поиск без лимита и без наблюдаемого бюджета. Это спорный компромисс - порог режет часть запросов и ухудшает опыт на пике. Но альтернатива «запустить поиск без порога» проваливается уже на входе: частота, которую ты подставляешь в смету, ничем не измерена, а занять её у демо нельзя.

Куда именно ты интегрируешься: Sonar, Agent API или Search API?
Смета бессмысленна, если посчитана не для того продукта. У Perplexity сейчас три разных поисковых поверхности, и они тарифицируются по-разному. Sonar-чат - это токены плюс сбор за запросы, разобранные выше. Но по текущей публикации Sonar официально помечен как «now in maintenance mode», и документация рекомендует новым интеграциям начинать с Agent API.
Agent API - рекомендованный преемник для веб-заземлённых интеграций - это отдельная мультипровайдерная спецификация со своим pay-as-you-go биллингом. В его quickstart нет той же лестницы search_context_size и сбора за 1000 запросов, что управляет Sonar. Значит, калькулятор, построенный на ценнике Sonar, не переносится на Agent API автоматически - его придётся пересобирать под другую модель тарификации.
Третья поверхность - отдельный perplexity search api, который возвращает сырые ранжированные веб-результаты без синтеза LLM, тоже по своему pay-as-you-go. Поэтому первый вопрос сметы - не «сколько стоит поиск», а «какой именно продукт я интегрирую»: чат Sonar, Agent API или Search API. Три ответа - три разные сметы.
Из-за этой развилки сверка тарифов превращается в отдельную работу, и мешает ей русскоязычная выдача. Пересказы пишут продукт то как перплексити api, то как перплексити апи, и почти никогда не уточняют, о какой из трёх поверхностей речь. Рядом идёт perplexity pro api, под которым половина авторов имеет в виду подписку на веб-версию - у неё с API-биллингом нет ничего общего. Даже страницы с заголовками perplexity api price и perplexity api pricing бывают про разные поверхности и разные даты. Проверяй поэтому не заголовок, а тарифную единицу: нет сбора за 1000 запросов и лестницы search_context_size - перед тобой не Sonar.
И честная бизнес-оговорка. То, что я называю «первичными условиями Sonar», - это условия продукта, от которого Perplexity сама уводит интеграторов в режим обслуживания. Тариф может измениться, продукт может уехать дальше по жизненному циклу. Строить долгую фичу на maintenance-mode продукте можно, но это решение стоит принимать явно.
| Что интегрируешь | Единица тарификации | Статус / риск |
|---|---|---|
| Sonar чат | токены + сбор за 1000 запросов | maintenance mode, уводят на Agent API |
| Agent API | свой pay-as-you-go, без лестницы Sonar | рекомендованный вход для нового |
| Search API | свой pay-as-you-go, сырые результаты | без синтеза LLM |
Собери эти развилки в один порядок действий, прежде чем звать разработку.

Границы этой сметы
Калькулятор связывает тип запроса, частоту, стоимость и лимит - и на этом его установленная зона заканчивается. Дальше идут вещи, которые он честно не закрывает.
Он не содержит актуальную цену и не заменяет договорные условия. Все числа - снимок на 18 июля 2026 года; Perplexity уже перестраивала эту поверхность, так что тарифы, тиры и даже то, какой API считается «тем самым» поисковым продуктом, могут смениться без предупреждения. Модель работает только в пределах зафиксированной частоты запросов - экстраполировать её за этот предел нельзя.
Он не отвечает на региональные вопросы оплаты. За формулировками «как оплатить perplexity в россии 2026» и «как можно оплатить perplexity в россии» стоят валюта, НДС и способ платежа - ни одна из шести сверенных страниц их не описывает. Тот же провал у запроса «perplexity enterprise купить»: корпоративные условия обсуждаются в переговорах и в публичной доке отсутствуют. Здесь честный ответ - «не подтверждено», и вписывать вместо него правдоподобную догадку в смету нельзя.
И он не заменяет генеративный контур. provod.ai закрывает оплату и маршрут к моделям вроде Claude, GPT, Gemini, DeepSeek и Qwen из России, но веб-поиска Sonar не даёт и контракт с Perplexity не отменяет.
FAQ
Поиск через API - это бесплатно?
Нет. Биллинг предоплатный по кредитному балансу, а при нуле ключи блокируются жёстко. Запросы «perplexity api бесплатно» и «perplexity api free» ищут тариф, которого у поискового API нет: есть только предоплаченные кредиты.
Почему «api perplexity» дороже обычного чат-вызова?
Из-за второй статьи - сбора за 1000 запросов по search_context_size, которого у голого токенного вызова нет.
Как посчитать смету заранее?
Возьми модель, задай search_context_size, оцени частоту запросов в день, сложи токены и сбор за запросы, поставь порог. Числа тарифов бери из живой доки на дату расчёта.
Можно оплатить из России?
Региональные условия оплаты Perplexity в сверенной документации не описаны. Для генеративной части продукта оплата из России решается отдельным маршрутом, для поиска Sonar - нет.
Sonar - это навсегда?
Нет. Он в режиме обслуживания, документация рекомендует Agent API для нового. Считай это фактором риска сметы.
Вопрос «как включить перплексити» в продукте решается не в коде и не в консоли, а здесь: поиск включается только с лимитом и наблюдаемым бюджетом. Если частота не измерена, тариф не подтверждён на дату, а порог не поставлен - функцию не включаем, потому что калькулятор в этом случае просто нечем заполнить.

provod.ai — роли и отдельные аккаунты для AI-команды
Не передавайте коллегам личные логины и ключи: разделяйте доступ внутри корпоративного пространства и сохраняйте централизованное управление рабочими сценариями.
В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.
Управляемые доступы идут без тарифной надбавки агрегатора: стоимость моделей остаётся 1:1 с официальными ценами провайдеров.
Организуйте безопасную командную работу: форма регистрации · цены на модели · защита данных по 152-ФЗ · политика обработки данных
Источники
Все шесть страниц - первоисточник вендора, docs.perplexity.ai; выборка сделана 18 июля 2026 года.
- Страница цен (
getting-started/pricing) - токенные тарифы Sonar, сбор за 1000 запросов и значениеsearch_context_sizeпо умолчанию. - Лимиты и тиры использования (
admin/rate-limits-usage-tiers) - RPM-лестница по сумме купленных кредитов; токенных потолков на странице нет. - Sonar quickstart (
sonar/quickstart) - отметка о переводе в maintenance mode и рекомендация Agent API. - Agent API quickstart (
agent-api/quickstart) - собственный pay-as-you-go, лестницы Sonar в документе нет. - Search API quickstart (
search/quickstart) - сырые ранжированные результаты без синтеза LLM, отдельный биллинг. - Биллинг и группы API (
getting-started/api-groups) - предоплата кредитами, блокировка ключей при нулевом балансе, рекомендация авто-пополнения.
