← Все статьи
Новости9 мин чтения

Аренда GPU России: когда дешевле взять час, а когда — один раз купить карту

Три прайс-листа, две методики расчёта окупаемости и один инцидент с блокировкой драйверов — вот что нужно свести воедино, прежде чем платить за GPU почасово или тащить видеокарту домой.

Обложка статьи: Аренда GPU России: когда дешевле взять час, а когда — один раз купить карту

Три прайс-листа, две методики расчёта окупаемости и один инцидент с блокировкой драйверов — вот что нужно свести воедино, прежде чем платить за GPU почасово или тащить видеокарту домой.

Платите в рублях за AI-модели без наценки на токены через provod.ai

Снимок цен на 26 июля 2026

Эти цифры имеет смысл свести заранее — до первого платежа, а не по факту счёта за месяц. У Selectel официальный калькулятор облачных GPU называет 292,02 ₽/час за Tesla A100 80GB и 75,40 ₽/час за RTX 4090 24GB, с НДС — цены на услуги Selectel. У Hostkey сейчас акция минус 30%: H100 80GB — 207 ₽/час, A100 — 153 ₽/час, но дата-центр физически стоит в Исландии: для персональных данных это меняет юрисдикцию, для личных экспериментов вопрос второстепенный — новость Hostkey об акции на H100. У immers.cloud ставки «от»: H100 от 353 ₽/час, A100 от 223 ₽/час, RTX 4090 от 86,7 ₽/час, RTX 3090 от 70,7 ₽/час, посекундное списание, депозит от 100 ₽ — тарифы immers.cloud. Разброс в разы даже на одну и ту же модель карты — уже сам по себе повод не подписываться на первое предложение.

За запросом «аренда gpu россия» скрываются три разные ценовые политики с разной географией и разной степенью прозрачности происхождения железа. Единой рыночной цены здесь просто нет.

Порог в 40 часов против порога в 140 000 диалогов

Здесь ровно та точка, где эксперты расходятся, и расхождение не косметическое. AdminVPS — сам продавец аренды — считает, что покупка RTX 4090 (230 000–250 000 ₽ за карту против аренды 80–120 ₽/час) окупается примерно за год уже при нагрузке от 40 часов в неделю — материал AdminVPS о покупке против облака. CTO компании OSMI IT Денис Нагаев видит совсем другой порог: переход на собственное железо оправдан только при промышленном трафике — свыше 140 000 диалогов в сутки и контекстах от 100 000 токенов, при этом окупаемость растягивается на 24 месяца. «Собственная инфраструктура даёт больше стабильности: нет очередей и ограничений по скорости, нет кредитных лимитов», — пишет он, имея в виду корпоративный LLM-инференс на нескольких A100; к личному ноутбуку с одной картой этот расчёт отношения не имеет — разбор Нагаева на Habr.

Разница на порядок объясняется тем, что считают эти двое. AdminVPS сравнивает голую почасовую ставку с ценой карты. Нагаев считает загрузку промышленного сервиса, где простаивающий GPU уносит ещё и упущенную выручку поверх оплаченного часа. Если вы читатель, который собирается гонять локальную модель для своих задач несколько раз в неделю, порог AdminVPS ближе к вашей реальности — но занижен в свою пользу, потому что AdminVPS сам зарабатывает на аренде.

Третий голос вообще выносит окупаемость за скобки. Автор Liugger, собравший домашний сервер на четырёх GPU, посчитал, что аналогичные облачные тарифы обошлись бы в 12 768–169 920 ₽ в месяц, тогда как электричество его сборки — 4 410 ₽ за 30 дней круглосуточной работы. «Токены у меня условно-бесплатны, а лимиты условно-бесконечны», — говорит он: главный выигрыш здесь измеряется свободой не считать каждый запрос, рубли идут вторым номером — пост Liugger на Habr. Проблема с его сравнением честно указана в самом источнике: сопоставлены разные модели без единой метрики качества, а стоимость самой сборки раскрыта не полностью — это аргумент про образ жизни, который на строгий расчёт и не претендует.

Формула, с которой можно спорить с числами в руках

02 evidence

Универсального порога нет, но есть формула, которая закрывает разрыв между тремя позициями. Ежемесячная стоимость аренды равна часовой ставке, умноженной на часы в неделю и на 4,33. Срок окупаемости покупки — цена карты, делённая на эту сумму.

Мини-калькулятор для Google Sheets или Excel:

Цена карты, ₽:              240000 Ставка аренды, ₽/час:       100 Нагрузка, часов/неделю:     40 Месячная аренда, ₽:         =B2*B3*4,33 Окупаемость покупки, мес.:  =B1/B4

В ячейки B1, B2 и B3 подставляются ваши числа: цена карты, ставка конкретного провайдера и реальная недельная загрузка. Если в B4 получается сумма меньше вашего терпимого месячного бюджета, аренда выигрывает сейчас; если B5 падает к 12–14 месяцам и карта будет занята почти ежедневно, покупку уже стоит считать всерьёз.

Возьмём RTX 4090: цена карты 240 000 ₽ (середина диапазона AdminVPS), усреднённая ставка аренды 100 ₽/час (диапазон AdminVPS и Selectel):

Нагрузка, часов/неделюАренда, ₽/месяцОкупаемость покупки
10~4 330~55 месяцев (4,6 года)
20~8 660~28 месяцев (2,3 года)
40~17 320~14 месяцев (~1,2 года)
60~25 980~9 месяцев
168 (24/7)~72 700~3,3 месяца

Подставьте свою карту, свою ставку и своё реальное количество часов — формула не меняется, меняются только вводные. Ключевой вывод из таблицы: тезис AdminVPS про «~год при 40 часах» подтверждается расчётом (13–14 месяцев), но при нагрузке ниже 20 часов в неделю аренда выигрывает с огромным запасом — окупаемость покупки растягивается за горизонт разумного планирования.

Серые H100 и вопрос, который вендоры не задают сами себе

Здесь и начинается самое неудобное. Провайдеры, рекламирующие H100 и H200 по фиксированной почасовой ставке, физически не могут получать эти карты через официальные каналы NVIDIA — экспортные ограничения США на топовые дата-центровые ускорители никто не снимал. Tom's Hardware со ссылкой на отраслевые оценки пишет, что Россия рассчитывает получить 100 000–150 000 чипов H100 в обход экспортных ограничений через параллельный импорт, а цена карты на чёрном рынке — около 20 000 долларов — материал Tom's Hardware о серых поставках H100. Это оценка объёма, не таможенная статистика, но она объясняет, почему в рассмотренных тарифах провайдеров происхождение карты и гарантия производителя не раскрыты.

Аренда снимает с клиента заботу о железе, но не снимает юридический статус этого железа — она просто переносит риск на баланс провайдера, который об этом риске молчит в прайс-листе. Для бизнеса с комплаенс-требованиями это не абстракция: если контрагент спросит про происхождение вычислительных мощностей, у арендатора H100 в России сегодня скорее всего не будет внятного ответа.

С массовыми потребительскими картами картина мягче, но не однозначнее. После запрета на поставки RTX 4090 в октябре 2023 года розничная цена в РФ выросла со 150 000 до 200 000 ₽ — новость о росте цены RTX 4090 в 2023 году. В обновлённой версии экспортного документа США от октября 2024 года запрет на RTX 4090 и L40 уже не упоминается — формально он снят — материал об обновлённом экспортном документе США. Юридическое снятие запрета не равно свободной официальной поставке: розница по-прежнему идёт окольными маршрутами, и купленная сегодня карта не обязательно застрахована гарантией производителя.

Если задача — не тренировка своей модели, а просто стабильный доступ к уже готовым моделям через API, весь этот спор о происхождении железа становится избыточным: сервисы вроде provod.ai дают доступ к каталогу поддерживаемых моделей через один OpenAI-совместимый интерфейс, и переход между провайдерами моделей не требует переписывания клиента — меняется base URL и ключ. Для части читателей вопрос про GPU при таком сценарии просто перестаёт стоять.

Что показал день блокировки драйверов

03 decision

23 октября 2024 года пользователи из России на сутки потеряли доступ к официальным драйверам NVIDIA — запросы блокировал файрвол Edgecast — новость РИА о блокировке драйверов. Уже на следующий день доступ восстановили для большинства пользователей — новость РГ о восстановлении доступа. Государственные СМИ описали это как быстро устранённый технический сбой. Независимый ИИ-исследователь Yam Peleg увидел в этом другое: «Nvidia just blocked all CUDA updates from Russia. I wouldn't wish that on my worst enemies» — он прочитал инцидент как избыточную меру, которая вполне может повториться — твит Yam Peleg о блокировке CUDA.

Практический вывод из этого расхождения одинаков для обоих сценариев — и для домашней карты, и для аренды. Если вы ставите драйверы и CUDA сами, держите под рукой зеркало установщиков и nvcleanstall на случай повторной блокировки — сутки простоя в 2024 году не гарантируют, что следующий инцидент разрешится так же быстро. Если вы арендуете GPU у российского провайдера, эта проблема формально не ваша — но она становится вашей в момент, когда провайдер сам не может обновить прошивку или CUDA toolkit на своих серверах.

Где проходит граница выбора

Для бизнеса с требованиями по комплаенсу и защите данных происхождение арендованного H100 превращается в юридический риск, который сложно закрыть договором с провайдером, если у самого провайдера нет прозрачной цепочки поставки. В такой ситуации важен российский договорный и платёжный контур: у provod.ai есть баланс организации в рублях, контроль расходов команды и закрывающие документы от российского юрлица. Вопрос железа это не закрывает, зато отделяет оплату и документооборот за доступ к поддерживаемым моделям от покупки или аренды спорной GPU-инфраструктуры.

Если у вас меньше 20 часов реальной загрузки в неделю — аренда GPU России почти всегда обходится дешевле, чем покупка карты, и не стоит тратить время на калькуляцию: берите час у Selectel, immers.cloud или аналогичного провайдера. Если нагрузка приближается к 40 часам и выше — садитесь за формулу выше и считайте на своих числах: разница между позициями AdminVPS и Нагаева — это разница между личным экспериментом и промышленным сервисом, и цифры это доказывают лучше любого мнения.

provod.ai — российский LLM API-агрегатор

Один OpenAI-совместимый endpoint вместо набора интеграций: подключайте модели к продукту, агентам, IDE и SDK через общий API. Во многих совместимых инструментах достаточно заменить base_url и API-ключ.

В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

Цены 1:1 с официальными ценами провайдеров — без собственной наценки provod.ai. Оплата в рублях, единый баланс и документы для юридических лиц.

Если статья была полезной — попробуйте provod.ai: форма регистрации · цены на модели · защита данных по 152-ФЗ · API и интеграции

Источники