← Все статьи
Новости9 мин чтения

Гига чат бесплатный: два документа Сбера — и в 365 раз разные цифры бесплатной квоты

Свежая документация и продуктовая витрина того же вендора в один день называют разные лимиты freemium — разница в 365 раз, и это меняет то, на сколько вам реально хватит бесплатного доступа.

Обложка статьи: Гига чат бесплатный: два документа Сбера — и в 365 раз разные цифры бесплатной квоты

Свежая документация и продуктовая витрина того же вендора в один день называют разные лимиты freemium — разница в 365 раз, и это меняет то, на сколько вам реально хватит бесплатного доступа.

Если вбить в поиск «гига чат бесплатный», кажется, что вопрос закрыт: сайт, приложение, бот и API — всё бесплатно. На деле у Сбера это два разных обещания, и путать их — значит планировать работу на неверных цифрах.

Подключите модели для поиска и баз знаний с оплатой в рублях на provod.ai

365 000 000 против 1 000 000

22 июля 2026 года страница «Тарифы GigaChat API для физлиц» обновилась и объявила: в рамках freemium-режима физлицу доступно 365 000 000 токенов на генерацию текста, обновляемых раз в 12 месяцев. Квота разложена по семействам моделей — Lite получает 250 млн токенов, Pro 40 млн, Max 25 млн, Ultra 50 млн. То есть free не выгорает разом: сначала кончится то семейство, которым вы реально пользуетесь, а остальные останутся живы.

Проблема в том, что на соседней странице того же домена — продуктовой витрине GigaChat API — та же бесплатная квота для личного использования описана иначе: 1 000 000 токенов с ежегодным возобновлением, и рядом кнопка «Купить» на случай, если токены закончились. Разница — 365 раз, и ни одна из страниц явно не отменяет другую.

У цифры в миллион есть датированная история. Независимый разбор на SecurityLab от 6 апреля 2026 года фиксировал именно 1 000 000 токенов на 12 месяцев — значит, миллион держался минимум до весны, а к 22 июля документация показывает уже 365 миллионов. Похоже на реальное повышение лимита, которое просто не долетело до витрины. Для читателя, который строит план работы сегодня, вывод один: число из статьи (в том числе из этой) стоит перепроверять на первоисточнике перед каждым планированием, а запоминать его как константу бессмысленно.

Что реально давит в API раньше счётчика токенов

Даже если считать верной щедрую цифру в 365 млн, до неё вы не обязательно доберётесь — квота не единственный ограничитель.

Во-первых, физлицу в API доступен ровно один поток генерации — расширение только по письму на gigachat@sberbank.ru. Лимит одновременных запросов привязан к client_id, а физлицу выдан один поток, поэтому распараллеленный скрипт получит HTTP 429 «Слишком много запросов» на втором одновременном запросе — задолго до исчерпания токенов.

Во-вторых, есть эксплуатационная ловушка на входе: OAuth-токен доступа живёт 30 минут, а запрашивать его можно не чаще 10 раз в секунду. Типичная ошибка новичка — получать токен перед каждым сообщением — упрётся в лимит частоты раньше, чем в токеновую квоту, хотя формально «место» ещё есть.

В-третьих, на исчерпании собственно токенов сервис не деградирует тихо: API отдаёт HTTP 402 с описанием «Закончились токены модели, к которой выполняется запрос» (в gRPC — код 8). Запрос падает целиком, автоматического отката на более дешёвую модель не происходит — это решение нужно закладывать в код самому.

Практическая мораль для разработчика: 429 вместо 402 означает упор в конкурентность единственного потока, и докупка токенов тут ничего не изменит. Если после 429 вы думаете не докупать токены, а пробовать другие модели, переписывать клиента под каждый чужой API не обязательно. Так устроен provod.ai: клиент, поддерживающий протокол OpenAI, подключается заменой base URL и ключа API, а сравнивать модели можно в пределах каталога, доступного в сервисе на текущий момент, не переписывая логику приложения под каждый отдельный API.

«Без лимитов» — до первой темы под запретом

02 evidence

На потребительских поверхностях всё звучит проще. FAQ giga.chat прямо заявляет: «Пользоваться GigaChat можно абсолютно бесплатно, без лимитов и ограничений». Никакого числа сообщений в сутки, никакого отдельного платного тарифа для частного пользователя в базе знаний нет.

При этом отвечает там флагманская модель. По данным Forbes, 6 июля 2026 года вышел GigaChat 3.5 Ultra на 432 млрд параметров (против 700 млрд у 3.1 Ultra) — и именно этот флагман доступен бесплатно в приложении и в open source для разработчиков. Старший вице-президент Сбера Антон Фролов подавал это как технологическое достижение команды: «Количество экспериментов при разработке модели выросло до 1500». Позиция вендора прозрачна — потребительский контур бесплатный, монетизируется API и корпоративный сегмент.

Но границы у этого «без счётчика» всё же есть. В документации по квотам прямо описано тематическое ограничение: если запрос попадает под одну из восьми запрещённых категорий, ответ приходит с полем choices.finish_reason: blacklist. То есть на пользовательских поверхностях free упирается в модерацию, и настроить эти ограничения под себя может только корпоративный клиент по отдельному запросу.

Картинки упираются в функционал: Kandinsky через ГигаЧат (СберУниверситет) не умеет дорисовывать или редактировать готовое изображение — переделывать результат приходится промптом, а другие соотношения сторон живут в отдельном редакторе Fusion Brain. Официального числа бесплатных генераций в сутки найти не удалось нигде.

Достаточно ли хорошо ГигаЧат ведёт себя для реальной работы — отдельный вопрос, и мнения расходятся. Автор блога Technolady на SecurityLab пишет прямо: «Для обычного пользователя веб-версия бесплатна», но тут же уточняет, что бесплатность не спасает — по качеству генерации сервис часто уступает привычным сервисам, а на сложном коде проигрывает специализированным конкурентам. Это субъективное впечатление практика без замеров, но оно честно контрастирует с вендорской подачей «флагман для всех».

Возражение, которое не снимается одной фразой

Самое неприятное здесь даже не качество генерации. «Бесплатно без лимитов» на потребительских поверхностях остаётся обещанием из вендорского FAQ, за которым нет SLA: нет документированного числа сообщений в сутки, нет независимого замера очередей в пиковые часы, а тематическая модерация режет ответ вне зависимости от того, сколько «лимита» у вас формально осталось. И тот факт, что сам Сбер одновременно публикует 1 000 000 и 365 000 000 токенов для API той же категории пользователей, — сигнал: цифры в этой теме меняются быстрее, чем успевают разойтись по документации самого вендора, и 402 может прийти раньше расчёта.

Для сравнения: у ближайшего российского конкурента лимит задан явным числом. Алиса Про даёт 50 запросов в месяц на бесплатном тарифе (200 — для подписчиков Яндекс 360), 25 документов на проект и 10 проектов. Это лимиты сервиса баз знаний, а не бесплатного чата с Алисой, так что сравнение не совсем лоб в лоб — но оно показывает: конкурент называет проверяемое число там, где Сбер обходится формулировкой «без ограничений».

Где именно кончается free

03 decision
ПоверхностьЗаявленный лимитЧем ограничено на делеКогда обнуляетсяЧто видит пользователь при упореСледующий шаг
Сайт giga.chat«Без лимитов и ограничений» (FAQ)Тематическая модерация (blacklist), субъективное качество ответаНе обнуляется — счётчика нетОтказ по теме без видимого кода ошибкиПодтверждённого платного тарифа для сайта не найдено
Приложение «ГигаЧат»То же обещание, отвечает флагман 3.5 Ultra (материал Forbes)Модерация; независимого замера очереди нетНет данныхОтказ по темеНет подтверждённого платного тарифа
Бот и MAXТо же общее «без лимитов»Отдельно от прочих поверхностей не задокументированоНет данныхНет данныхНет данных
API физлица365 млн токенов по документации (витрина называет 1 млн)Один поток, 429 при конкурентности, TTL OAuth-токена 30 минРаз в 12 месяцевHTTP 402 «Требуется оплатить сервис»Пакет от 1300 ₽ за 20 млн токенов Lite (прайс); пакеты продаются только под Lite, Pro и Max — платного пакета под Ultra в прайсе физлиц не найдено
API юрлицаFreemium отсутствует (тарифы для юрлиц)Только платные пакеты и постоплатаНе применимоМинимальный месячный платёж 600 ₽ при использованииПакет от 19 500 ₽ за 300 млн Lite

Отдельно стоит держать в уме: чтобы перевести абстрактную квоту в понятный объём, Сбер считает один токен как примерно 3–4 символа — и запроса, и ответа. Даже осторожная цифра в 1 млн токенов — это уже несколько миллионов символов текста, чего для личных задач почти всегда достаточно; вопрос упирается не в объём, а в поток и конкурентность.

Если команда уже вышла за личный формат и планирует бюджет на несколько ИИ-провайдеров сразу, а не только на один GigaChat API с постоплатой от 600 ₽ в месяц, разумнее сразу считать в рублях с одного места: у provod.ai для этого есть общий баланс организации и оплата российской картой, по СБП или по счёту без иностранной карты — это закрывает именно задачу учёта расходов на разных провайдеров, а не заменяет тарифы самого GigaChat.

Обходной путь, если мало и этого

Для тех, кто упирается в лимиты или модерацию облака, есть третий вариант помимо сайта и API: веса GigaChat 3.5 Ultra выложены в открытый доступ. Разработчик команды GigaChat Никита Сушко пишет в блоге компании на Хабре: «Веса доступны на HuggingFace и GitVerse под MIT» — то есть развернуть модель у себя можно легально, без токеновой квоты вообще. Правда, для модели такого размера self-host требует серьёзного железа, так что для массового читателя это скорее теоретический выход, чем повседневное решение.

Один популярный гайд на vc.ru упоминает «ограничения по количеству запросов в день на бесплатном тарифе» вообще без чисел и ссылок — анекдотическое наблюдение уровня слуха, которое лишь показывает, насколько сильно тема путается в массовых обзорах. Прежде чем планировать работу с бесплатным ГигаЧатом на ближайшие месяцы, стоит открыть страницу тарифов физлиц напрямую и посмотреть дату «Обновлено» — если она свежее конца июля 2026 года, цифры в этой статье тоже стоит сверить заново.

provod.ai — выбирайте по результату, а не по сложности доступа

Проверяйте несколько моделей на одном сценарии и переключайтесь на ту, которая лучше решает задачу: интеграция, команда и платёжный контур при этом не меняются.

В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

Сравнение остаётся честным по цене: каждый вариант считается 1:1 по официальному тарифу провайдера, без собственной надбавки provod.ai.

Найдите лучшую модель для задачи: форма регистрации · цены на модели · защита данных по 152-ФЗ · главная provod.ai

Источники