← Все статьи
Новости10 мин чтения

Gemini в 2026 году: почему «Flash» в приложении новее «Pro» и где кончается бесплатный тариф

Google второй раз за полгода поменял логику продукта — сначала лимиты, потом сами модели, — и в июле 2026-го привычный вопрос «какая версия новее» перестал работать.

Обложка статьи: Gemini в 2026 году: почему «Flash» в приложении новее «Pro» и где кончается бесплатный тариф

Google второй раз за полгода поменял логику продукта — сначала лимиты, потом сами модели, — и в июле 2026-го привычный вопрос «какая версия новее» перестал работать.

Откройте сейчас приложение Gemini и посмотрите на переключатель моделей. Там нет цифр — только Flash-Lite, Flash и Pro. Первое желание — решить, что Pro старше по возрасту, а Flash младше по мощности. Оба предположения неверны. 21 июля 2026 года Google выпустил 3.6 Flash и 3.5 Flash-Lite — обе модели сразу пришли в потребительское приложение, в API и в корпоративную Agent Platform, а третья модель этого релиза, 3.5 Flash Cyber, досталась только госструктурам в рамках пилота (анонс новых моделей от 21 июля). А вот ярлык «Pro» всё ещё указывает на 3.1 Pro — модель от 19 февраля (анонс модели от 19 февраля). Пять месяцев без обновления флагмана — при том, что «младший» класс обновился уже дважды за это время. Официально 3.5 Pro «тестируется с партнёрами», и, по словам product lead Google DeepMind Logan Kilpatrick, вот-вот «приземлится»; по неофициальной версии Bloomberg, модель не достигла внутренних целей Google по производительности (материал TechCrunch о задержке флагмана).

Для новичка это не абстрактная путаница разработчиков. Вопрос «какая версия мне досталась» решается не номером, а связкой из трёх вещей: какая модель реально стоит за ярлыком, какое у неё окно контекста на вашем тарифе и чей это лимит — по сообщениям или по вычислениям.

Платите в рублях за Gemini API без наценки на токены через provod.ai

Лимит — это не счётчик сообщений

До мая 2026 года ограничение выглядело привычно: N запросов в день, и всё. Потом Google перевёл бесплатные и платные тарифы на compute-квоту: расход зависит от сложности запроса, длины диалога и используемых функций, а сама квота обновляется каждые 5 часов до недельного потолка (официальная справка о лимитах). VP по подпискам Google One и AI Shimrit Ben-Yair объяснила это так: система должна «учитывать сложность промпта, используемые функции и длину чата» вместо плоского счётчика сообщений — то есть честнее отражать реальную стоимость запроса для инфраструктуры Google (анонс тарифов после I/O).

На практике оказалось грубее, чем звучало. В мае пользователи платных тарифов Pro и Ultra жаловались, что пара видео или несколько тяжёлых промптов выжигают пятичасовую квоту почти целиком. Ответом стал частичный откат: Google ограничил долю квоты на один запрос, перестал списывать неудачные генерации и сделал промпты к 3.1 Flash-Lite бесплатными — они больше не расходуют лимит вовсе. Руководитель направления в Google Josh Woodward прокомментировал это прямо: система «ограничивает долю квоты, которую может съесть один промпт, чтобы вы получали больше от модели Pro» (разбор отката лимитов). Формулировка честная, но она же признаёт: до отката лимит действительно резался быстрее, чем ожидали пользователи.

Второй параметр, привязанный к тарифу жёстче любых квот, — окно контекста. У бесплатного аккаунта это 32 тысячи токенов, у AI Plus — 128 тысяч, у AI Pro и Ultra — миллион. Сама компания оговаривает: любые лимиты «могут меняться без предупреждения» при нехватке вычислительных мощностей — то есть таблица ниже верна на дату публикации, а не навсегда.

Что реально скрывается за каждым ярлыком

02 evidence
Ярлык в приложенииРеальная модельГде ещё доступнаКонтекст по тарифуЦена в API
Flash-Lite3.5 Flash-Lite (и 3.1 Flash-Lite)API, Android Studio, Enterprise Agent PlatformFree 32k / Plus 128k / Pro и Ultra 1M$0,30 / $2,50 за 1M токенов вход/выход
Flash3.6 Flashте же площадките же окна$1,50 / $7,50 за 1M токенов
Pro3.1 Pro (статус — Preview)API, NotebookLM (расширенные лимиты — только Pro/Ultra)Free 32k / Plus 128k / Pro и Ultra 1M$2 / $12 (≤200k), $4 / $18 (>200k); бесплатного тарифа в API нет

Две детали здесь неочевидны для новичка. Во-первых, миллион токенов контекста, которым Google хвастается в презентациях 3.6 Flash — это предел модели в API (техническая карточка новой Flash-модели), а бесплатному пользователю приложения физически доступно только 32 тысячи — примерно одна тридцатая от заявленной цифры. Во-вторых, 3.1 Pro в официальном перечне до сих пор помечен как Preview, а не Stable (официальный список моделей API) — формально самая мощная доступная модель не имеет статуса финальной версии.

У 3.6 Flash это не абстрактный лимит: модель принимает на вход до 1 млн токенов и выдаёт до 64 тысяч на выходе, работает с текстом, изображениями, аудио и видео. Данные обучения доходят до марта 2026, но по части доменов знания Google честно ограничивает cutoff январём 2025 — при работе со свежими темами это стоит держать в уме.

Обновление или просто дешевле?

Есть аргумент, способный обесценить весь релиз 21 июля: обновление могло быть косметическим. Независимый бенчмарк-агрегатор Artificial Analysis даёт 3.6 Flash и предыдущему 3.5 Flash одинаковый Intelligence Index — 50 баллов, ранги #26 и #25 из 190 моделей соответственно (независимый рейтинг новой Flash-модели, независимый рейтинг предыдущей Flash-модели). По интеллекту индекс одинаковый; реальная разница — в скорости (231 токен в секунду против 185) и в цене вывода. Google в своём анонсе говорит о снижении расхода токенов до 65% на задачах вроде DeepSWE — это вендорский показатель, и он не противоречит независимому замеру: экономия токенов и рост интеллекта — разные вещи.

Независимый разработчик Simon Willison, разбирая ценовую динамику Flash-класса ещё в мае, сформулировал резче: лаборатории «начинают прощупывать ценовой предел терпимости клиентов API» — тогда 3.5 Flash подорожал втрое относительно предыдущей превью-версии и вплотную подошёл по цене к Pro (разбор независимого разработчика о ценах). Вышедший 21 июля 3.6 Flash этот тренд частично развернул — $7,50 за вывод против $9 у предшественника, — но сам факт, что «дешёвый» класс сравним по цене со старым флагманом, а не с моделями попроще, объясняет, почему Google так упорно двигает именно Flash в свои бесплатные продукты: он выгоднее компании считать основным.

Что это значит для читателя, который никогда не сравнивал этот сервис с ChatGPT или Claude: разница между «старой» и «новой» версией Flash в повседневном использовании может быть незаметна вовсе. Цена и скорость здесь важнее заявленного интеллекта — модель дешевле обходится инфраструктуре Google, поэтому её реже режут по лимитам.

Где кончается бесплатный аккаунт

03 decision
  • Контекст 32 тысячи токенов вместо миллиона: длинный документ или долгий чат бесплатный аккаунт физически не удержит в памяти целиком.
  • У модели с ярлыком «Pro» нет бесплатного тарифа в API вообще — только в приложении, и там она делит квоту с остальными моделями.
  • Квота обновляется раз в 5 часов с недельным потолком — это не «N сообщений в день», а вычислительный бюджет, который тяжёлые запросы (видео, длинные рассуждения) съедают непропорционально быстро.
  • При исчерпании лимита приложение автоматически переводит диалог на Flash-Lite — вы можете не заметить, что модель под капотом сменилась.
  • Промпты на Flash-Lite после майского отката бесплатны и не тратят квоту — де-факто это единственный тариф без риска «упереться» в течение дня.
  • Любой из этих порогов Google оставляет за собой право менять без предупреждения при нехватке мощностей.

Для человека, который тестирует разные модели вручную и хочет сравнить их без пересчёта на пять разных подписок, практичнее не гадать по ярлыкам, а свести конкретные версии моделей в одном месте. provod.ai даёт единый API-доступ к каталогу доступных на платформе моделей — клиент, поддерживающий OpenAI-совместимый протокол, подключается заменой base URL и ключа, без переписывания кода под каждого вендора; так доступные на платформе модели можно прогнать на своей задаче за один вечер, а не за неделю переписки с поддержкой разных сервисов.

Платить или нет

Логика приоритета для новичка простая: если задачи короткие и разовые — переписать письмо, свести список, быстро проверить факт — 32 тысяч токенов бесплатного тарифа хватает почти всегда, а автопадение на Flash-Lite в худшем случае просто замедлит ответ. Платить имеет смысл, если вы регулярно упираетесь в контекст (загружаете длинные документы, ведёте долгие диалоги) или системно используете Deep Research — тогда AI Plus с окном 128k и кратно большей квотой становится первым тарифом, цену которого нужно смотреть на странице подписки в своём регионе. Если нужен именно 3.1 Pro с максимальными лимитами — на дату публикации это подписка Ultra, у которой после I/O два уровня: $100 в месяц с лимитами в 5 раз выше базового Pro и $200 в месяц с лимитами в 20 раз выше (старший уровень заменил прежний тариф за $250) (об уровнях Ultra после I/O). Промежуточный AI Pro тоже открывает окно в миллион токенов, но его цену Google в этом анонсе не называет — фигурирующие в агрегаторах ~$20 в месяц стоит сверить на странице подписки в своём регионе. Альтернатива подписке — оплата напрямую через API по $2–4 за миллион входных токенов.

Если платить за отдельные запросы удобнее, чем за месяц вперёд, на provod.ai доступ к моделям каталога платформы идёт по официальным ценам провайдера без наценки платформы, а оплатить его можно рублями с российской карты, через СБП или по счёту — без иностранной карты и VPN. Для гипотезы «мне нужна модель поумнее, а не побыстрее» поштучная оплата токенов — более дешёвый способ проверки, чем месячный бюджет на подписку, заложенный вслепую.

Главный вывод для того, кто впервые открывает Gemini: не спрашивайте «какая это версия» — спрашивайте «какое у меня окно контекста прямо сейчас и на чьей я квоте». Ответ на первый вопрос красивый и маркетинговый. Ответ на второй решает, будет ли сервис реально работать для ваших задач.

provod.ai — один API-ключ вместо набора кабинетов

Сведите AI-инфраструктуру к одной точке подключения: продукт, агенты и внутренние инструменты используют общий OpenAI-совместимый endpoint, а команда перестаёт хранить отдельные ключи каждого поставщика.

В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

Единый доступ не повышает цену модели: каждый запрос считается 1:1 по официальному тарифу провайдера, без собственной наценки provod.ai.

Соберите единый AI-стек: форма регистрации · цены на модели · защита данных по 152-ФЗ · API и интеграции

Источники