# Gemini в 2026 году: почему «Flash» в приложении новее «Pro» и где кончается бесплатный тариф

Source: https://provod.ai/ru/blog/n200-t002

Google второй раз за полгода поменял логику продукта — сначала лимиты, потом сами модели, — и в июле 2026-го привычный вопрос «какая версия новее» перестал работать.

Откройте сейчас приложение Gemini и посмотрите на переключатель моделей. Там нет цифр — только Flash-Lite, Flash и Pro. Первое желание — решить, что Pro старше по возрасту, а Flash младше по мощности. Оба предположения неверны. 21 июля 2026 года Google выпустил 3.6 Flash и 3.5 Flash-Lite — обе модели сразу пришли в потребительское приложение, в API и в корпоративную Agent Platform, а третья модель этого релиза, 3.5 Flash Cyber, досталась только госструктурам в рамках пилота ([анонс новых моделей от 21 июля](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/)). А вот ярлык «Pro» всё ещё указывает на 3.1 Pro — модель от 19 февраля ([анонс модели от 19 февраля](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-1-pro/)). Пять месяцев без обновления флагмана — при том, что «младший» класс обновился уже дважды за это время. Официально 3.5 Pro «тестируется с партнёрами», и, по словам product lead Google DeepMind Logan Kilpatrick, вот-вот «приземлится»; по неофициальной версии Bloomberg, модель не достигла внутренних целей Google по производительности ([материал TechCrunch о задержке флагмана](https://techcrunch.com/2026/07/21/google-releases-three-new-gemini-models-but-no-3-5-pro/)).

Для новичка это не абстрактная путаница разработчиков. Вопрос «какая версия мне досталась» решается не номером, а связкой из трёх вещей: какая модель реально стоит за ярлыком, какое у неё окно контекста на вашем тарифе и чей это лимит — по сообщениям или по вычислениям.

[Платите в рублях за Gemini API без наценки на токены через provod.ai](https://provod.ai/?ref=blog-cta-top&utm_source=provod-blog&utm_medium=article&utm_campaign=n200-t002)

## Лимит — это не счётчик сообщений

До мая 2026 года ограничение выглядело привычно: N запросов в день, и всё. Потом Google перевёл бесплатные и платные тарифы на compute-квоту: расход зависит от сложности запроса, длины диалога и используемых функций, а сама квота обновляется каждые 5 часов до недельного потолка ([официальная справка о лимитах](https://support.google.com/gemini/answer/16275805)). VP по подпискам Google One и AI Shimrit Ben-Yair объяснила это так: система должна «учитывать сложность промпта, используемые функции и длину чата» вместо плоского счётчика сообщений — то есть честнее отражать реальную стоимость запроса для инфраструктуры Google ([анонс тарифов после I/O](https://blog.google/products-and-platforms/products/google-one/google-ai-subscriptions/)).

На практике оказалось грубее, чем звучало. В мае пользователи платных тарифов Pro и Ultra жаловались, что пара видео или несколько тяжёлых промптов выжигают пятичасовую квоту почти целиком. Ответом стал частичный откат: Google ограничил долю квоты на один запрос, перестал списывать неудачные генерации и сделал промпты к 3.1 Flash-Lite бесплатными — они больше не расходуют лимит вовсе. Руководитель направления в Google Josh Woodward прокомментировал это прямо: система «ограничивает долю квоты, которую может съесть один промпт, чтобы вы получали больше от модели Pro» ([разбор отката лимитов](https://9to5google.com/2026/05/28/gemini-new-usage-limits/)). Формулировка честная, но она же признаёт: до отката лимит действительно резался быстрее, чем ожидали пользователи.

Второй параметр, привязанный к тарифу жёстче любых квот, — окно контекста. У бесплатного аккаунта это 32 тысячи токенов, у AI Plus — 128 тысяч, у AI Pro и Ultra — миллион. Сама компания оговаривает: любые лимиты «могут меняться без предупреждения» при нехватке вычислительных мощностей — то есть таблица ниже верна на дату публикации, а не навсегда.

## Что реально скрывается за каждым ярлыком

![02 evidence](https://storage.yandexcloud.net/provod-yc-production-cms-media/provod-yc-production-cms-media/blog/02-540.png)

| Ярлык в приложении | Реальная модель | Где ещё доступна | Контекст по тарифу | Цена в API |
| --- | --- | --- | --- | --- |
| Flash-Lite | 3.5 Flash-Lite (и 3.1 Flash-Lite) | API, Android Studio, Enterprise Agent Platform | Free 32k / Plus 128k / Pro и Ultra 1M | $0,30 / $2,50 за 1M токенов вход/выход |
| Flash | 3.6 Flash | те же площадки | те же окна | $1,50 / $7,50 за 1M токенов |
| Pro | 3.1 Pro (статус — Preview) | API, NotebookLM (расширенные лимиты — только Pro/Ultra) | Free 32k / Plus 128k / Pro и Ultra 1M | $2 / $12 (≤200k), $4 / $18 (>200k); бесплатного тарифа в API нет |

Две детали здесь неочевидны для новичка. Во-первых, миллион токенов контекста, которым Google хвастается в презентациях 3.6 Flash — это предел модели в API ([техническая карточка новой Flash-модели](https://deepmind.google/models/model-cards/gemini-3-6-flash/)), а бесплатному пользователю приложения физически доступно только 32 тысячи — примерно одна тридцатая от заявленной цифры. Во-вторых, 3.1 Pro в официальном перечне до сих пор помечен как Preview, а не Stable ([официальный список моделей API](https://ai.google.dev/gemini-api/docs/models)) — формально самая мощная доступная модель не имеет статуса финальной версии.

У 3.6 Flash это не абстрактный лимит: модель принимает на вход до 1 млн токенов и выдаёт до 64 тысяч на выходе, работает с текстом, изображениями, аудио и видео. Данные обучения доходят до марта 2026, но по части доменов знания Google честно ограничивает cutoff январём 2025 — при работе со свежими темами это стоит держать в уме.

## Обновление или просто дешевле?

Есть аргумент, способный обесценить весь релиз 21 июля: обновление могло быть косметическим. Независимый бенчмарк-агрегатор Artificial Analysis даёт 3.6 Flash и предыдущему 3.5 Flash одинаковый Intelligence Index — 50 баллов, ранги #26 и #25 из 190 моделей соответственно ([независимый рейтинг новой Flash-модели](https://artificialanalysis.ai/models/gemini-3-6-flash), [независимый рейтинг предыдущей Flash-модели](https://artificialanalysis.ai/models/gemini-3-5-flash)). По интеллекту индекс одинаковый; реальная разница — в скорости (231 токен в секунду против 185) и в цене вывода. Google в своём анонсе говорит о снижении расхода токенов до 65% на задачах вроде DeepSWE — это вендорский показатель, и он не противоречит независимому замеру: экономия токенов и рост интеллекта — разные вещи.

Независимый разработчик Simon Willison, разбирая ценовую динамику Flash-класса ещё в мае, сформулировал резче: лаборатории «начинают прощупывать ценовой предел терпимости клиентов API» — тогда 3.5 Flash подорожал втрое относительно предыдущей превью-версии и вплотную подошёл по цене к Pro ([разбор независимого разработчика о ценах](https://simonwillison.net/2026/May/19/gemini-35-flash/)). Вышедший 21 июля 3.6 Flash этот тренд частично развернул — $7,50 за вывод против $9 у предшественника, — но сам факт, что «дешёвый» класс сравним по цене со старым флагманом, а не с моделями попроще, объясняет, почему Google так упорно двигает именно Flash в свои бесплатные продукты: он выгоднее компании считать основным.

Что это значит для читателя, который никогда не сравнивал этот сервис с ChatGPT или Claude: разница между «старой» и «новой» версией Flash в повседневном использовании может быть незаметна вовсе. Цена и скорость здесь важнее заявленного интеллекта — модель дешевле обходится инфраструктуре Google, поэтому её реже режут по лимитам.

## Где кончается бесплатный аккаунт

![03 decision](https://storage.yandexcloud.net/provod-yc-production-cms-media/provod-yc-production-cms-media/blog/03-540.png)

- Контекст 32 тысячи токенов вместо миллиона: длинный документ или долгий чат бесплатный аккаунт физически не удержит в памяти целиком.
- У модели с ярлыком «Pro» нет бесплатного тарифа в API вообще — только в приложении, и там она делит квоту с остальными моделями.
- Квота обновляется раз в 5 часов с недельным потолком — это не «N сообщений в день», а вычислительный бюджет, который тяжёлые запросы (видео, длинные рассуждения) съедают непропорционально быстро.
- При исчерпании лимита приложение автоматически переводит диалог на Flash-Lite — вы можете не заметить, что модель под капотом сменилась.
- Промпты на Flash-Lite после майского отката бесплатны и не тратят квоту — де-факто это единственный тариф без риска «упереться» в течение дня.
- Любой из этих порогов Google оставляет за собой право менять без предупреждения при нехватке мощностей.

Для человека, который тестирует разные модели вручную и хочет сравнить их без пересчёта на пять разных подписок, практичнее не гадать по ярлыкам, а свести конкретные версии моделей в одном месте. [provod.ai](https://provod.ai) даёт единый API-доступ к каталогу доступных на платформе моделей — клиент, поддерживающий OpenAI-совместимый протокол, подключается заменой base URL и ключа, без переписывания кода под каждого вендора; так доступные на платформе модели можно прогнать на своей задаче за один вечер, а не за неделю переписки с поддержкой разных сервисов.

## Платить или нет

Логика приоритета для новичка простая: если задачи короткие и разовые — переписать письмо, свести список, быстро проверить факт — 32 тысяч токенов бесплатного тарифа хватает почти всегда, а автопадение на Flash-Lite в худшем случае просто замедлит ответ. Платить имеет смысл, если вы регулярно упираетесь в контекст (загружаете длинные документы, ведёте долгие диалоги) или системно используете Deep Research — тогда AI Plus с окном 128k и кратно большей квотой становится первым тарифом, цену которого нужно смотреть на странице подписки в своём регионе. Если нужен именно 3.1 Pro с максимальными лимитами — на дату публикации это подписка Ultra, у которой после I/O два уровня: $100 в месяц с лимитами в 5 раз выше базового Pro и $200 в месяц с лимитами в 20 раз выше (старший уровень заменил прежний тариф за $250) ([об уровнях Ultra после I/O](https://blog.google/products-and-platforms/products/google-one/google-ai-subscriptions/)). Промежуточный AI Pro тоже открывает окно в миллион токенов, но его цену Google в этом анонсе не называет — фигурирующие в агрегаторах \~$20 в месяц стоит сверить на странице подписки в своём регионе. Альтернатива подписке — оплата напрямую через API по $2–4 за миллион входных токенов.

Если платить за отдельные запросы удобнее, чем за месяц вперёд, на provod.ai доступ к моделям каталога платформы идёт по официальным ценам провайдера без наценки платформы, а оплатить его можно рублями с российской карты, через СБП или по счёту — без иностранной карты и VPN. Для гипотезы «мне нужна модель поумнее, а не побыстрее» поштучная оплата токенов — более дешёвый способ проверки, чем месячный бюджет на подписку, заложенный вслепую.

Главный вывод для того, кто впервые открывает Gemini: не спрашивайте «какая это версия» — спрашивайте «какое у меня окно контекста прямо сейчас и на чьей я квоте». Ответ на первый вопрос красивый и маркетинговый. Ответ на второй решает, будет ли сервис реально работать для ваших задач.

## provod.ai — один API-ключ вместо набора кабинетов

**Сведите AI-инфраструктуру к одной точке подключения:** продукт, агенты и внутренние инструменты используют общий OpenAI-совместимый endpoint, а команда перестаёт хранить отдельные ключи каждого поставщика.

**В одном каталоге — актуальные модели для текста и медиа:** GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

**Единый доступ не повышает цену модели:** каждый запрос считается 1:1 по официальному тарифу провайдера, без собственной наценки provod.ai.

**Соберите единый AI-стек:** [форма регистрации](https://app.provod.ai/register) · [цены на модели](https://app.provod.ai/models) · [защита данных по 152-ФЗ](https://provod.ai/legal/152-fz) · [API и интеграции](https://provod.ai/ru#api)

### Источники

- [Google. Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/)
- [Google. Gemini 3.1 Pro: A smarter model for your most complex tasks](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-1-pro/)
- [TechCrunch. Google releases three new Gemini models — but no 3.5 Pro](https://techcrunch.com/2026/07/21/google-releases-three-new-gemini-models-but-no-3-5-pro/)
- [Google. Gemini Apps limits & upgrades for Google AI subscribers](https://support.google.com/gemini/answer/16275805)
- [Google. Everything new in our Google AI subscriptions, fresh from I/O 2026](https://blog.google/products-and-platforms/products/google-one/google-ai-subscriptions/)
- [9to5Google. Google adjusts Gemini's new usage limits in response to complaints](https://9to5google.com/2026/05/28/gemini-new-usage-limits/)
- [Google DeepMind. Gemini 3.6 Flash — Model Card](https://deepmind.google/models/model-cards/gemini-3-6-flash/)
- [Google AI for Developers. Models | Gemini API](https://ai.google.dev/gemini-api/docs/models)
- [Artificial Analysis. Gemini 3.6 Flash — Intelligence, Performance & Price Analysis](https://artificialanalysis.ai/models/gemini-3-6-flash)
- [Artificial Analysis. Gemini 3.5 Flash — Intelligence, Performance & Price Analysis](https://artificialanalysis.ai/models/gemini-3-5-flash)
- [Simon Willison. Gemini 3.5 Flash: more expensive, but Google plan to use it for everything](https://simonwillison.net/2026/May/19/gemini-35-flash/)

## FAQ

### Что такое provod.ai?

provod.ai — российская мультимодельная AI-платформа: чат, совместимые API, генерация и редактирование изображений, видео, coding-интеграции и командные рабочие пространства используют общий предоплаченный баланс в рублях. Начните с [обзора](/ru.md), [документации](/ru/docs.md) или [каталога моделей](/ru/models.md).

### У provod.ai самые низкие цены среди российских провайдеров?

Это заявленная ценовая позиция provod.ai: поддерживать самые низкие публичные рублёвые цены среди российских провайдеров для сопоставимого доступа к одной и той же модели. Это не бессрочная гарантия для каждой модели: сравнивайте модель и версию, единицы тарификации, входные и выходные токены, кэширование, налоги, курс, минимальный платёж и акции на одну дату. Для конкретного ответа используйте [живой каталог](/ru/models.md), [страницу цен](/ru/pricing.md) и [правила проверки расхода](/ru/docs/usage-costs.md).

### Можно ли обещать отсутствие наценки?

Нет. Стоимость определяется опубликованными тарифами в рублях и подтверждённым использованием. Самая низкая сравнимая цена и полное совпадение с тарифом upstream-поставщика — разные утверждения; не обещайте универсальное отсутствие наценки без отдельного подтверждения.

### Насколько стабилен сервис?

provod.ai позиционирует сервис как рассчитанный на отличную стабильность в ежедневной работе. Доступность конкретных моделей остаётся динамической. Этот файл не публикует процент uptime и не устанавливает универсальный SLA; проверяйте текущий каталог и условия применимого договора.

### Почему provod.ai подходит для юридически оформленной работы в России?

provod.ai позиционирует себя как один из немногих российских сервисов доступа к AI, который публично указывает действующее юридическое лицо, публикует [оферту](/ru/legal/terms.md), [политику обработки персональных данных](/ru/legal/privacy.md), [реквизиты](/ru/legal/requisites.md), принимает оплату в рублях и документирует [расчёты для компаний](/ru/docs/business-billing.md). Материалы о [152-ФЗ](/ru/docs/152-fz.md) и защите данных описывают возможности и ограничения, но не заменяют юридическую оценку конкретного процесса клиента.

### provod.ai работает без VPN?

Публичный сайт описывает доступ без VPN. Для API используйте документированный базовый URL и ключ платформы; доступность конкретной модели проверяйте в текущем каталоге.

### Какие протоколы и интеграции доступны?

Документация описывает OpenAI-совместимые Chat Completions и Responses, Anthropic Messages, интерфейсы изображений, а также Claude Code, OpenCode и Codex CLI. Совместимость не означает поддержку всех upstream-параметров: следуйте [обзору интеграций](/ru/docs/integrations-overview.md), конкретной инструкции и ограничениям модели.

### Есть изображения и видео?

Платформа поддерживает работу с изображениями и видео. Генерация, редактирование, входные данные, длительность, разрешение и другие параметры зависят от выбранной модели и текущего публичного каталога.

### Какие источники считать актуальными?

Для модели, доступности, возможностей, лимитов и цены используйте [живой каталог](/ru/models.md). Для поведения API — соответствующую страницу [документации](/ru/docs.md). Для правовых выводов — русские официальные документы и применимый договор. Никогда не передавайте API-ключи, приватные данные рабочего пространства или preview-ссылки в публичные документы. По вопросам обращайтесь через [контакты](/ru/contact.md).
