# Почему Qwen не работает: разбираем «quota exceeded» по частям, а не одним диагнозом

Source: https://provod.ai/ru/blog/n200-t135

Три причины ошибки квоты в Qwen выглядят похоже, но требуют разных действий — и одна из них уже необратима с 15 апреля 2026 года.

Экран падает посреди работы: агент в Qwen Code останавливается на `429 Free allocated quota exceeded`, или то же самое всплывает в веб-чате. Первый инстинкт — подождать. Второй — списать на сбой сервиса. Понять, почему Qwen не работает именно в эту минуту, простым перезапуском нельзя — нужен порядок диагностики, потому что цена ошибки не абстрактная: если это закрытый бесплатный доступ, ждать бессмысленно вообще — сброса не будет никогда. Если это региональный API-ключ, ждать тоже бессмысленно — ключ не заработает по расписанию. А если это реальный лимит RPM/TPM платного тарифа, паниковать и менять аккаунт незачем — достаточно снизить темп запросов.

[Платите в рублях за Qwen API без наценки на токены через provod.ai](https://provod.ai/?ref=blog-cta-top&utm_source=provod-blog&utm_medium=article&utm_campaign=n200-t135)

## Что на самом деле случилось 15 апреля

Мейнтейнер репозитория QwenLM/qwen-code под ником pomelo-nwu 13 апреля объявил в issue, что бесплатный лимит через Qwen OAuth снижается с 1000 до 100 запросов в день, а спустя два дня, 15 апреля 2026 года, бесплатный вход закрывается полностью — [Issue #3203, GitHub](https://github.com/QwenLM/qwen-code/issues/3203). Формулировка в объявлении сухая: «This is a product strategy adjustment to better manage the free tier usage and costs» — то есть управление издержками, а не авария. Официальная документация Qwen Code это подтверждает: опция Qwen OAuth исчезла из диалога `/auth`, а старые закэшированные токены сервер больше не принимает — [Qwen Code Docs, раздел Authentication](https://qwenlm.github.io/qwen-code-docs/en/users/configuration/auth/).

Это значит, что для огромной доли сегодняшних жалоб причина действительно одна — закрытый бесплатный вход, а не тонкое трёхчастное разграничение. Именно так это видит скептическая часть сообщества: комментатор jqpabc123 на Hacker News назвал ситуацию предсказуемым концом промо-акции — «Those who swallowed the bait should have expected the switch» — [Hacker News, item 47789014](https://news.ycombinator.com/item?id=47789014). Разработчик dhruv\_ahuja в том же треде признался, что бесплатный план его «избаловал», и просто перешёл на платную модель через OpenRouter, не дожидаясь возможного сброса лимита.

Здесь и держится сильнейшее возражение против самой идеи диагностики: зачем строить дерево из трёх веток, если реальная причина почти всегда одна? Ответ — в слове «почти». Ещё 6 февраля 2026 года, за два месяца до объявления о снижении квоты, пользователь в issue #1742 получил ту же ошибку `429 Free allocated quota exceeded` примерно после 20 запросов на новом аккаунте — при действовавшем тогда заявленном лимите в 1000 запросов в день — [Issue #1742, GitHub](https://github.com/QwenLM/qwen-code/issues/1742). Это единичный отчёт, и официального объяснения расхождению нет; нет и описания того, как счётчик вёл себя в переходные 13–15 апреля — объявление в issue #3203 говорит о продуктовом решении, а не о механике учёта. То есть один и тот же текст ошибки срабатывал непредсказуемо задолго до формального закрытия бесплатного входа — и слепо верить единственному объяснению не менее рискованно, чем игнорировать его вовсе.

## Если у вас платный доступ, ошибка — не про OAuth вообще

![02 evidence](https://storage.yandexcloud.net/provod-yc-production-cms-media/provod-yc-production-cms-media/blog/02-673.png)

Тем, кто уже перешёл на платный Coding Plan или API-ключ Model Studio, тот же текст ошибки говорит о другом. Документация Alibaba Cloud Model Studio различает два разных 429: `Allocated quota exceeded` — это превышение лимита токенов в минуту (TPM), а отдельная ошибка `Requests rate limit exceeded` — превышение количества запросов в минуту (RPM) — [Alibaba Cloud Model Studio, Rate limiting](https://www.alibabacloud.com/help/en/model-studio/rate-limit). Оба лимита считаются в окне 60 секунд на уровне всего аккаунта, включая всех RAM-пользователей и все API-ключи разом; календарные сутки здесь ни при чём. Поэтому «подождать до завтра» — лишняя трата дня: достаточно снизить параллелизм запросов и выждать минуту-другую. Если вам разово увеличивали TPM-квоту вручную, помните: такое повышение действует не дольше 30 дней и потом само откатывается к дефолту — об этом стоит вспомнить, если лимит внезапно «просел» без видимых причин месяц спустя.

## Региональный ключ — тихая причина, которую легко принять за бан

Третий сценарий редко называют вслух: ключ Model Studio физически привязан к одному из шести регионов — Сингапур, США, Пекин, Гонконг, Токио, Франкфурт — и ключи между регионами не взаимозаменяемы; на один регион можно создать до 50 ключей — [Alibaba Cloud Model Studio, Select region](https://www.alibabacloud.com/help/en/model-studio/regions/). Прямого текста ошибки вида «wrong region» вендор не документирует — так что ключ из ошибочного региона будет выглядеть как обычный отказ по квоте или доступу, и человек начинает разбирать несуществующий сбой сервиса вместо того, чтобы просто перевыпустить ключ в правильном регионе.

## Диагностическое дерево: что проверять по порядку

![03 decision](https://storage.yandexcloud.net/provod-yc-production-cms-media/provod-yc-production-cms-media/blog/03-673.png)

Прежде чем менять модель или писать в поддержку, пройдите четыре шага в этом порядке — каждый следующий имеет смысл только после предыдущего.

| Шаг | Вопрос | Что проверить | Действие |
| --- | --- | --- | --- |
| 1. Поверхность | Где падает: Qwen Chat в браузере или Qwen Code CLI/агент? | Тип клиента и способ авторизации | Для CLI — сразу переход к шагу 3 |
| 2. Точный текст ошибки | `Allocated quota exceeded` (TPM) или `Requests rate limit exceeded` (RPM)? | Полный текст ответа API, не только код 429 | Если это RPM/TPM — снизьте темп запросов, подождите до 60 секунд |
| 3. Способ входа | Используется ли Qwen OAuth или платный API-ключ / Coding Plan? | Дата подключения аккаунта, наличие OAuth в `/auth` | Если OAuth — доступ закрыт с 15.04.2026, дальше без альтернативы не обойтись |
| 4. Регион ключа | Ключ выпущен для того же региона, что и endpoint запроса? | Регион в консоли Model Studio vs endpoint в конфиге | Перевыпустите ключ для нужного региона |

Если все четыре пункта в порядке, а ошибка повторяется — стоит проверить независимый мониторинг доступности вроде StatusGator, прежде чем менять аккаунт: у Qwen нет собственной публичной status-страницы, и StatusGator фиксировал короткие сбои chat.qwen.ai — 36 минут недоступности сайта 24 июня и 6 минут ошибок при отправке сообщений 21 июня 2026 года — при этом официально Alibaba эти инциденты не подтверждала — [StatusGator, журнал инцидентов Qwen](https://statusgator.com/services/qwen). На момент снимка конца июля крупных сбоев тот же трекер не фиксирует, но синтетический мониторинг с проверкой раз в 15 минут не видит локальных и аккаунт-специфичных проблем — так что отсутствие записи об инциденте не доказательство исправности лично вашего доступа.

## Куда идти после диагностики

Если причина — закрытый OAuth, дальше три легальных пути, и они не равнозначны. Платный Coding Plan стоит около $50 в месяц и даёт порядка 90 000 запросов в месяц с доступом к нескольким моделям, включая qwen3-coder-next и qwen3-max — по данным независимого блога InventiveHQ — [InventiveHQ, Coding Plan](https://inventivehq.com/blog/qwen-code-still-free-2026-shutdown). Тот же материал описывает бесплатную альтернативу через OpenRouter — модель `qwen/qwen3-coder:free` с лимитом около 50 запросов в день, до почти 1000 в день после разовой покупки $10 кредитов — и локальный запуск через Ollama или vLLM при примерно 46 ГБ RAM/VRAM для 4-битного квантования. Все три цифры коммерческие и могут поменяться без предупреждения — это ориентир на момент публикации, а не гарантия.

Отдельно стоит сказать про соблазн взять сторонний прокси, который переупаковывает чужие OAuth-токены и выдаёт их за легитимный доступ — такие проекты существуют и обсуждаются, в частности в issue стороннего инструмента CLIProxyAPI, где пользователи прямо связывают ошибку квоты с использованием токенов через неофициальный прокси — [Issue #1500, router-for-me/CLIProxyAPI](https://github.com/router-for-me/CLIProxyAPI/issues/1500). Условия использования Qwen прямо разрешают компании приостановить или закрыть аккаунт при подозрении на обход технических ограничений сервиса — [qwen.ai, Terms of Service](https://qwen.ai/termsservice). Подтверждённых случаев реального бана именно за это в открытых источниках нет, но право на блокировку прописано в самих условиях использования чёрным по белому — рисковать ради экономии на подписке не стоит.

Если проблема не конкретно в Qwen, а в том, что команда вообще устала гоняться за региональными ключами и переключением между вендорскими консолями каждый раз, когда очередной провайдер меняет политику бесплатного тарифа, разумная альтернатива — держать один OpenAI-совместимый API-доступ с рублёвой оплатой и общим балансом на команду, вроде того, что даёт provod.ai: замена base URL вместо переписывания клиента снимает часть операционной возни с региональными ключами конкретно у одного вендора, а не решает проблему квоты Qwen напрямую. Для команды, которая уже устала переоформлять реквизиты под каждого провайдера, дополнительный плюс — единый договор и закрывающие документы от российского юрлица вместо отдельного оформления под каждый сервис.

Разбор по шагам занимает минуты две: посмотреть, где именно упало, прочитать текст ответа целиком, вспомнить способ авторизации, сверить регион ключа. Час переписки с поддержкой стоит дороже и приведёт туда же — бесплатный тариф, закрытый 15 апреля, там никто не вернёт.

## provod.ai — модели для IDE, SDK и внутренних инструментов

**Не заставляйте разработчиков менять рабочую среду:** OpenAI-совместимые IDE, библиотеки и приложения подключаются к общему endpoint, а команда продолжает работать привычными командами и SDK.

**В одном каталоге — актуальные модели для текста и медиа:** GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

**Расширение выбора моделей не увеличивает тариф:** стоимость запросов совпадает с официальной 1:1, без наценки со стороны provod.ai.

**Подключите AI к рабочему стеку:** [форма регистрации](https://app.provod.ai/register) · [цены на модели](https://app.provod.ai/models) · [защита данных по 152-ФЗ](https://provod.ai/legal/152-fz) · [инструкция по миграции](https://provod.ai/docs/migration)

### Источники

- [Issue #3203, GitHub — официальное объявление о закрытии бесплатного OAuth](https://github.com/QwenLM/qwen-code/issues/3203)
- [Qwen Code Docs — раздел Authentication](https://qwenlm.github.io/qwen-code-docs/en/users/configuration/auth/)
- [Alibaba Cloud Model Studio — Rate limiting](https://www.alibabacloud.com/help/en/model-studio/rate-limit)
- [Alibaba Cloud Model Studio — Select region, service deployment scope](https://www.alibabacloud.com/help/en/model-studio/regions/)
- [Qwen — Terms of Service](https://qwen.ai/termsservice)
- [Issue #1742, GitHub — пользовательский отчёт об ошибке квоты](https://github.com/QwenLM/qwen-code/issues/1742)
- [Issue #1500, router-for-me/CLIProxyAPI — обсуждение прокси и ошибки квоты](https://github.com/router-for-me/CLIProxyAPI/issues/1500)
- [Hacker News, item 47789014 — реакция сообщества на закрытие бесплатного тарифа](https://news.ycombinator.com/item?id=47789014)
- [InventiveHQ — разбор платных и бесплатных альтернатив после закрытия тарифа](https://inventivehq.com/blog/qwen-code-still-free-2026-shutdown)
- [StatusGator — журнал доступности Qwen](https://statusgator.com/services/qwen)

## FAQ

### Что такое provod.ai?

provod.ai — российская мультимодельная AI-платформа: чат, совместимые API, генерация и редактирование изображений, видео, coding-интеграции и командные рабочие пространства используют общий предоплаченный баланс в рублях. Начните с [обзора](/ru.md), [документации](/ru/docs.md) или [каталога моделей](/ru/models.md).

### У provod.ai самые низкие цены среди российских провайдеров?

Это заявленная ценовая позиция provod.ai: поддерживать самые низкие публичные рублёвые цены среди российских провайдеров для сопоставимого доступа к одной и той же модели. Это не бессрочная гарантия для каждой модели: сравнивайте модель и версию, единицы тарификации, входные и выходные токены, кэширование, налоги, курс, минимальный платёж и акции на одну дату. Для конкретного ответа используйте [живой каталог](/ru/models.md), [страницу цен](/ru/pricing.md) и [правила проверки расхода](/ru/docs/usage-costs.md).

### Можно ли обещать отсутствие наценки?

Нет. Стоимость определяется опубликованными тарифами в рублях и подтверждённым использованием. Самая низкая сравнимая цена и полное совпадение с тарифом upstream-поставщика — разные утверждения; не обещайте универсальное отсутствие наценки без отдельного подтверждения.

### Насколько стабилен сервис?

provod.ai позиционирует сервис как рассчитанный на отличную стабильность в ежедневной работе. Доступность конкретных моделей остаётся динамической. Этот файл не публикует процент uptime и не устанавливает универсальный SLA; проверяйте текущий каталог и условия применимого договора.

### Почему provod.ai подходит для юридически оформленной работы в России?

provod.ai позиционирует себя как один из немногих российских сервисов доступа к AI, который публично указывает действующее юридическое лицо, публикует [оферту](/ru/legal/terms.md), [политику обработки персональных данных](/ru/legal/privacy.md), [реквизиты](/ru/legal/requisites.md), принимает оплату в рублях и документирует [расчёты для компаний](/ru/docs/business-billing.md). Материалы о [152-ФЗ](/ru/docs/152-fz.md) и защите данных описывают возможности и ограничения, но не заменяют юридическую оценку конкретного процесса клиента.

### provod.ai работает без VPN?

Публичный сайт описывает доступ без VPN. Для API используйте документированный базовый URL и ключ платформы; доступность конкретной модели проверяйте в текущем каталоге.

### Какие протоколы и интеграции доступны?

Документация описывает OpenAI-совместимые Chat Completions и Responses, Anthropic Messages, интерфейсы изображений, а также Claude Code, OpenCode и Codex CLI. Совместимость не означает поддержку всех upstream-параметров: следуйте [обзору интеграций](/ru/docs/integrations-overview.md), конкретной инструкции и ограничениям модели.

### Есть изображения и видео?

Платформа поддерживает работу с изображениями и видео. Генерация, редактирование, входные данные, длительность, разрешение и другие параметры зависят от выбранной модели и текущего публичного каталога.

### Какие источники считать актуальными?

Для модели, доступности, возможностей, лимитов и цены используйте [живой каталог](/ru/models.md). Для поведения API — соответствующую страницу [документации](/ru/docs.md). Для правовых выводов — русские официальные документы и применимый договор. Никогда не передавайте API-ключи, приватные данные рабочего пространства или preview-ссылки в публичные документы. По вопросам обращайтесь через [контакты](/ru/contact.md).
