Три причины ошибки квоты в Qwen выглядят похоже, но требуют разных действий — и одна из них уже необратима с 15 апреля 2026 года.
Экран падает посреди работы: агент в Qwen Code останавливается на 429 Free allocated quota exceeded, или то же самое всплывает в веб-чате. Первый инстинкт — подождать. Второй — списать на сбой сервиса. Понять, почему Qwen не работает именно в эту минуту, простым перезапуском нельзя — нужен порядок диагностики, потому что цена ошибки не абстрактная: если это закрытый бесплатный доступ, ждать бессмысленно вообще — сброса не будет никогда. Если это региональный API-ключ, ждать тоже бессмысленно — ключ не заработает по расписанию. А если это реальный лимит RPM/TPM платного тарифа, паниковать и менять аккаунт незачем — достаточно снизить темп запросов.
Платите в рублях за Qwen API без наценки на токены через provod.ai
Что на самом деле случилось 15 апреля
Мейнтейнер репозитория QwenLM/qwen-code под ником pomelo-nwu 13 апреля объявил в issue, что бесплатный лимит через Qwen OAuth снижается с 1000 до 100 запросов в день, а спустя два дня, 15 апреля 2026 года, бесплатный вход закрывается полностью — Issue #3203, GitHub. Формулировка в объявлении сухая: «This is a product strategy adjustment to better manage the free tier usage and costs» — то есть управление издержками, а не авария. Официальная документация Qwen Code это подтверждает: опция Qwen OAuth исчезла из диалога /auth, а старые закэшированные токены сервер больше не принимает — Qwen Code Docs, раздел Authentication.
Это значит, что для огромной доли сегодняшних жалоб причина действительно одна — закрытый бесплатный вход, а не тонкое трёхчастное разграничение. Именно так это видит скептическая часть сообщества: комментатор jqpabc123 на Hacker News назвал ситуацию предсказуемым концом промо-акции — «Those who swallowed the bait should have expected the switch» — Hacker News, item 47789014. Разработчик dhruv_ahuja в том же треде признался, что бесплатный план его «избаловал», и просто перешёл на платную модель через OpenRouter, не дожидаясь возможного сброса лимита.
Здесь и держится сильнейшее возражение против самой идеи диагностики: зачем строить дерево из трёх веток, если реальная причина почти всегда одна? Ответ — в слове «почти». Ещё 6 февраля 2026 года, за два месяца до объявления о снижении квоты, пользователь в issue #1742 получил ту же ошибку 429 Free allocated quota exceeded примерно после 20 запросов на новом аккаунте — при действовавшем тогда заявленном лимите в 1000 запросов в день — Issue #1742, GitHub. Это единичный отчёт, и официального объяснения расхождению нет; нет и описания того, как счётчик вёл себя в переходные 13–15 апреля — объявление в issue #3203 говорит о продуктовом решении, а не о механике учёта. То есть один и тот же текст ошибки срабатывал непредсказуемо задолго до формального закрытия бесплатного входа — и слепо верить единственному объяснению не менее рискованно, чем игнорировать его вовсе.
Если у вас платный доступ, ошибка — не про OAuth вообще

Тем, кто уже перешёл на платный Coding Plan или API-ключ Model Studio, тот же текст ошибки говорит о другом. Документация Alibaba Cloud Model Studio различает два разных 429: Allocated quota exceeded — это превышение лимита токенов в минуту (TPM), а отдельная ошибка Requests rate limit exceeded — превышение количества запросов в минуту (RPM) — Alibaba Cloud Model Studio, Rate limiting. Оба лимита считаются в окне 60 секунд на уровне всего аккаунта, включая всех RAM-пользователей и все API-ключи разом; календарные сутки здесь ни при чём. Поэтому «подождать до завтра» — лишняя трата дня: достаточно снизить параллелизм запросов и выждать минуту-другую. Если вам разово увеличивали TPM-квоту вручную, помните: такое повышение действует не дольше 30 дней и потом само откатывается к дефолту — об этом стоит вспомнить, если лимит внезапно «просел» без видимых причин месяц спустя.
Региональный ключ — тихая причина, которую легко принять за бан
Третий сценарий редко называют вслух: ключ Model Studio физически привязан к одному из шести регионов — Сингапур, США, Пекин, Гонконг, Токио, Франкфурт — и ключи между регионами не взаимозаменяемы; на один регион можно создать до 50 ключей — Alibaba Cloud Model Studio, Select region. Прямого текста ошибки вида «wrong region» вендор не документирует — так что ключ из ошибочного региона будет выглядеть как обычный отказ по квоте или доступу, и человек начинает разбирать несуществующий сбой сервиса вместо того, чтобы просто перевыпустить ключ в правильном регионе.
Диагностическое дерево: что проверять по порядку

Прежде чем менять модель или писать в поддержку, пройдите четыре шага в этом порядке — каждый следующий имеет смысл только после предыдущего.
| Шаг | Вопрос | Что проверить | Действие |
|---|---|---|---|
| 1. Поверхность | Где падает: Qwen Chat в браузере или Qwen Code CLI/агент? | Тип клиента и способ авторизации | Для CLI — сразу переход к шагу 3 |
| 2. Точный текст ошибки | Allocated quota exceeded (TPM) или Requests rate limit exceeded (RPM)? | Полный текст ответа API, не только код 429 | Если это RPM/TPM — снизьте темп запросов, подождите до 60 секунд |
| 3. Способ входа | Используется ли Qwen OAuth или платный API-ключ / Coding Plan? | Дата подключения аккаунта, наличие OAuth в /auth | Если OAuth — доступ закрыт с 15.04.2026, дальше без альтернативы не обойтись |
| 4. Регион ключа | Ключ выпущен для того же региона, что и endpoint запроса? | Регион в консоли Model Studio vs endpoint в конфиге | Перевыпустите ключ для нужного региона |
Если все четыре пункта в порядке, а ошибка повторяется — стоит проверить независимый мониторинг доступности вроде StatusGator, прежде чем менять аккаунт: у Qwen нет собственной публичной status-страницы, и StatusGator фиксировал короткие сбои chat.qwen.ai — 36 минут недоступности сайта 24 июня и 6 минут ошибок при отправке сообщений 21 июня 2026 года — при этом официально Alibaba эти инциденты не подтверждала — StatusGator, журнал инцидентов Qwen. На момент снимка конца июля крупных сбоев тот же трекер не фиксирует, но синтетический мониторинг с проверкой раз в 15 минут не видит локальных и аккаунт-специфичных проблем — так что отсутствие записи об инциденте не доказательство исправности лично вашего доступа.
Куда идти после диагностики
Если причина — закрытый OAuth, дальше три легальных пути, и они не равнозначны. Платный Coding Plan стоит около $50 в месяц и даёт порядка 90 000 запросов в месяц с доступом к нескольким моделям, включая qwen3-coder-next и qwen3-max — по данным независимого блога InventiveHQ — InventiveHQ, Coding Plan. Тот же материал описывает бесплатную альтернативу через OpenRouter — модель qwen/qwen3-coder:free с лимитом около 50 запросов в день, до почти 1000 в день после разовой покупки $10 кредитов — и локальный запуск через Ollama или vLLM при примерно 46 ГБ RAM/VRAM для 4-битного квантования. Все три цифры коммерческие и могут поменяться без предупреждения — это ориентир на момент публикации, а не гарантия.
Отдельно стоит сказать про соблазн взять сторонний прокси, который переупаковывает чужие OAuth-токены и выдаёт их за легитимный доступ — такие проекты существуют и обсуждаются, в частности в issue стороннего инструмента CLIProxyAPI, где пользователи прямо связывают ошибку квоты с использованием токенов через неофициальный прокси — Issue #1500, router-for-me/CLIProxyAPI. Условия использования Qwen прямо разрешают компании приостановить или закрыть аккаунт при подозрении на обход технических ограничений сервиса — qwen.ai, Terms of Service. Подтверждённых случаев реального бана именно за это в открытых источниках нет, но право на блокировку прописано в самих условиях использования чёрным по белому — рисковать ради экономии на подписке не стоит.
Если проблема не конкретно в Qwen, а в том, что команда вообще устала гоняться за региональными ключами и переключением между вендорскими консолями каждый раз, когда очередной провайдер меняет политику бесплатного тарифа, разумная альтернатива — держать один OpenAI-совместимый API-доступ с рублёвой оплатой и общим балансом на команду, вроде того, что даёт provod.ai: замена base URL вместо переписывания клиента снимает часть операционной возни с региональными ключами конкретно у одного вендора, а не решает проблему квоты Qwen напрямую. Для команды, которая уже устала переоформлять реквизиты под каждого провайдера, дополнительный плюс — единый договор и закрывающие документы от российского юрлица вместо отдельного оформления под каждый сервис.
Разбор по шагам занимает минуты две: посмотреть, где именно упало, прочитать текст ответа целиком, вспомнить способ авторизации, сверить регион ключа. Час переписки с поддержкой стоит дороже и приведёт туда же — бесплатный тариф, закрытый 15 апреля, там никто не вернёт.
provod.ai — модели для IDE, SDK и внутренних инструментов
Не заставляйте разработчиков менять рабочую среду: OpenAI-совместимые IDE, библиотеки и приложения подключаются к общему endpoint, а команда продолжает работать привычными командами и SDK.
В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.
Расширение выбора моделей не увеличивает тариф: стоимость запросов совпадает с официальной 1:1, без наценки со стороны provod.ai.
Подключите AI к рабочему стеку: форма регистрации · цены на модели · защита данных по 152-ФЗ · инструкция по миграции
Источники
- Issue #3203, GitHub — официальное объявление о закрытии бесплатного OAuth
- Qwen Code Docs — раздел Authentication
- Alibaba Cloud Model Studio — Rate limiting
- Alibaba Cloud Model Studio — Select region, service deployment scope
- Qwen — Terms of Service
- Issue #1742, GitHub — пользовательский отчёт об ошибке квоты
- Issue #1500, router-for-me/CLIProxyAPI — обсуждение прокси и ошибки квоты
- Hacker News, item 47789014 — реакция сообщества на закрытие бесплатного тарифа
- InventiveHQ — разбор платных и бесплатных альтернатив после закрытия тарифа
- StatusGator — журнал доступности Qwen
