Пятичасовой лимит закончился в 14:00. Ты не генерировал ничего тяжёлого: отревьюил два PR, прогнал пару субагентов, починил тест. Такие истории после установки «продуктивностного» toolset стали обычным делом - с виду работы немного, а окно лимита пробито.
Виновника искать не нужно наугад: у Claude Code есть встроенный отчёт, раскладывающий расход по скиллам, субагентам, плагинам и MCP-серверам в процентах. Пройдём по официальной документации Anthropic (проверена 19 июля 2026) и разберём, куда утекают токены и что с этим делать.
Лимит подписки - это квота в скользящих окнах; его не следует смешивать со стоимостью API в долларах и локальной приблизительной атрибуцией /usage. План такой: сначала находим, кто тратит, потом решаем, за что стоит платить по полной. Кстати, рублёвый доступ к тем же моделям по официальным тарифам даёт provod.ai (российский OpenRouter) - к ценам вернёмся ближе к концу.
Платите в рублях за Claude API без наценки на токены через provod.ai
Что такое Everything Claude Code и почему после него лимит тает быстрее?
Коротко: это open-source проект ECC, бывший Everything Claude Code, репозиторий affaan-m/ECC: 67 агентов, 278 скиллов, хуки, правила и MCP-конфиги в одном флаконе. Надстройка честно ускоряет работу, но каждый её слой - это контекст, а контекст - токены из твоего лимита.
Проект собрал Affaan Mustafa из десяти с лишним месяцев ежедневной работы в Claude Code; на GitHub его ник affaan-m, и люди ищут репозиторий просто как affaan. На июль 2026 у него 211.9 тысячи звёзд и 32.5 тысячи форков (цифры растут еженедельно), лицензия MIT, мажорный релиз v2.0.0 - июнь 2026. Работает поверх Claude Code, Codex, Cursor и OpenCode.
Запрос «everything claude code» - это как раз он. Проблема в арифметике: в контексте постоянно есть листинг скиллов, а при вызове в него до конца сессии попадает SKILL.md; субагенты работают в отдельных окнах. Это разные статьи расхода, а не одновременная загрузка всех 278 скиллов и 67 агентов. Пройдём по слоям.
Как устроены лимиты: пять часов, неделя и общий пул с чатом
Коротко: у каждого платного плана лимит сбрасывается в скользящем 5-часовом окне, сверху лежит недельный потолок, а расход общий между Claude в браузере и Claude Code. Переключение модели через /model окно не сбрасывает - окна общие для всех моделей.
По странице цен Anthropic на 19 июля 2026: Pro - $20 в месяц ($17 при годовой оплате), Max - от $100 (кратность 5x или 20x к Pro), Team - $25 за место. Абсолютные цифры лимитов компания не публикует, только кратности - точный потолок заранее не посчитать.
История этого года показательная. 26 марта 2026 Anthropic урезала 5-часовые лимиты в пиковые часы, и примерно 7% пользователей впервые уперлись в потолок. 6 мая 2026 пиковое урезание отменили, а лимиты удвоили для Pro, Max, Team и seat-based Enterprise - на фоне сделки со SpaceX о доступе к дата-центру Colossus 1 (больше 300 МВт и 220 тысяч GPU). Лимиты растут, но аппетит надстроек растёт быстрее.
Где посмотреть, кто съел лимит: /usage, /context и /doctor
Коротко: на платных планах команда /usage показывает разбивку расхода в процентах - по скиллам, субагентам, плагинам и отдельным MCP-серверам. Клавиши d и w переключают «последние 24 часа» и «последние 7 дней». В расширении VS Code та же таблица живёт в диалоге Account & usage, нужен Claude Code v2.1.174 или новее.
Две оговорки. Цифры приблизительные и локальные: считаются по сессиям этого компьютера, расход с других устройств и claude.ai сюда не попадает. И /usage сам подсвечивает поведение, съевшее 10%+ недавнего расхода - промахи кэша, длинный контекст, интенсивных субагентов - с советом под каждый флаг.
Рядом две команды: /context показывает строку Skills - сколько окна заняли скиллы прямо сейчас, а /doctor оценивает стоимость их листинга. Актуальная на 19 июля 2026 версия - 2.1.215: Claude перестал запускать /verify и /code-review сам, только по явному вызову. Плагины в отчёте видны отдельной строкой, ставятся из официального маркетплейса командой вроде /plugin marketplace add anthropics/claude-plugins-official; организация anthropics ведёт его на GitHub. Каждый плагин - потенциальная строка в счёте.
Сколько стоят скиллы: аренда листинга и тело, которое не уходит
Коротко: скиллы платят дважды. Сначала «аренда»: листинг имён и описаний всех скиллов постоянно занимает до 1% контекстного окна. Потом вызов: отрендеренный SKILL.md входит в контекст и остаётся там до конца сессии.
Механика из документации Skills. На скилл связка description + when_to_use режется до 1 536 символов; при переполнении бюджета листинга описания обрезают, начиная с редко вызываемых. При вызове тело скилла приходит одним сообщением, и документация формулирует жёстко:
«Every line is a recurring token cost»- Anthropic, документация Skills >Перевод: «каждая строка - это повторяющийся расход токенов».
При автокомпакции скиллы перевешиваются после саммари с бюджетом: первые 5 000 токенов каждого, суммарно не больше 25 000; старые могут вылететь полностью. Из свежего в changelog: v2.1.202 убрала дублирование загруженного скилла при повторном вызове, а v2.1.199 разрешила стековать до пяти скиллов в одном сообщении - удобно и одновременно способ загрузить пять тел разом. Вывод: тонкий SKILL.md и выгрузка неиспользуемых скиллов - самая дешёвая экономия.
Субагенты: отдельное окно или двойной счёт?
Коротко: и то, и другое. Каждый субагент работает в собственном контекстном окне и не раздувает главный диалог промежуточными шагами - это экономия. Но его окно - отдельный счёт, а резюме результатов возвращается в диалог и заполняет его.
По документации Subagents: субагент получает только свой системный промпт плюс базовое окружение, порождать других субагентов не может, автокомпакция срабатывает примерно на 95% окна. Встроенный Explore работает на Haiku - быстрый, read-only, осознанно дешёвая роль.
Дальше - арифметика масштаба. Agent teams, параллельные экземпляры Claude Code со своими окнами, расходуют примерно в 7 раз больше токенов обычной сессии, когда teammates работают в plan mode. Фича выключена по умолчанию (CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS=1). А в v2.1.212 появился стоп-кран: максимум 200 спавнов субагентов за сессию (CLAUDE_CODE_MAX_SUBAGENTS_PER_SESSION) - против «бешеных» циклов делегирования.
MCP-серверы: невидимый налог на инструменты
Коротко: при отложенной загрузке в контекст сначала попадают только имена MCP-инструментов, а описания подгружаются по мере вызова; MCP Tool Search автоматически включается, когда описания превысили бы 10% окна. Вывод одного вызова по умолчанию ограничен 25 000 токенами. Сжатие окна с 200k до ~70k - возможный кейс из FAQ ECC, а не эффект любых шести серверов.
Цитата из FAQ репозитория:
«Too many MCP servers eat your context... Each MCP tool description consumes tokens from your 200k window, potentially reducing it to ~70k»- FAQ ECC, GitHub >Перевод: «слишком много MCP-серверов съедают контекст... каждое описание инструмента тратит токены из твоего окна 200k, потенциально сжимая его до ~70k».
Поэтому в июне 2026 ECC сократил коннекторы по умолчанию с шести до одного (chrome-devtools), остальные - по opt-in. У Anthropic свой клапан: определения инструментов откладываются, а MCP Tool Search включается автоматически, когда описания превысили бы 10% окна. Управляется переменной ENABLE_TOOL_SEARCH (auto по умолчанию, auto:5 - свой порог, false - грузить всё), работает на Sonnet 4+ и Opus 4+, на Haiku нет. Про вывод: предупреждение после 10 000 токенов за вызов, жёсткий потолок 25 000 поднимается через MAX_MCP_OUTPUT_TOKENS.
И следи, в каких domains (областях - user, project, local) прописан сервер: на уровне user он облагает налогом все проекты, даже те, где не нужен. Пример: в issue #754 официального репозитория плагинов (19 марта 2026) плагин Vercel инъектил через хуки до 57 КБ session-start контекста и ломал работу моделей с малым окном.
| Слой | Что тратит | Как измерить | Рычаг снижения |
|---|---|---|---|
| Скиллы | Листинг ~1% окна + тело до конца сессии | /context, строка Skills; /doctor | Тонкий SKILL.md, выгрузить лишние |
| Субагенты | Своё окно каждому + резюме в диалог | /usage, атрибуция в процентах | Explore на Haiku; потолок 200 спавнов |
| MCP | Описания инструментов + вывод до 25k токенов | /usage по серверам; порог Tool Search 10% | ENABLE_TOOL_SEARCH=auto; один коннектор opt-in |
| CLAUDE.md | Загрузка при старте каждой сессии | /context | До 200 строк, детали - в скиллы |
| Thinking | Десятки тысяч токенов как output | Счёт сессии | /effort или MAX_THINKING_TOKENS |
| Фон | Суммаризация для --resume, служебные проверки | Менее $0.04 за сессию | Не трогать, копейки |
Резать нужно не всё подряд. Открой /usage за семь дней и сверь с таблицей: у одного перевес дадут скиллы, у другого - пара «тяжёлых» MCP-серверов, у третьего - субагентный фанатизм. Универсальной раскладки нет, есть твоя. Цифры таблицы - из документации Anthropic на июль 2026.
Кейс ECC с окном, сжатым с 200k до ~70k, нагляднее любого совета: шесть серверов по умолчанию стоили проекту две трети контекста. Картинка ниже - про это.

Тихие расходы: thinking, толстый CLAUDE.md и фон
Коротко: три статьи расхода работают без твоего участия. Thinking-токены тарифицируются как output и по умолчанию уходят десятками тысяч на запрос. CLAUDE.md загружается при старте каждой сессии, даже на нерелевантных задачах. Фоновая суммаризация и служебные проверки - менее $0.04 за сессию.
По странице Costs: дефолтный бюджет thinking - десятки тысяч токенов на запрос, снижается через /effort или MAX_THINKING_TOKENS; для рутинных правок «думать» в полный бюджет незачем. CLAUDE.md официальная рекомендация держит в пределах 200 строк, а специализированные инструкции переносить в скиллы - они грузятся по требованию. Хуки - ещё один легальный компрессор: пример из доков фильтрует вывод тестов до упавших, сжимая десятки тысяч токенов логов до сотен. А фон трогать не стоит: $0.04 за сессию не окупают возни.
Что сделать сегодня, чтобы лимит дожил до конца дня
Коротко: открой /usage, найди верхнюю строку атрибуции и режь именно её. Обычно хватает пяти ходов.
- Посмотри /usage за 7 дней (клавиша w) и выпиши топ-1 потребителя: скиллы, субагенты или конкретный MCP-сервер.
- Проверь /context и /doctor: сколько окна занимает листинг скиллов; выгрузи невостребованные, ужми длинные описания.
- Оставь один MCP-коннектор по умолчанию, остальные - по opt-in, как в политике ECC; убедись, что Tool Search включён.
- Переведи фоновых субагентов на дешёвый класс моделей (Explore уже на Haiku) и поставь потолок спавнов.
- Сократи CLAUDE.md до 200 строк, детальные инструкции перенеси в скиллы; на рутине снизь /effort.
Полезные переменные окружения - экспортируй в шелле перед запуском:
ENABLE\_TOOL\_SEARCH=auto # Tool Search при описаниях MCP >10% окна MAX\_MCP\_OUTPUT\_TOKENS=25000 # жёсткий потолок вывода одного инструмента CLAUDE\_CODE\_MAX\_SUBAGENTS\_PER\_SESSION=200 # стоп-кран от циклов делегирования (v2.1.212)
Что эта настройка не решит
Коротко: чистка не отменяет саму модель лимитов. Пятичасовое окно и недельный потолок останутся, сколько бы ты ни оптимизировал.
/clear обнуляет только локальный счётчик стоимости сессии (и даже это починили лишь в v2.1.211); серверные окна подписки он не трогает. Переход с подписки на API - прозрачность, а не бесплатность: деньги всё равно уйдут, просто будет видно, куда. И agent teams - инструмент скорости, а не экономии: семикратный расход в plan mode - цена параллелизма.
Модель под роль: как изменить структуру расхода
Коротко: второй рычаг после чистки - не одна модель на всё, а модель под роль. По официальному прайсу Anthropic на 19 июля 2026 разница между классами - в десятки раз.
Цены за миллион токенов, input/output: Fable 5 - $10/$50, Opus 4.8 - $5/$25, Sonnet 5 - $2/$10 по вводной цене до 31 августа 2026 (потом $3/$15), Haiku 4.5 - $1/$5. Чтение из промпт-кэша примерно в 10 раз дешевле input: у Opus 4.8 cache read - $0.50 за миллион. Отсюда схема: архитектуру и финальное ревью держи на топ-модели, поиск, черновики и субагентную рутину - на Haiku-классе. Хочешь изменить счёт за месяц, не трогая качество, - начинай с ролей, а не с промптов.
По той же документации, в энтерпрайз-развёртках Claude Code выходит в среднем около $13 на разработчика в активный день, $150-250 в месяц; у 90% - меньше $30 в день. Одна дебаг-сессия может стоить дороже дня чата: каждый ход несёт файлы, вызовы инструментов и многошаговые рассуждения.
Все эти цифры - официальные тарифы в долларах. По условиям сервиса, эти модели считает provod.ai: один баланс на чат и API, оплата картой РФ, СБП или по счёту с закрывающими. Тяжёлые роли остаются на топ-модели, фоновая рутина уходит на дешёвую - и всё видно в одном счёте.
Когда provod.ai не подходит
Коротко: если твой основной сценарий - подписочный Claude Code на Max с постоянной загрузкой, агрегатор подписку не заменит. Claude Code ходит по Anthropic API с собственными окнами лимитов, и это отдельный продукт.
Ещё два случая. Компании, которой нужен прямой Enterprise-контракт с Anthropic ради SLA и аудита от вендора, нужен договор с вендором, а не посредник. И если платишь за API хаотично, не понимая своего расхода, сначала настрой учёт по инструкции выше - иначе счёт в рублях удивит так же, как в долларах. Агрегатор снимает вопрос доступа и оплаты из России; дисциплина расхода остаётся на тебе.
Словарик запросов кластера
Коротко: поисковая статистика примешивает чужие кластеры - от колонок Яндекса до музыкальных фитов. Вот честная расшифровка: что ищут и что это на самом деле.
Про сам проект и его окрестности:
- «affan» - опечатка: ищут «everything claude code affan», правильно - affaan, ник автора ECC.
- «corey» и «haynes» - «marketing skills claude by corey haynes»: набор Marketing Skills Кори Хейнса (Corey Haines); фамилия пишется Haines.
- «decompose» - «style decompose skill claude»: скиллы-декомпозиции, раскладывающие задачу на шаги.
- «daily» - «daily included routine runs claude»: routines, ежедневные фоновые запуски; каждый - тоже расход окна.
- «when» - «want to be notified when claude responds»: как получить уведомление, когда Claude закончил ответ.
- «zsh» - «zsh command not found claude»: после установки CLI не попал в PATH, чинится конфигом zsh.
- «lorrain» - «claude le lorrain пион»: Клод Лоррен, художник XVII века; к Claude Code отношения не имеет.
- «playa» - «la playa claude ciari»: инструментал Клода Чиари, не нейросеть.
Чужой кластер - ChatGPT:
- «booster» - «speed booster for chatgpt»: обещание «ускорить ChatGPT», мусорный интент.
- «comhttp», «gaphttps», «gpthttps» - склейки адресной строки chatgpt.com.
- «71700323», «id6448311069», «т4636sa» - обрывки ID из ссылок на приложения.
- «7bc4d75s3a8cqk27», «xl5raq2hh7sw22dx» - технические хвосты активационных URL.
- «aqatattoo», «alisagpt», «chatgptchatapp», «greekbot», «youtubetranscript» - сторонние обёртки и сайты-клоны вокруг ChatGPT.
- «nslookup», «querry» - DNS-диагностика chatgpt.com; querry - опечатка от query.
- «cheats», «exploits» - читы и эксплойты для игр.
- «mobs» - «talking mobs chatgpt and tts»: озвучка игровых мобов.
- «imahe» - опечатка «image» в запросах про генерацию картинок.
Алиса и Яндекс:
- «65вт», «duo» - колонки Яндекса (Станция Макс 65 Вт, Duo Max), железо.
- «monika» - «just monika»: отсылка к Doki Doki Literature Club у Алисы.
- «ns» - обрывок названия кондиционера Neoclima.
- «цтв», «эа», «эей» - опечаточные хвосты в запросах про Алису, смысла не несут.
Suno, Udio и музыка:
- «feat» - фиты с треками Suno, музыкальный кластер.
- «slap» - slap house, жанровый тег промптов Suno; рядом ищут «tags» - теги стилей.
- «вдребезги» - название трека из запросов про скачивание музыки.
- «modern», «2k26» - стилизация под Modern Talking.
- «outlaws» - русская озвучка Star Wars Outlaws нейросетью.
- «rubber» - rubber mallet, резиновый молоточек из запроса про обработку трека.
- «device» - high definition audio device, аудиодрайвер Windows.
- «relaxation», «литься» - фоновая relaxation-музыка; «льются» - из того же запроса.
- «reverse» - reverse audio online, переворот аудио; «ht» - Play.ht, сервис озвучки.
Видео и картинки:
- «aiseesoft», «gstory», «photocat», «tensorpix», «unifab», «wink» - сервисы AI-апскейла видео.
- «flipped», «merge» - мобильные приложения с AI-персонажами и их склейкой (Merge Labs).
- «joy», «aigirl» - NSFW-чат-боты с персонажами; нормальные платформы режут такое фильтрами.
- «морозко», «приёмыш» - рисунки к сказкам из детских запросов к генераторам.
- «chayka», «nataliia» - профили пользователей Шедеврума; «берёза» - промпт «на берёзе выбить цветок» оттуда же.
- «event», «schadar» - музыкальный релиз Event Horizon, не про код.
- «readania» - сайт readania.com из запроса про детектив от нейросети.
Прочие модели и сервисы:
- «club», «sparklers» - «gemini club sparklers», визуальный эффект бенгальских огней в Gemini.
- «googl» - опечатка google в адресе Gemini.
- «kino» - фильм «Гемини» на узбекском: кино, не модель.
- «huggin» - опечатка Hugging Face; «init», «spreadsheet» - инициализация модели и табличный агент Qwen.
- «чст» - опечаточный обрывок «квено аи».
- «tc» - доменная проверка почты DeepSeek; «рейдж» - обрывок запроса про «дипсик».
- «r2v» - режим генерации Grok Imagine; «workdir» - рабочая папка вложений Grok.
- «es» - испаноязычные запросы про Llama; «living» - AR-приложение «лама в гостиной».
- «cognitivecomputations» - Cognitive Computations, авторы Dolphin Mistral.
- «ulitra» - опечатка «ultra» в запросах про GigaChat.
- «shut» - слухи «sora shut down»; «фрт» - опечатка рядом с Sora.
- «kwaivgi», «popular» - настройки Kling: motion control и motion reference.
- «hunyuanglobal» - 3D-сервис Hunyuan; «ultrareal» - файнтюн Flux под фотореализм; «softgen» - AI-конструктор приложений.
- «ragdolls» - игра Fun with Ragdolls, не RAG; «driving» - full self driving, автопилот Tesla.
- «latent» - latent space, термин из теории моделей; «title» - обрывок URL синонимайзера.
Частые вопросы
Коротко: пять вопросов, которые остаются после чистки - про /clear, локальность цифр, порог MCP, субагентов и майские лимиты.
Сбрасывает ли /clear расход по подписке? Нет. Окна живут на сервере Anthropic. /clear обнуляет только локальный счётчик стоимости сессии - и даже это починили лишь в v2.1.211.
Почему /usage не видит расход с другого компьютера? Цифры считаются локально, по сессиям этой машины. Расход со второго ноутбука и с claude.ai в отчёт не попадает, сумму по команде придётся собирать вручную.
Сколько MCP-серверов - уже много? Ориентир из документации: описания инструментов больше 10% окна - с этого порога автоматически включается Tool Search. Практический эталон - политика ECC: один коннектор по умолчанию, остальное opt-in.
Правда, что субагенты экономят контекст? Главный диалог - да: промежуточные шаги остаются в изолированном окне субагента. Общий счёт - нет: каждый субагент тратит своё окно, резюме возвращается в диалог. Agent teams в plan mode - семикратный расход.
Что изменилось с лимитами в мае 2026? 6 мая 2026 Anthropic отменила пиковое урезание, действовавшее с 26 марта, и удвоила 5-часовые лимиты для Pro, Max, Team и seat-based Enterprise. Заодно существенно подняла API rate limits для Opus.
Моя граница такая: надстройка оправдана, если она видна в /usage и ты помнишь, когда ей пользовался. Всё, что висит в контексте «на всякий случай», - кандидат на вылет. Согласен? Или у тебя обратный опыт: чем больше агентов, тем спокойнее?

provod.ai — централизуйте расходы на модели
Один баланс и рабочее пространство дают компании общую точку контроля: не нужно собирать счета по личным кабинетам и разбираться, какая команда потратила бюджет у какого поставщика.
В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.
Основа расчёта прозрачна: официальный тариф каждой модели передаётся 1:1, без собственной наценки provod.ai.
Соберите AI-расходы в одном месте: форма регистрации · цены на модели · защита данных по 152-ФЗ · реквизиты для договора
Источники
Коротко: первоисточники по каждому числу - документы Anthropic, репозиторий ECC и changelog; всё проверено 19 июля 2026.
- Claude Code Docs - Costs: https://code.claude.com/docs/en/costs
- Claude Code Docs - VS Code (RU): https://code.claude.com/docs/ru/vs-code
- Skills: https://docs.claude.com/en/docs/claude-code/skills
- Subagents: https://docs.claude.com/en/docs/claude-code/sub-agents
- MCP: https://docs.claude.com/en/docs/claude-code/mcp
- Репозиторий ECC: https://github.com/affaan-m/ECC
- Anthropic - Pricing: https://www.anthropic.com/pricing
- Anthropic - Higher limits, 06.05.2026: https://www.anthropic.com/news/higher-limits-spacex
- DataCamp - обзор ECC, 29.06.2026: https://www.datacamp.com/tutorial/everything-claude-code
- Changelog Claude Code: https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
- Issue #754, 19.03.2026: https://github.com/anthropics/claude-plugins-official/issues/754
- Code to Cloud про ECC, 21.05.2026: https://codetocloud.io/blog/claude-code-repos-engineering-team/
- Marketing Skills Кори Хейнса, 04.06.2026: https://agenticskills.io/skills/marketing-skills
- AI Tools Recap, 06.05.2026: https://aitoolsrecap.com/Blog/anthropic-claude-code-rate-limits-doubled-opus-api-2026
Спорный вывод напоследок: «экономить токены» и «работать быстрее» - конфликтующие цели. Тонкий toolset возвращает лимит вместе с ручной работой, которую скиллы делали за тебя; жирный стек съедает окно, но честно его отрабатывает.
