DEV Community

Cover image for «everything claude code»: куда уходят лимиты - расход по скиллам, субагентам и MCP
Promptra Team for Promptra

Posted on

«everything claude code»: куда уходят лимиты - расход по скиллам, субагентам и MCP

Пятичасовой лимит закончился в 14:00. Ты не генерировал ничего тяжёлого: отревьюил два PR, прогнал пару субагентов, починил тест. Такие истории после установки «продуктивностного» toolset стали обычным делом - с виду работы немного, а окно лимита пробито.

Виновника искать не нужно наугад: у Claude Code есть встроенный отчёт, раскладывающий расход по скиллам, субагентам, плагинам и MCP-серверам в процентах. Пройдём по официальной документации Anthropic (проверена 19 июля 2026) и разберём, куда утекают токены и что с этим делать.

Лимит подписки - это квота в скользящих окнах; его не следует смешивать со стоимостью API в долларах и локальной приблизительной атрибуцией /usage. План такой: сначала находим, кто тратит, потом решаем, за что стоит платить по полной. Кстати, рублёвый доступ к тем же моделям по официальным тарифам даёт provod.ai (российский OpenRouter) - к ценам вернёмся ближе к концу.

Что такое Everything Claude Code и почему после него лимит тает быстрее?

Коротко: это open-source проект ECC, бывший Everything Claude Code, репозиторий affaan-m/ECC: 67 агентов, 278 скиллов, хуки, правила и MCP-конфиги в одном флаконе. Надстройка честно ускоряет работу, но каждый её слой - это контекст, а контекст - токены из твоего лимита.

Проект собрал Affaan Mustafa из десяти с лишним месяцев ежедневной работы в Claude Code; на GitHub его ник affaan-m, и люди ищут репозиторий просто как affaan. На июль 2026 у него 211.9 тысячи звёзд и 32.5 тысячи форков (цифры растут еженедельно), лицензия MIT, мажорный релиз v2.0.0 - июнь 2026. Работает поверх Claude Code, Codex, Cursor и OpenCode.

Запрос «everything claude code» - это как раз он. Проблема в арифметике: в контексте постоянно есть листинг скиллов, а при вызове в него до конца сессии попадает SKILL.md; субагенты работают в отдельных окнах. Это разные статьи расхода, а не одновременная загрузка всех 278 скиллов и 67 агентов. Пройдём по слоям.

Как устроены лимиты: пять часов, неделя и общий пул с чатом

Коротко: у каждого платного плана лимит сбрасывается в скользящем 5-часовом окне, сверху лежит недельный потолок, а расход общий между Claude в браузере и Claude Code. Переключение модели через /model окно не сбрасывает - окна общие для всех моделей.

По странице цен Anthropic на 19 июля 2026: Pro - $20 в месяц ($17 при годовой оплате), Max - от $100 (кратность 5x или 20x к Pro), Team - $25 за место. Абсолютные цифры лимитов компания не публикует, только кратности - точный потолок заранее не посчитать.

История этого года показательная. 26 марта 2026 Anthropic урезала 5-часовые лимиты в пиковые часы, и примерно 7% пользователей впервые уперлись в потолок. 6 мая 2026 пиковое урезание отменили, а лимиты удвоили для Pro, Max, Team и seat-based Enterprise - на фоне сделки со SpaceX о доступе к дата-центру Colossus 1 (больше 300 МВт и 220 тысяч GPU). Лимиты растут, но аппетит надстроек растёт быстрее.

Где посмотреть, кто съел лимит: /usage, /context и /doctor

Коротко: на платных планах команда /usage показывает разбивку расхода в процентах - по скиллам, субагентам, плагинам и отдельным MCP-серверам. Клавиши d и w переключают «последние 24 часа» и «последние 7 дней». В расширении VS Code та же таблица живёт в диалоге Account & usage, нужен Claude Code v2.1.174 или новее.

Две оговорки. Цифры приблизительные и локальные: считаются по сессиям этого компьютера, расход с других устройств и claude.ai сюда не попадает. И /usage сам подсвечивает поведение, съевшее 10%+ недавнего расхода - промахи кэша, длинный контекст, интенсивных субагентов - с советом под каждый флаг.

Рядом две команды: /context показывает строку Skills - сколько окна заняли скиллы прямо сейчас, а /doctor оценивает стоимость их листинга. Актуальная на 19 июля 2026 версия - 2.1.215: Claude перестал запускать /verify и /code-review сам, только по явному вызову. Плагины в отчёте видны отдельной строкой, ставятся из официального маркетплейса командой вроде /plugin marketplace add anthropics/claude-plugins-official; организация anthropics ведёт его на GitHub. Каждый плагин - потенциальная строка в счёте.

Сколько стоят скиллы: аренда листинга и тело, которое не уходит

Коротко: скиллы платят дважды. Сначала «аренда»: листинг имён и описаний всех скиллов постоянно занимает до 1% контекстного окна. Потом вызов: отрендеренный SKILL.md входит в контекст и остаётся там до конца сессии.

Механика из документации Skills. На скилл связка description + when_to_use режется до 1 536 символов; при переполнении бюджета листинга описания обрезают, начиная с редко вызываемых. При вызове тело скилла приходит одним сообщением, и документация формулирует жёстко:

«Every line is a recurring token cost»

  • Anthropic, документация Skills

Перевод: «каждая строка - это повторяющийся расход токенов».

При автокомпакции скиллы перевешиваются после саммари с бюджетом: первые 5 000 токенов каждого, суммарно не больше 25 000; старые могут вылететь полностью. Из свежего в changelog: v2.1.202 убрала дублирование загруженного скилла при повторном вызове, а v2.1.199 разрешила стековать до пяти скиллов в одном сообщении - удобно и одновременно способ загрузить пять тел разом. Вывод: тонкий SKILL.md и выгрузка неиспользуемых скиллов - самая дешёвая экономия.

Субагенты: отдельное окно или двойной счёт?

Коротко: и то, и другое. Каждый субагент работает в собственном контекстном окне и не раздувает главный диалог промежуточными шагами - это экономия. Но его окно - отдельный счёт, а резюме результатов возвращается в диалог и заполняет его.

По документации Subagents: субагент получает только свой системный промпт плюс базовое окружение, порождать других субагентов не может, автокомпакция срабатывает примерно на 95% окна. Встроенный Explore работает на Haiku - быстрый, read-only, осознанно дешёвая роль.

Дальше - арифметика масштаба. Agent teams, параллельные экземпляры Claude Code со своими окнами, расходуют примерно в 7 раз больше токенов обычной сессии, когда teammates работают в plan mode. Фича выключена по умолчанию (CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS=1). А в v2.1.212 появился стоп-кран: максимум 200 спавнов субагентов за сессию (CLAUDE_CODE_MAX_SUBAGENTS_PER_SESSION) - против «бешеных» циклов делегирования.

MCP-серверы: невидимый налог на инструменты

Коротко: при отложенной загрузке в контекст сначала попадают только имена MCP-инструментов, а описания подгружаются по мере вызова; MCP Tool Search автоматически включается, когда описания превысили бы 10% окна. Вывод одного вызова по умолчанию ограничен 25 000 токенами. Сжатие окна с 200k до ~70k - возможный кейс из FAQ ECC, а не эффект любых шести серверов.

Цитата из FAQ репозитория:

«Too many MCP servers eat your context... Each MCP tool description consumes tokens from your 200k window, potentially reducing it to ~70k»

  • FAQ ECC, GitHub

Перевод: «слишком много MCP-серверов съедают контекст... каждое описание инструмента тратит токены из твоего окна 200k, потенциально сжимая его до ~70k».

Поэтому в июне 2026 ECC сократил коннекторы по умолчанию с шести до одного (chrome-devtools), остальные - по opt-in. У Anthropic свой клапан: определения инструментов откладываются, а MCP Tool Search включается автоматически, когда описания превысили бы 10% окна. Управляется переменной ENABLE_TOOL_SEARCH (auto по умолчанию, auto:5 - свой порог, false - грузить всё), работает на Sonnet 4+ и Opus 4+, на Haiku нет. Про вывод: предупреждение после 10 000 токенов за вызов, жёсткий потолок 25 000 поднимается через MAX_MCP_OUTPUT_TOKENS.

И следи, в каких domains (областях - user, project, local) прописан сервер: на уровне user он облагает налогом все проекты, даже те, где не нужен. Пример: в issue #754 официального репозитория плагинов (19 марта 2026) плагин Vercel инъектил через хуки до 57 КБ session-start контекста и ломал работу моделей с малым окном.

Слой Что тратит Как измерить Рычаг снижения
Скиллы Листинг ~1% окна + тело до конца сессии /context, строка Skills; /doctor Тонкий SKILL.md, выгрузить лишние
Субагенты Своё окно каждому + резюме в диалог /usage, атрибуция в процентах Explore на Haiku; потолок 200 спавнов
MCP Описания инструментов + вывод до 25k токенов /usage по серверам; порог Tool Search 10% ENABLE_TOOL_SEARCH=auto; один коннектор opt-in
CLAUDE.md Загрузка при старте каждой сессии /context До 200 строк, детали - в скиллы
Thinking Десятки тысяч токенов как output Счёт сессии /effort или MAX_THINKING_TOKENS
Фон Суммаризация для --resume, служебные проверки Менее $0.04 за сессию Не трогать, копейки

Резать нужно не всё подряд. Открой /usage за семь дней и сверь с таблицей: у одного перевес дадут скиллы, у другого - пара «тяжёлых» MCP-серверов, у третьего - субагентный фанатизм. Универсальной раскладки нет, есть твоя. Цифры таблицы - из документации Anthropic на июль 2026.

Кейс ECC с окном, сжатым с 200k до ~70k, нагляднее любого совета: шесть серверов по умолчанию стоили проекту две трети контекста. Картинка ниже - про это.

Шкала окна: как шесть MCP-серверов сжали 200k до ~70k, кейс ECC

Тихие расходы: thinking, толстый CLAUDE.md и фон

Коротко: три статьи расхода работают без твоего участия. Thinking-токены тарифицируются как output и по умолчанию уходят десятками тысяч на запрос. CLAUDE.md загружается при старте каждой сессии, даже на нерелевантных задачах. Фоновая суммаризация и служебные проверки - менее $0.04 за сессию.

По странице Costs: дефолтный бюджет thinking - десятки тысяч токенов на запрос, снижается через /effort или MAX_THINKING_TOKENS; для рутинных правок «думать» в полный бюджет незачем. CLAUDE.md официальная рекомендация держит в пределах 200 строк, а специализированные инструкции переносить в скиллы - они грузятся по требованию. Хуки - ещё один легальный компрессор: пример из доков фильтрует вывод тестов до упавших, сжимая десятки тысяч токенов логов до сотен. А фон трогать не стоит: $0.04 за сессию не окупают возни.

Что сделать сегодня, чтобы лимит дожил до конца дня

Коротко: открой /usage, найди верхнюю строку атрибуции и режь именно её. Обычно хватает пяти ходов.

  1. Посмотри /usage за 7 дней (клавиша w) и выпиши топ-1 потребителя: скиллы, субагенты или конкретный MCP-сервер.
  2. Проверь /context и /doctor: сколько окна занимает листинг скиллов; выгрузи невостребованные, ужми длинные описания.
  3. Оставь один MCP-коннектор по умолчанию, остальные - по opt-in, как в политике ECC; убедись, что Tool Search включён.
  4. Переведи фоновых субагентов на дешёвый класс моделей (Explore уже на Haiku) и поставь потолок спавнов.
  5. Сократи CLAUDE.md до 200 строк, детальные инструкции перенеси в скиллы; на рутине снизь /effort.

Полезные переменные окружения - экспортируй в шелле перед запуском:

ENABLE_TOOL_SEARCH=auto                    # Tool Search при описаниях MCP >10% окна
MAX_MCP_OUTPUT_TOKENS=25000                # жёсткий потолок вывода одного инструмента
CLAUDE_CODE_MAX_SUBAGENTS_PER_SESSION=200  # стоп-кран от циклов делегирования (v2.1.212)
Enter fullscreen mode Exit fullscreen mode

Что эта настройка не решит

Коротко: чистка не отменяет саму модель лимитов. Пятичасовое окно и недельный потолок останутся, сколько бы ты ни оптимизировал.

/clear обнуляет только локальный счётчик стоимости сессии (и даже это починили лишь в v2.1.211); серверные окна подписки он не трогает. Переход с подписки на API - прозрачность, а не бесплатность: деньги всё равно уйдут, просто будет видно, куда. И agent teams - инструмент скорости, а не экономии: семикратный расход в plan mode - цена параллелизма.

Модель под роль: как изменить структуру расхода

Коротко: второй рычаг после чистки - не одна модель на всё, а модель под роль. По официальному прайсу Anthropic на 19 июля 2026 разница между классами - в десятки раз.

Цены за миллион токенов, input/output: Fable 5 - $10/$50, Opus 4.8 - $5/$25, Sonnet 5 - $2/$10 по вводной цене до 31 августа 2026 (потом $3/$15), Haiku 4.5 - $1/$5. Чтение из промпт-кэша примерно в 10 раз дешевле input: у Opus 4.8 cache read - $0.50 за миллион. Отсюда схема: архитектуру и финальное ревью держи на топ-модели, поиск, черновики и субагентную рутину - на Haiku-классе. Хочешь изменить счёт за месяц, не трогая качество, - начинай с ролей, а не с промптов.

По той же документации, в энтерпрайз-развёртках Claude Code выходит в среднем около $13 на разработчика в активный день, $150-250 в месяц; у 90% - меньше $30 в день. Одна дебаг-сессия может стоить дороже дня чата: каждый ход несёт файлы, вызовы инструментов и многошаговые рассуждения.

Все эти цифры - официальные тарифы в долларах. По условиям сервиса, эти модели считает provod.ai: один баланс на чат и API, оплата картой РФ, СБП или по счёту с закрывающими. Тяжёлые роли остаются на топ-модели, фоновая рутина уходит на дешёвую - и всё видно в одном счёте.

Когда provod.ai не подходит

Коротко: если твой основной сценарий - подписочный Claude Code на Max с постоянной загрузкой, агрегатор подписку не заменит. Claude Code ходит по Anthropic API с собственными окнами лимитов, и это отдельный продукт.

Ещё два случая. Компании, которой нужен прямой Enterprise-контракт с Anthropic ради SLA и аудита от вендора, нужен договор с вендором, а не посредник. И если платишь за API хаотично, не понимая своего расхода, сначала настрой учёт по инструкции выше - иначе счёт в рублях удивит так же, как в долларах. Агрегатор снимает вопрос доступа и оплаты из России; дисциплина расхода остаётся на тебе.

Словарик запросов кластера

Коротко: поисковая статистика примешивает чужие кластеры - от колонок Яндекса до музыкальных фитов. Вот честная расшифровка: что ищут и что это на самом деле.

Про сам проект и его окрестности:

  • «affan» - опечатка: ищут «everything claude code affan», правильно - affaan, ник автора ECC.
  • «corey» и «haynes» - «marketing skills claude by corey haynes»: набор Marketing Skills Кори Хейнса (Corey Haines); фамилия пишется Haines.
  • «decompose» - «style decompose skill claude»: скиллы-декомпозиции, раскладывающие задачу на шаги.
  • «daily» - «daily included routine runs claude»: routines, ежедневные фоновые запуски; каждый - тоже расход окна.
  • «when» - «want to be notified when claude responds»: как получить уведомление, когда Claude закончил ответ.
  • «zsh» - «zsh command not found claude»: после установки CLI не попал в PATH, чинится конфигом zsh.
  • «lorrain» - «claude le lorrain пион»: Клод Лоррен, художник XVII века; к Claude Code отношения не имеет.
  • «playa» - «la playa claude ciari»: инструментал Клода Чиари, не нейросеть.

Чужой кластер - ChatGPT:

  • «booster» - «speed booster for chatgpt»: обещание «ускорить ChatGPT», мусорный интент.
  • «comhttp», «gaphttps», «gpthttps» - склейки адресной строки chatgpt.com.
  • «71700323», «id6448311069», «т4636sa» - обрывки ID из ссылок на приложения.
  • «7bc4d75s3a8cqk27», «xl5raq2hh7sw22dx» - технические хвосты активационных URL.
  • «aqatattoo», «alisagpt», «chatgptchatapp», «greekbot», «youtubetranscript» - сторонние обёртки и сайты-клоны вокруг ChatGPT.
  • «nslookup», «querry» - DNS-диагностика chatgpt.com; querry - опечатка от query.
  • «cheats», «exploits» - читы и эксплойты для игр.
  • «mobs» - «talking mobs chatgpt and tts»: озвучка игровых мобов.
  • «imahe» - опечатка «image» в запросах про генерацию картинок.

Алиса и Яндекс:

  • «65вт», «duo» - колонки Яндекса (Станция Макс 65 Вт, Duo Max), железо.
  • «monika» - «just monika»: отсылка к Doki Doki Literature Club у Алисы.
  • «ns» - обрывок названия кондиционера Neoclima.
  • «цтв», «эа», «эей» - опечаточные хвосты в запросах про Алису, смысла не несут.

Suno, Udio и музыка:

  • «feat» - фиты с треками Suno, музыкальный кластер.
  • «slap» - slap house, жанровый тег промптов Suno; рядом ищут «tags» - теги стилей.
  • «вдребезги» - название трека из запросов про скачивание музыки.
  • «modern», «2k26» - стилизация под Modern Talking.
  • «outlaws» - русская озвучка Star Wars Outlaws нейросетью.
  • «rubber» - rubber mallet, резиновый молоточек из запроса про обработку трека.
  • «device» - high definition audio device, аудиодрайвер Windows.
  • «relaxation», «литься» - фоновая relaxation-музыка; «льются» - из того же запроса.
  • «reverse» - reverse audio online, переворот аудио; «ht» - Play.ht, сервис озвучки.

Видео и картинки:

  • «aiseesoft», «gstory», «photocat», «tensorpix», «unifab», «wink» - сервисы AI-апскейла видео.
  • «flipped», «merge» - мобильные приложения с AI-персонажами и их склейкой (Merge Labs).
  • «joy», «aigirl» - NSFW-чат-боты с персонажами; нормальные платформы режут такое фильтрами.
  • «морозко», «приёмыш» - рисунки к сказкам из детских запросов к генераторам.
  • «chayka», «nataliia» - профили пользователей Шедеврума; «берёза» - промпт «на берёзе выбить цветок» оттуда же.
  • «event», «schadar» - музыкальный релиз Event Horizon, не про код.
  • «readania» - сайт readania.com из запроса про детектив от нейросети.

Прочие модели и сервисы:

  • «club», «sparklers» - «gemini club sparklers», визуальный эффект бенгальских огней в Gemini.
  • «googl» - опечатка google в адресе Gemini.
  • «kino» - фильм «Гемини» на узбекском: кино, не модель.
  • «huggin» - опечатка Hugging Face; «init», «spreadsheet» - инициализация модели и табличный агент Qwen.
  • «чст» - опечаточный обрывок «квено аи».
  • «tc» - доменная проверка почты DeepSeek; «рейдж» - обрывок запроса про «дипсик».
  • «r2v» - режим генерации Grok Imagine; «workdir» - рабочая папка вложений Grok.
  • «es» - испаноязычные запросы про Llama; «living» - AR-приложение «лама в гостиной».
  • «cognitivecomputations» - Cognitive Computations, авторы Dolphin Mistral.
  • «ulitra» - опечатка «ultra» в запросах про GigaChat.
  • «shut» - слухи «sora shut down»; «фрт» - опечатка рядом с Sora.
  • «kwaivgi», «popular» - настройки Kling: motion control и motion reference.
  • «hunyuanglobal» - 3D-сервис Hunyuan; «ultrareal» - файнтюн Flux под фотореализм; «softgen» - AI-конструктор приложений.
  • «ragdolls» - игра Fun with Ragdolls, не RAG; «driving» - full self driving, автопилот Tesla.
  • «latent» - latent space, термин из теории моделей; «title» - обрывок URL синонимайзера.

provod.ai — подключение AI без переписывания продукта

Сохраняйте привычный стек: приложение, AI-клиент, агент, IDE, SDK или библиотека продолжают работать в знакомом формате. Если инструмент поддерживает OpenAI-совместимый API, обычно меняются только URL и ключ.

В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

Стоимость моделей совпадает с официальными тарифами поставщиков 1:1: агрегатор не добавляет свою наценку, а российская команда платит в рублях через единый баланс.

Подключите существующий AI-стек к provod.ai: инструкция по миграции · форма регистрации · цены на модели · защита данных по 152-ФЗ

Частые вопросы

Коротко: пять вопросов, которые остаются после чистки - про /clear, локальность цифр, порог MCP, субагентов и майские лимиты.

Сбрасывает ли /clear расход по подписке?
Нет. Окна живут на сервере Anthropic. /clear обнуляет только локальный счётчик стоимости сессии - и даже это починили лишь в v2.1.211.

Почему /usage не видит расход с другого компьютера?
Цифры считаются локально, по сессиям этой машины. Расход со второго ноутбука и с claude.ai в отчёт не попадает, сумму по команде придётся собирать вручную.

Сколько MCP-серверов - уже много?
Ориентир из документации: описания инструментов больше 10% окна - с этого порога автоматически включается Tool Search. Практический эталон - политика ECC: один коннектор по умолчанию, остальное opt-in.

Правда, что субагенты экономят контекст?
Главный диалог - да: промежуточные шаги остаются в изолированном окне субагента. Общий счёт - нет: каждый субагент тратит своё окно, резюме возвращается в диалог. Agent teams в plan mode - семикратный расход.

Что изменилось с лимитами в мае 2026?
6 мая 2026 Anthropic отменила пиковое урезание, действовавшее с 26 марта, и удвоила 5-часовые лимиты для Pro, Max, Team и seat-based Enterprise. Заодно существенно подняла API rate limits для Opus.

Источники

Коротко: первоисточники по каждому числу - документы Anthropic, репозиторий ECC и changelog; всё проверено 19 июля 2026.

  1. Claude Code Docs - Costs: https://code.claude.com/docs/en/costs
  2. Claude Code Docs - VS Code (RU): https://code.claude.com/docs/ru/vs-code
  3. Skills: https://docs.claude.com/en/docs/claude-code/skills
  4. Subagents: https://docs.claude.com/en/docs/claude-code/sub-agents
  5. MCP: https://docs.claude.com/en/docs/claude-code/mcp
  6. Репозиторий ECC: https://github.com/affaan-m/ECC
  7. Anthropic - Pricing: https://www.anthropic.com/pricing
  8. Anthropic - Higher limits, 06.05.2026: https://www.anthropic.com/news/higher-limits-spacex
  9. DataCamp - обзор ECC, 29.06.2026: https://www.datacamp.com/tutorial/everything-claude-code
  10. Changelog Claude Code: https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
  11. Issue #754, 19.03.2026: https://github.com/anthropics/claude-plugins-official/issues/754
  12. Code to Cloud про ECC, 21.05.2026: https://codetocloud.io/blog/claude-code-repos-engineering-team/
  13. Marketing Skills Кори Хейнса, 04.06.2026: https://agenticskills.io/skills/marketing-skills
  14. AI Tools Recap, 06.05.2026: https://aitoolsrecap.com/Blog/anthropic-claude-code-rate-limits-doubled-opus-api-2026

Спорный вывод напоследок: «экономить токены» и «работать быстрее» - конфликтующие цели. Тонкий toolset возвращает лимит вместе с ручной работой, которую скиллы делали за тебя; жирный стек съедает окно, но честно его отрабатывает.

Моя граница такая: надстройка оправдана, если она видна в /usage и ты помнишь, когда ей пользовался. Всё, что висит в контексте «на всякий случай», - кандидат на вылет. Согласен? Или у тебя обратный опыт: чем больше агентов, тем спокойнее?

Один баланс provod.ai: тяжёлые роли на топ-модели, фоновая рутина на дешёвой

Посчитай, во что обходится твой toolset, и проверь те же сценарии на моделях подешевле: на provod.ai один баланс на чат и API, цены официальных провайдеров без наценки, оплата в рублях с карты РФ, юрлицам - договор и закрывающие.

Top comments (0)