В чём фокус
У Claude Code из коробки две встроенные боли, и обе не про ум модели. Первая — лимит: подписка выдаёт ограниченное окно запросов, и в середине рабочего дня оно кончается. Вторая — беспамятство: каждая новая сессия начинается с чистого листа, и то, что вы вчера полдня выясняли про проект, сегодня нужно рассказывать заново.
Между этими двумя лежит третья, менее заметная: контекстное окно заполняется быстро, и чем оно полнее, тем хуже модель держит ранние инструкции (Anthropic, Best practices). Каждый прочитанный файл, каждый вывод команды, весь ваш разговор лежат в одном окне и вытесняют то, что было сказано вначале. Лимит приходит быстрее не потому, что вы много работаете, а потому что в модель летит много мусора.
Плагины Claude Code — это способ поменять поведение инструмента, не трогая сам инструмент. Он умеет подключать сторонние расширения через маркетплейсы (дока, plugins), а часть вещей вообще ставится рядом и работает как прослойка. Пять штук ниже закрывают четыре разные дыры: откуда брать запросы, что помнить между днями, что вообще отправлять в модель и чего в вашем проекте не хватает.
Шаг 0: что нужно до старта
Всё ниже работает поверх Claude Code — это Claude, живущий прямо в редакторе кода как обычная программа. Он читает ваши файлы, запускает команды и правит проект сам. Если его ещё нет:
- Установка с нуля и оплата российской картой — Claude Code из России за вечер →
- Если хочется без подписки — Claude Code бесплатно →
- Чтобы Claude не путался в проекте — каркас проекта и CLAUDE.md →
Ещё понадобится Node.js версии 20 или новее — на нём стоит один из плагинов, и это единственное техническое требование во всём списке. Проверить, что он есть, можно одной командой:
node --version
# должно ответить v20.x.x или вышеЛимиты: OmniRoute
Самая обидная остановка — когда квота кончилась, а задача на середине. OmniRoute решает это не увеличением лимита, а тем, что лимитов становится много. Это локальный шлюз с MIT-лицензией: он поднимается у вас на машине, притворяется обычным адресом Claude и раздаёт запросы по 290 провайдерам, из которых больше девяноста работают бесплатно (репозиторий OmniRoute).
Работает это каскадом. Пока жив ваш основной провайдер, запросы идут к нему. Как только квота исчерпана, шлюз молча спускается на следующий уровень — сначала другие ключи, потом дешёвые модели, потом бесплатные. Вы этого не замечаете: в редакторе просто продолжается работа. Из сложенных бесплатных тарифов проект насчитывает порядка полутора миллиардов токенов в месяц — цифра заявлена самим репозиторием, и относиться к ней стоит как к потолку при идеальной раскладке, а не как к гарантии.
npm install -g omniroute
# поднимет API и панель на http://localhost:20128Дальше открываете панель на этом же адресе, выбираете бесплатные тарифы из списка (карта не нужна) и в настройках Claude Code указываете базовый адрес http://localhost:20128/v1, а моделью ставите auto — тогда шлюз сам решает, кому отдать запрос.
Память: claude-mem
Второй по частоте раздражитель — амнезия. Вы закрыли сессию, и всё, что Claude выяснил про проект за день, исчезло. Назавтра он снова читает те же файлы, снова спрашивает, где что лежит, и снова тратит на это контекст, который вы только что оплатили.
claude-mem вешается на пять точек жизненного цикла сессии — старт, отправку вашего сообщения, использование инструментов, остановку и завершение (репозиторий claude-mem). По ходу работы он записывает, что происходило, в конце сжимает это в короткую сводку, а в начале следующей сессии подкладывает относящееся к делу обратно. Ощущается это не как «включилась память», а как будто помощник просто помнит вчерашний разговор.
npx claude-mem installБаза лежит локально — SQLite в папке ~/.claude-mem/, там же настройки. Наружу ничего не уходит. Вместе с плагином приезжает навык поиска по истории проекта обычными словами и четыре инструмента: поиск по памяти, хронология и выгрузка полных наблюдений по идентификатору. То есть можно не только полагаться на автоподстановку, но и спросить прямо: «что мы решили про авторизацию на прошлой неделе».
Сжатие: Headroom
Первые два плагина добавляют ресурс. Этот — перестаёт его сливать. Headroom садится между вами и моделью и пропускает дальше только то, что действительно нужно: логи, выводы инструментов, куски файлов и результаты поиска ужимаются до того, как превратятся в токены (репозиторий Headroom).
Важная деталь, из-за которой это не превращается в «модель стала тупее»: сжатие обратимое. Вместе с ужатым куском Headroom кладёт маленький инструмент возврата — если модели действительно понадобится оригинал, она его достанет. Поэтому подробности не теряются, а просто не занимают место, пока не нужны.
Цифры проект приводит разные для разных типов данных: на выводе в формате JSON экономия доходит до 60–95 процентов, на обычной работе кодового агента скромнее — 15–20 процентов. В их примере разбора инцидента 65 694 токена превратились в 5 118, то есть 92 процента ушли. Лицензия Apache 2.0, поставить можно тремя способами — библиотекой в свой код, прокси-сервером или MCP-сервером. Для Claude Code проще всего третий вариант обёртки:
pip install "headroom-ai[all]"
# запустить Claude через локальный прокси со сжатием:
headroom wrap claudeКоманда поднимает прокси и запускает уже настроенную сессию — руками в конфигах ковыряться не нужно, настройки сохраняются в вашем ~/.claude.json.

Аудит: claude-code-setup
Единственный официальный в списке — плагин от самой Anthropic. Он решает задачу, которую обычно решают чужими подборками из интернета: что именно подключить конкретно к вашему проекту.
Плагин читает проект — структуру папок, зависимости, характер кода — и предлагает конфигурацию по пяти направлениям: MCP-серверы для внешних интеграций, навыки, хуки автоматических действий, субагенты под отдельные роли и слэш-команды под частые операции (README плагина). Причём не абстрактно, а по вашему стеку: увидел React — предложит инструмент для тестов интерфейса, увидел код авторизации — предложит субагента-безопасника.
И главное свойство, из-за которого его не страшно запускать на рабочем проекте: он работает только на чтение. В README сказано прямо — анализирует, но файлы не меняет. То есть это консультация, а не вмешательство: он показывает список, вы решаете.
# отдельной команды нет — просите обычными словами:
recommend automations for this project
# по-русски работает так же:
посмотри проект и скажи, каких хуков и навыков в нём не хватаетПривычки: Task Observer
Пятый — самый необычный, потому что улучшает не Claude, а ваши собственные инструкции для него. Это мета-навык: он смотрит, как идёт работа, и ловит три вещи — что вы поправили за моделью, что вы сделали руками вместо того чтобы записать правилом, и где его собственный подход дал сбой (репозиторий проекта).
В конце сессии он выдаёт структурный отчёт: что заметил, каких навыков это касается и что конкретно в них поменять. Дальше вы либо соглашаетесь, либо нет. Смысл в накоплении: правило, которое вы третий месяц проговариваете вслух каждый раз, наконец оказывается записанным там, где Claude его прочитает сам.
Ставится он не через маркетплейс, а руками — скачиваете репозиторий и кладёте папку навыка в проект. Лицензия CC BY 4.0, то есть можно использовать и переделывать под себя с указанием авторства.
# склонировать и положить папку навыка в проект:
git clone https://github.com/rebelytics/one-skill-to-rule-them-all
# перенести task-observer в .claude/skills/task-observer/
# (SKILL.md и папка references/ должны лежать вместе)CLAUDE.md — тогда он поднимается в начале каждой сессии, а не когда повезёт.В каком порядке ставить
Ставить всё разом в первый вечер — плохая идея: если что-то сломается, вы не поймёте, что именно. Порядок ниже выстроен так, чтобы каждый следующий шаг было видно на фоне предыдущего.
Между третьим и четвёртым есть пересечение, о котором стоит знать заранее: сжатие есть и в Headroom, и внутри OmniRoute. Вместе они работают, но если ответы вдруг поплыли — выключайте по одному, а не оба сразу.
Плагины поставил. А кто будет работать, пока ты спишь?
Пять плагинов чинят инструмент — но инструмент всё ещё ждёт, пока вы сядете за него. Следующий шаг — собрать агента, который сам находит темы, делает карусели и ролики, выкладывает страницы и собирает заявки. Разбираем сборку по шагам за один день.
Что за агент →Что ты увидишь
Разница заметна не в первый час, а на второй день — когда обычно начинается «объясни всё заново». Вот один и тот же понедельник до и после.
ты: продолжаем вчерашнее
claude: Уточните, над чем мы работали? Прочитаю проект…
…двадцать минут на пересказ, и половина окна уже занята. К обеду — упор в лимит.
ты: продолжаем вчерашнее
claude: Вчера остановились на форме оплаты, спорный момент был с валидацией. Продолжаю оттуда?
ты: да
…а когда квота кончится, работа просто не остановится: запрос уйдёт к следующему провайдеру.

Чтобы не споткнуться
Три места, где обычно ломается — и как пройти их сразу.
А если…
Четыре сомнения, которые ловят на входе. Отвечаю прямо.
Зачем тебе это на самом деле
Поставить пять плагинов можно за вечер, и уже на этом меняется характер работы. Раньше день строился вокруг ограничений: с утра пересказ проекта, к обеду упор в квоту, вечером ожидание сброса. Инструмент диктовал темп, а вы под него подстраивались.
После — ограничения перестают быть событием дня. Память убирает утренний пересказ, сжатие растягивает окно, шлюз снимает потолок. Остаётся то, ради чего всё затевалось: вы ставите задачи, а не обслуживаете инструмент. И вот с этого места уже имеет смысл думать не про плагины, а про то, что этот инструмент может делать без вас.
А дальше
Пять плагинов закрывают фундамент: инструмент, который помнит, не упирается и не тратит лишнего. Но он по-прежнему ждёт, пока вы сядете и дадите задачу.
Следующий уровень — это когда работа идёт без вас: агент сам смотрит, что виралит в вашей нише, собирает из этого карусели и ролики, выкладывает страницы-гайды, заводит воронку на кодовое слово и приносит готовое на приёмку в телеграм. Это уже не настройка редактора, а собранный контент-агент — его разбираем по шагам за один день.
Источники
Всё, что выше, — из первоисточников: репозиториев самих плагинов и официальной документации Claude Code.