AI Cube/Гайды/Пять плагинов
Claude Code · плагины · по шагам

Пять плагинов, которые снимают лимиты Claude Code

Работа идёт, мысль поймана — и тут упор в квоту до вечера. Назавтра садишься, и объяснять проект приходится заново, будто вчерашнего дня не было. Обычно это лечат деньгами: тариф побольше. Но ровно эти дыры закрывают пять бесплатных плагинов — свободные провайдеры вместо упора в лимит, память между сессиями, сжатие контекста, официальный аудит проекта от Anthropic и навык, который дописывает остальные навыки. Ниже — что каждый делает, команда установки и порядок, в котором их ставить, чтобы не подраться друг с другом.

12 мин чтения все пять бесплатные команды внутри порядок установки

В чём фокус

У Claude Code из коробки две встроенные боли, и обе не про ум модели. Первая — лимит: подписка выдаёт ограниченное окно запросов, и в середине рабочего дня оно кончается. Вторая — беспамятство: каждая новая сессия начинается с чистого листа, и то, что вы вчера полдня выясняли про проект, сегодня нужно рассказывать заново.

Между этими двумя лежит третья, менее заметная: контекстное окно заполняется быстро, и чем оно полнее, тем хуже модель держит ранние инструкции (Anthropic, Best practices). Каждый прочитанный файл, каждый вывод команды, весь ваш разговор лежат в одном окне и вытесняют то, что было сказано вначале. Лимит приходит быстрее не потому, что вы много работаете, а потому что в модель летит много мусора.

Плагины Claude Code — это способ поменять поведение инструмента, не трогая сам инструмент. Он умеет подключать сторонние расширения через маркетплейсы (дока, plugins), а часть вещей вообще ставится рядом и работает как прослойка. Пять штук ниже закрывают четыре разные дыры: откуда брать запросы, что помнить между днями, что вообще отправлять в модель и чего в вашем проекте не хватает.

Идея в одну строку: лимит упирается не в вашу работу, а в то, сколько лишнего уходит в модель и сколько раз вы объясняете одно и то же. Плагины чинят обе стороны — и расход, и повторы.

Шаг 0: что нужно до старта

Всё ниже работает поверх Claude Code — это Claude, живущий прямо в редакторе кода как обычная программа. Он читает ваши файлы, запускает команды и правит проект сам. Если его ещё нет:

Ещё понадобится Node.js версии 20 или новее — на нём стоит один из плагинов, и это единственное техническое требование во всём списке. Проверить, что он есть, можно одной командой:

проверка окружения
node --version
# должно ответить v20.x.x или выше

Лимиты: OmniRoute

Самая обидная остановка — когда квота кончилась, а задача на середине. OmniRoute решает это не увеличением лимита, а тем, что лимитов становится много. Это локальный шлюз с MIT-лицензией: он поднимается у вас на машине, притворяется обычным адресом Claude и раздаёт запросы по 290 провайдерам, из которых больше девяноста работают бесплатно (репозиторий OmniRoute).

Работает это каскадом. Пока жив ваш основной провайдер, запросы идут к нему. Как только квота исчерпана, шлюз молча спускается на следующий уровень — сначала другие ключи, потом дешёвые модели, потом бесплатные. Вы этого не замечаете: в редакторе просто продолжается работа. Из сложенных бесплатных тарифов проект насчитывает порядка полутора миллиардов токенов в месяц — цифра заявлена самим репозиторием, и относиться к ней стоит как к потолку при идеальной раскладке, а не как к гарантии.

установка и запуск
npm install -g omniroute
# поднимет API и панель на http://localhost:20128

Дальше открываете панель на этом же адресе, выбираете бесплатные тарифы из списка (карта не нужна) и в настройках Claude Code указываете базовый адрес http://localhost:20128/v1, а моделью ставите auto — тогда шлюз сам решает, кому отдать запрос.

Отдельный бонус: у шлюза внутри своё сжатие, которое режет от 15 до 95 процентов токенов в зависимости от того, насколько «грязный» запрос. То есть он не только находит, где взять лимит, но и тратит его медленнее.

Память: claude-mem

Второй по частоте раздражитель — амнезия. Вы закрыли сессию, и всё, что Claude выяснил про проект за день, исчезло. Назавтра он снова читает те же файлы, снова спрашивает, где что лежит, и снова тратит на это контекст, который вы только что оплатили.

claude-mem вешается на пять точек жизненного цикла сессии — старт, отправку вашего сообщения, использование инструментов, остановку и завершение (репозиторий claude-mem). По ходу работы он записывает, что происходило, в конце сжимает это в короткую сводку, а в начале следующей сессии подкладывает относящееся к делу обратно. Ощущается это не как «включилась память», а как будто помощник просто помнит вчерашний разговор.

установка
npx claude-mem install

База лежит локально — SQLite в папке ~/.claude-mem/, там же настройки. Наружу ничего не уходит. Вместе с плагином приезжает навык поиска по истории проекта обычными словами и четыре инструмента: поиск по памяти, хронология и выгрузка полных наблюдений по идентификатору. То есть можно не только полагаться на автоподстановку, но и спросить прямо: «что мы решили про авторизацию на прошлой неделе».

Сжатие: Headroom

Первые два плагина добавляют ресурс. Этот — перестаёт его сливать. Headroom садится между вами и моделью и пропускает дальше только то, что действительно нужно: логи, выводы инструментов, куски файлов и результаты поиска ужимаются до того, как превратятся в токены (репозиторий Headroom).

Важная деталь, из-за которой это не превращается в «модель стала тупее»: сжатие обратимое. Вместе с ужатым куском Headroom кладёт маленький инструмент возврата — если модели действительно понадобится оригинал, она его достанет. Поэтому подробности не теряются, а просто не занимают место, пока не нужны.

Цифры проект приводит разные для разных типов данных: на выводе в формате JSON экономия доходит до 60–95 процентов, на обычной работе кодового агента скромнее — 15–20 процентов. В их примере разбора инцидента 65 694 токена превратились в 5 118, то есть 92 процента ушли. Лицензия Apache 2.0, поставить можно тремя способами — библиотекой в свой код, прокси-сервером или MCP-сервером. Для Claude Code проще всего третий вариант обёртки:

установка и запуск с Claude Code
pip install "headroom-ai[all]"

# запустить Claude через локальный прокси со сжатием:
headroom wrap claude

Команда поднимает прокси и запускает уже настроенную сессию — руками в конфигах ковыряться не нужно, настройки сохраняются в вашем ~/.claude.json.

Схема: три слоя — где взять лимит, что помнить, что вообще отправлять в модель
Три дыры и три плагина: провайдеры, память, сжатие

Аудит: claude-code-setup

Единственный официальный в списке — плагин от самой Anthropic. Он решает задачу, которую обычно решают чужими подборками из интернета: что именно подключить конкретно к вашему проекту.

Плагин читает проект — структуру папок, зависимости, характер кода — и предлагает конфигурацию по пяти направлениям: MCP-серверы для внешних интеграций, навыки, хуки автоматических действий, субагенты под отдельные роли и слэш-команды под частые операции (README плагина). Причём не абстрактно, а по вашему стеку: увидел React — предложит инструмент для тестов интерфейса, увидел код авторизации — предложит субагента-безопасника.

И главное свойство, из-за которого его не страшно запускать на рабочем проекте: он работает только на чтение. В README сказано прямо — анализирует, но файлы не меняет. То есть это консультация, а не вмешательство: он показывает список, вы решаете.

как вызвать
# отдельной команды нет — просите обычными словами:
recommend automations for this project

# по-русски работает так же:
посмотри проект и скажи, каких хуков и навыков в нём не хватает

Привычки: Task Observer

Пятый — самый необычный, потому что улучшает не Claude, а ваши собственные инструкции для него. Это мета-навык: он смотрит, как идёт работа, и ловит три вещи — что вы поправили за моделью, что вы сделали руками вместо того чтобы записать правилом, и где его собственный подход дал сбой (репозиторий проекта).

В конце сессии он выдаёт структурный отчёт: что заметил, каких навыков это касается и что конкретно в них поменять. Дальше вы либо соглашаетесь, либо нет. Смысл в накоплении: правило, которое вы третий месяц проговариваете вслух каждый раз, наконец оказывается записанным там, где Claude его прочитает сам.

Ставится он не через маркетплейс, а руками — скачиваете репозиторий и кладёте папку навыка в проект. Лицензия CC BY 4.0, то есть можно использовать и переделывать под себя с указанием авторства.

установка навыка
# склонировать и положить папку навыка в проект:
git clone https://github.com/rebelytics/one-skill-to-rule-them-all
# перенести task-observer в .claude/skills/task-observer/
# (SKILL.md и папка references/ должны лежать вместе)
Одна тонкость от автора: сам по себе навык может не включиться, когда вы увлечены задачей. Поэтому его просят вызывать строкой в вашем CLAUDE.md — тогда он поднимается в начале каждой сессии, а не когда повезёт.

В каком порядке ставить

Ставить всё разом в первый вечер — плохая идея: если что-то сломается, вы не поймёте, что именно. Порядок ниже выстроен так, чтобы каждый следующий шаг было видно на фоне предыдущего.

01
claude-mem — первым
Самый безобидный и самый заметный по эффекту. Ставится одной командой, ничего не перенаправляет, эффект виден на следующее утро: Claude помнит вчерашнее.
02
claude-code-setup — вторым
Он только читает, поэтому запускать его безопасно в любой момент. Пусть посмотрит проект до того, как вы начнёте навешивать остальное — получите список того, чего не хватает именно вам.
03
Headroom — третьим
Первый, кто встаёт в разрыв между вами и моделью. Запускайте через обёртку и день поработайте так: если ответы устраивают, оставляете.
04
OmniRoute — четвёртым
Самый инвазивный: меняет адрес, по которому ходит Claude Code. Ставьте, когда убедились, что остальное работает — иначе при первой же странности будете гадать, кто виноват.
05
Task Observer — последним
Ему нужен материал: несколько живых сессий, где вы что-то правите за Claude. На пустом проекте наблюдать нечего.

Между третьим и четвёртым есть пересечение, о котором стоит знать заранее: сжатие есть и в Headroom, и внутри OmniRoute. Вместе они работают, но если ответы вдруг поплыли — выключайте по одному, а не оба сразу.

◆ от плагинов — к агенту

Плагины поставил. А кто будет работать, пока ты спишь?

Пять плагинов чинят инструмент — но инструмент всё ещё ждёт, пока вы сядете за него. Следующий шаг — собрать агента, который сам находит темы, делает карусели и ролики, выкладывает страницы и собирает заявки. Разбираем сборку по шагам за один день.

Что за агент →

Что ты увидишь

Разница заметна не в первый час, а на второй день — когда обычно начинается «объясни всё заново». Вот один и тот же понедельник до и после.

🤷Голый Claude Codeначинает с нуля

ты: продолжаем вчерашнее

claude: Уточните, над чем мы работали? Прочитаю проект…

…двадцать минут на пересказ, и половина окна уже занята. К обеду — упор в лимит.

🎯С пятью плагинамипомнит и не упирается

ты: продолжаем вчерашнее

claude: Вчера остановились на форме оплаты, спорный момент был с валидацией. Продолжаю оттуда?

ты: да

…а когда квота кончится, работа просто не остановится: запрос уйдёт к следующему провайдеру.

Порядок установки пяти плагинов и что меняется после каждого
Порядок установки: от самого безобидного к самому инвазивному
Ни один из пяти не делает модель умнее. Они убирают то, что мешало ей работать: повторные объяснения, мусор в контексте и упор в единственную квоту.

Чтобы не споткнуться

Три места, где обычно ломается — и как пройти их сразу.

01
Не ставьте всё в один заход
Два из пяти встают в разрыв между вами и моделью. Поставите оба разом и получите странный ответ — не поймёте, чей он. Ставьте по одному, с днём работы между шагами.
02
Бесплатные провайдеры — это чужие модели
Когда OmniRoute уводит запрос на бесплатный тариф, отвечает уже не Claude, а другая модель. На рутине это незаметно, на тонкой задаче — вполне. Если ответ вдруг стал странным, первым делом смотрите в панель, кто отвечал.
03
Проверьте, что уходит наружу
claude-mem держит базу локально, а вот у шлюза запрос уходит стороннему провайдеру. Для рабочего проекта с чувствительным кодом это стоит решить осознанно, а не по умолчанию.

А если…

Четыре сомнения, которые ловят на входе. Отвечаю прямо.

…я совсем не технарь?
Три из пяти ставятся одной строкой, которую вы копируете. Оставшиеся два — это распаковать папку и попросить Claude обычными словами посмотреть проект. Программировать не нужно нигде.
…бесплатное значит сырое?
У всех пяти открытый код и живые репозитории, а один вообще официальный, от Anthropic. Но это не коробочный продукт с поддержкой: если что-то отвалится, чинить придётся вам — потому и порядок установки по одному.
…у меня и так хватает лимита?
Тогда начните не со шлюза, а с памяти и сжатия. Они экономят не деньги, а ваше время: перестаёте пересказывать проект каждое утро.
…это не сломает рабочий проект?
Официальный плагин работает только на чтение и ничего не меняет. Память пишет в свою базу. Реально влезают в поток только сжатие и шлюз — их и ставьте последними, когда остальное уже проверено.

Зачем тебе это на самом деле

Поставить пять плагинов можно за вечер, и уже на этом меняется характер работы. Раньше день строился вокруг ограничений: с утра пересказ проекта, к обеду упор в квоту, вечером ожидание сброса. Инструмент диктовал темп, а вы под него подстраивались.

После — ограничения перестают быть событием дня. Память убирает утренний пересказ, сжатие растягивает окно, шлюз снимает потолок. Остаётся то, ради чего всё затевалось: вы ставите задачи, а не обслуживаете инструмент. И вот с этого места уже имеет смысл думать не про плагины, а про то, что этот инструмент может делать без вас.

А дальше

Пять плагинов закрывают фундамент: инструмент, который помнит, не упирается и не тратит лишнего. Но он по-прежнему ждёт, пока вы сядете и дадите задачу.

Следующий уровень — это когда работа идёт без вас: агент сам смотрит, что виралит в вашей нише, собирает из этого карусели и ролики, выкладывает страницы-гайды, заводит воронку на кодовое слово и приносит готовое на приёмку в телеграм. Это уже не настройка редактора, а собранный контент-агент — его разбираем по шагам за один день.

Контент-агент · AI Cube

Собери контент-агента
за один день

Тот же Claude Code, но настроенный так, что к вечеру он сам находит тему, делает карусель и ролик, выкладывает гайд и заводит воронку на кодовое слово. Сборка по шагам — от сервера до первого опубликованного контента.

Хочу агента