AI Cube/Гайды/Агентные лупы
🔁 Agent Loop

Агентные лупы: промпт-инжиниринг умер

Раньше вылизывали формулировки. Теперь строят лупы — циклы, где агент сам действует, проверяет себя и идёт по новой, пока не закончит. Работает на Hermes и Claude Code, по расписанию через cron, даже пока ты спишь.

24/7
работает по cron
∞→стоп
условие выхода
Hermes
любая модель
3 шага
сборка

Промпт против лупа

Промпт отвечает один раз и живёт с тем результатом, какой получился. Написал запрос, получил текст, дальше всё на тебе: читаешь, замечаешь огрехи, переписываешь промпт, запускаешь снова. Вся проверка и доводка держится на человеке, а человек — самое медленное и дорогое звено в этой схеме.

Луп устроен иначе. Это не «промпт получше», а другой уровень: ты перестаёшь подсказывать модели каждый шаг и вместо этого собираешь систему, которая подсказывает себе сама. Агент сверяет свою работу с результатом и чинит её без тебя. Он крутится по кругу: наблюдает, действует, проверяет, повторяет. И так до тех пор, пока задача не закрыта по заданному критерию.

Промпт
  • Отвечает один раз
  • Живёт с первым результатом
  • Проверяет человек
  • Правки = новый промпт вручную
Луп
  • Действует в цикле
  • Сверяет работу с результатом
  • Проверяет себя сам
  • Чинит и идёт по новой

Сам цикл — четыре повторяющихся такта:

  • Наблюдай — собери текущее состояние и данные.
  • Действуй — сделай шаг через инструмент.
  • Проверяй — сверь результат с критерием готовности.
  • Повторяй — если не готово, заходи на новый круг.
Цикл агента: наблюдай, действуй, проверяй, повторяй — и условие выхода
У Anthropic определение агента ровно про это: агент — это модель, которая использует инструменты в цикле. Не один ответ, а повторяющиеся действия с проверкой между ними. Модель плюс инструменты, замкнутые петлёй, и есть минимальный агент.

Главный сдвиг в голове такой: ты больше не пишешь, что сделать, ты описываешь, чего добиться и как агент поймёт, что добился. Дальше он сам решает, какой инструмент дёрнуть и сколько кругов пройти. Промпт остаётся, но становится одним кирпичом внутри лупа, а не всей конструкцией.

Шаг 1. Задай цель с выходом

Луп начинается с цели, которая может завершиться. Не «занимайся лидами», а конкретная задача с понятной точкой стоп. Если завершения не предусмотрено, агент будет крутиться бесконечно и просто сожжёт бюджет. Цель без выхода — это не цель, а кран, который забыли закрыть.

Хорошая формулировка несёт в себе и объём работы, и условие, по которому цикл сам себя выключит:

◆ PROMPT
GOAL: Прочитай 5 новых лидов, набросай ответ на каждого.
EXIT: Когда черновики готовы по всем 5 — стоп.
       Если лид непонятен — пометь «нужен человек» и переходи к следующему.

Здесь у агента есть и понятный объём (5 лидов), и условие выхода (черновики готовы по всем), и аварийный люк (непонятный лид не блокирует цикл, а помечается). Как только условие выполнено, цикл останавливается сам, без твоего участия.

Хороший выход почти всегда формулируется через одно из трёх: цель достигнута, бюджет исчерпан, или задача застряла и нужен человек. Любое из них завершает цикл честно. Что нельзя оставлять — это «крутись, пока не станет хорошо»: у модели нет встроенного понятия «хорошо», она будет считать хорошим то, что само же и написала.

Нет стоп-условия — нет лупа. Без явного выхода цикл превращается в бесконечную трату токенов. Любая цель для агента должна нести в себе ответ на вопрос «когда считать, что готово». Стоп-условие пишут первым, до всего остального — именно оно позволяет тебе спокойно уйти и не сидеть над процессом.

Шаг 2. Дай инструменты и память

Цель есть, но без рук агент ничего не сделает. На этом шаге ты выдаёшь ему три вещи: доступ к данным, право действовать и память между запусками. Именно инструменты в цикле превращают рассуждающую модель в агента — без них остаётся просто чат, который красиво говорит, но ничего не двигает.

+Доступ к данным
Чтобы прочитать лиды и почту, агенту нужен вход в источники: CRM, входящие, таблицы. Без этого он не «видит», над чем работает, и галлюцинирует вместо работы.
+Право действовать
Действие через инструмент: набросать ответ, создать черновик, записать в базу. Цикл строится на том, что агент реально что-то делает, а не только рассуждает про себя.
+Память между запусками
Чтобы не начинать с нуля каждый раз, агент держит контекст: какие лиды уже обработаны, что отвечал вчера, на чём остановился. Память — это файл на диске, а не надежда на длинный контекст.

Память — то, что отличает разовый прогон от настоящего лупа. Агент, который помнит свои прошлые действия, не дублирует работу и не наступает на одни и те же грабли. На практике это простой приём: в конце каждого круга агент дописывает короткий файл вроде memory.md — что сделал, что решил, на чём остановился, — а в начале следующего круга читает его первым. Люди, которые крутят агентов месяцами, в один голос говорят: главная боль не «модель тупит», а «память протухает» — устаревшие и задублированные заметки, которые приходится чистить.

Анатомия лупа: цель с выходом, инструменты, память, cron-расписание и чекер
◆ ПРАКТИКУМ · НОВЫЙ ПОТОК ГОТОВИТСЯ

Хочешь так же?
Собери контент-завод на Claude Code.

За один вечер показываю всю цепочку: тренды → виралки → карусели и рилсы → воронки на кодовые слова → лид-магниты → продажи. Один человек, без программирования.

На практикум →
990 ₽ онлайн или 1 490 ₽ запись

Шаг 3. Запусти по расписанию

Последнее звено — расписание. Cron будит агента в нужное время, тот действует, проверяет себя и отчитывается в Slack или Telegram. Тебе остаётся читать репорт, а не нажимать «запустить». Это и есть момент, когда ассистент превращается в сотрудника: он перестаёт ждать твой промпт и начинает жить по собственным часам.

Так может выглядеть расписание лупов — каждая строка отдельный агент со своим cron:

◆ PROMPT
skill          cron            next run        status
lead-reply     0 9 * * *       завтра 09:00    idle
news-digest    0 7 * * 1-5     завтра 07:00    idle
inbox-triage   */30 * * * *    через 12 мин    running

Один разбирает лиды по утрам, другой собирает дайджест по будням, третий чистит входящие каждые полчаса. Все они просыпаются сами и шлют итог в мессенджер. Важная деталь, которую новички упускают: «по расписанию» значит «на железе, которое не выключается». Если cron привязан к твоему ноутбуку, он замолчит, как только ты закроешь крышку. Поэтому лупы чаще вешают на дешёвый VPS или мини-сервер, который работает круглые сутки.

Именно расписание превращает агента в сотрудника, который работает 24/7. Пока ты спишь, cron будит лупы, они делают свою работу и оставляют тебе готовый отчёт к утру. Но у этой медали есть обратная сторона: незакрытый цикл по расписанию жжёт деньги тоже круглые сутки. Поэтому шаг 3 не работает без шага 1.

Самопроверка — главный рычаг

Самое сильное место в лупе — это проверка. Дай агенту критерий готовности: тест, чеклист, эталон. Когда ему есть с чем сверяться, качество растёт заметно. Без критерия агент гадает, готов ли результат, и часто принимает собственную работу за хорошую, потому что других ориентиров у него нет.

И тут ключевое правило, к которому независимо приходят почти все, кто строит серьёзные лупы: модель, которая делала работу, не должна её же и оценивать. Кто писал код или текст, тот «влюблён» в свой результат и поставит себе зачёт. Поэтому ставят отдельного чекера — другую модель или хотя бы другой промпт с другой ролью, чья единственная задача искать дыры. Делатель и проверяющий разведены, как автор и редактор.

Loopmaxxing

Бесконечный луп без условия выхода и без чекера. Агент крутится ради процесса, дублирует шаги и жжёт бюджет, веря, что «ещё круг — и станет лучше». Движения много, толку мало, счёт растёт.

Чекер

Луп с отдельным проверяющим и критерием готовности. Агент сверяется с тестом или чеклистом и выходит, как только цель достигнута. Умный выход вместо вечного кручения.

Критерий готовности и стоп-условие работают в паре: первый говорит, что считать хорошим результатом, второй — когда остановиться. Вместе они и делают из набора действий рабочий луп, а не дорогую карусель. Хороший критерий лучше всего выражать тем, что нельзя подделать словами: прошёл тест или нет, есть пункт в чеклисте или нет.

Правило простое: сначала придумай, как агент поймёт, что закончил, и кто это подтвердит, и только потом запускай цикл. Проверка важнее количества кругов — один круг с честным чекером бьёт десять кругов самолюбования.

Кейсы из сообщества

Это не теория из вакуума. Те, кто крутит агентов каждый день, независимо друг от друга пришли к одним и тем же выводам: стоп-условие первым, отдельный чекер, бюджет под контролем. Три показательных истории.

Loop Engineering

Aayush Soni сформулировал то, о чём весь этот гайд: перестань быть лупом сам. Cron повторяет вслепую, а настоящий луп находит работу, отдаёт её делателю, проверяет результат отдельным чекером (модель, что писала код, не ставит себе оценку), пишет, что сделано, и решает, что дальше. А потом честно останавливается: цель достигнута, бюджет потрачен, застрял или нужен человек. Его цифры про цену хаоса: агентные системы жгут примерно в 4 раза больше токенов, мульти-агентные — около 15 раз.

«A loop that cannot stop is a bug. So you build the stop conditions first.»

Против loopmaxxing

Ben Dickson (автор TechTalks) выдал отрезвляющий контртезис: «AI loops» легко превращаются в новый «tokenmaxxing» — веру, что если гонять модель по кругу достаточно долго, она рано или поздно угадает. На деле это просто растущий счёт за токены и уход от инженерного мышления. Проблема не в лупе как таковом, а в экстремизме «луп — это всё, что нужно» и бесцельной трате без условия выхода. Ровно тот случай, который мы называем loopmaxxing.

«Burning cash on AI is not a replacement for hard thinking and sound engineering.»

Нет стопа = сожжён бюджет

Живая иллюстрация на r/ClaudeAI: автор поста проснулся с письмом об исчерпанном лимите. Виновником оказалась одна команда /loop, поставленная на ночь проверять открытые PR каждые 30 минут. Без присмотра она отработала 46 раз за 26 часов на дорогой модели и вместе со второй забытой сессией сожгла около 6000 долларов до того, как он проснулся. Классика: цикл без стоп-условия и без бюджета крутится по расписанию ровно столько, на сколько хватит карты.

«It ran 46 times over 26 hours, unattended, overnight… burned through roughly $6,000.»

Что повторяется во всех трёх историях: луп без стоп-условия и без отдельного чекера — это не автоматизация, а способ сжигать деньги по расписанию. Те же самые рычаги, что мы разобрали в шагах 1 и 5, всплывают здесь как разница между рабочей системой и дорогой каруселью.

С чего начать

Возьми одну рутину, которую делаешь руками каждый день, и оберни её в луп: цель с выходом, инструменты и память, расписание через cron, отдельный чекер для самопроверки. Собери стоп-условие первым, повесь на бюджет потолок, и только потом отпускай цикл в ночь. Один рабочий луп с честным выходом экономит больше времени, чем сотня вылизанных промптов — и не разбудит тебя письмом об исчерпанном лимите.

◆ ПРАКТИКУМ · НОВЫЙ ПОТОК ГОТОВИТСЯ · ОНЛАЙН

ВАЙБ контент-завод
на базе Claude Code

За один вечер — вся цепочка: тренды, виральные карусели и рилсы, воронки на кодовые слова, лид-магниты, продажи, платёжки и боты. Один человек, без программирования и без большой команды.

ВХОД
Тренды и виралки
поиск встроен в Claude Code
ПРОИЗВОДСТВО
6 форматов на виралку
карусели ×3 + рилсы ×3
ПРОДАЖА
Воронки и оплата
ChatPlace, Lava, боты
Перейти на практикум →
990 ₽онлайн или1 490 ₽ запись