В чём фокус
Самая дорогая часть любого рилса — не съёмка. Съёмка это тридцать секунд перед камерой телефона. Дорогой становится монтаж: подрезать паузы, наложить титры, вставить b-roll в нужную секунду, поменять фон, свести это в динамику, за которой досматривают до конца. Именно тут живут монтажёр, дизайнер и стопка платных программ. И именно эту часть теперь можно отдать машине целиком.
Представь монтаж как сборочный конвейер. Ты кладёшь на ленту сырьё — одно говорящее видео. Дальше оно проходит станции: на одной речь превращается в текст с точным таймингом, на другой рождается раскадровка, на третьей нейросеть перерисовывает твоё видео по этой раскадровке, на последней куски склеиваются в готовый ролик. У каждой станции свой инструмент, а роль бригадира — того, кто запускает станции по порядку и следит, чтобы деталь не потерялась, — берёт на себя Claude Code. В официальном гайде его работа так и описана: исследовать, спланировать, сделать, проверить — цикл, который он ведёт сам (Anthropic, Best practices).
Ни одна из станций не требует, чтобы ты открывал программу для монтажа. Всё делается через инструменты, которые уже умеют это лучше человека: расшифровка речи, генерация картинок, видео-модель Google и обычная склейка. Ниже — как выглядит вся лента целиком, а потом разберём каждую станцию отдельно.

Шаг 0: что нужно до старта
Конвейер собран поверх Claude Code — это Claude, встроенный в редактор кода как обычная программа. Он запускает инструменты, читает файлы и сам ведёт задачу от начала до конца, а ты смотришь или занимаешься своим. Знать программирование не нужно: командуешь обычными словами по-русски. Если Claude Code ещё не стоит:
- Установка с нуля и оплата российской картой — Claude Code из России за вечер →
- Если хочется без подписки, на бесплатных моделях — Claude Code бесплатно →
Кроме него по ходу конвейера понадобятся три вещи, все — снаружи монтажки:
- Телефон — снять говорящее видео.
- Генератор картинок (GPT Image или похожий) — нарисовать раскадровку.
- Google Flow — та самая монтажная для видео-модели Veo, куда мы отдаём чёрную работу (Google, Flow).
- PRO-аккаунт Google Flow — оформить pro →
- Зарубежная карта для оплаты — оформить карту →
- Стабильный VPN — подключить vpn →
Всё готово? Кладём на ленту первую деталь.
Шаг 1: снять говорящее видео на телефон
Сырьё для всего конвейера — один вертикальный ролик секунд на тридцать, где ты просто говоришь на камеру. Никакой студии: ровный свет от окна, телефон на подставке, речь по делу. Важно только одно — чистый звук, потому что именно твой голос останется в финальном рилсе. Монтаж мы добавим сверху, а звук не тронем.
Сценарий держи коротким и по структуре рилса: первая фраза — крючок, середина — суть, финал — призыв с кодовым словом. Чем яснее ты проговариваешь мысль, тем точнее машина потом расставит титры и врезки по смыслу. Снял — перекинул файл на компьютер, где работает Claude Code. Дальше руками ты почти ничего не делаешь.
Шаг 2: расшифровка речи и нарезка по фразам
Первая станция превращает звук в текст с точным таймингом. Делает это faster-whisper — быстрая версия модели распознавания речи Whisper на движке CTranslate2, до четырёх раз шустрее обычной при той же точности. Ключевое: она умеет отдавать тайминг не только по фразам, а по каждому отдельному слову — во сколько секунд оно началось и закончилось (SYSTRAN, faster-whisper).
Зачем такая точность. Тайминг по словам — это разметка для монтажа. По нему Claude режет твоё видео на куски примерно по десять секунд, но не тупо по секундомеру, а по границе фразы, ближайшей к отметке. Кусок не обрывается на полуслове, а заканчивается там, где ты закончил мысль. Дальше каждый такой кусок пойдёт по конвейеру как отдельная сцена — со своей раскадровкой и своим монтажом.
Тебе не нужно вызывать инструменты вручную. Просишь Claude обычными словами — он сам запускает расшифровку и нарезку:
Расшифруй это видео по словам (faster-whisper, язык русский),
потом нарежь его на куски примерно по 10 секунд — режь по концу
фразы, ближайшей к каждой десятой секунде, а не ровно по времени.
Каждый кусок сохрани отдельным файлом.Шаг 3: раскадровка и картинка-сториборд
Дальше самое интересное. Прежде чем что-то монтировать, нужно решить, что показать в каждую секунду: где спикер крупно, где он уезжает в кружок и появляется графика, где на весь экран выходит титр с главной фразой. Это и есть раскадровка — план из шести кадров-панелей на каждый десятисекундный кусок. Claude пишет её сам по таймингу из прошлого шага: панель за панелью, с типом кадра и репликой, которая в этот момент звучит.
Смена кадра каждые полторы-две секунды — это и есть та самая динамика, за которую досматривают. Первая панель почти всегда спикер и крючок, кульминацию главной фразы выносим на весь экран крупным текстом, а кодовое слово из призыва обязательно показываем титром в финале.

Готовую раскадровку Claude превращает в одну картинку — сториборд. Рисует её генератор изображений (мы берём GPT Image), и делает это не с потолка: к запросу прикладываются шесть реальных кадров, вырезанных из твоего же куска видео. Панели строятся поверх этих кадров. Это не каприз — так следующая станция, видео-модель, свяжет нарисованный план с твоим настоящим видео и не уплывёт в чужую картинку.
Шаг 4: монтаж в Google Flow
Теперь чёрную работу делает нейросеть. Google Flow — это монтажная, собранная вокруг видео-модели Veo (Google, Flow). Мы отдаём ей два ингредиента — десятисекундный кусок твоего видео и картинку-сториборд — и просим пересобрать этот кусок по раскадровке. Работа с несколькими опорными картинками так у Google и называется — «ингредиенты»: одна задаёт героя, другая фон, третья стиль, а модель держит их одинаковыми по всей сцене (Google, Veo 3.1 Ingredients).
Два момента, которые надо выставить в настройках сцены. Первый — вертикальный формат: Flow умеет отдавать нативную вертикаль 9:16 и картинку в 1080p, ровно под ленту рилсов (там же). Второй — звук. Veo умеет сам генерить речь, эффекты и музыку синхронно с картинкой (Google DeepMind, Veo) — но нам это не нужно, у нас есть твой живой голос. Поэтому в запрос прямо пишем: сохранить оригинальный звук как есть. Тогда модель меняет только картинку — добавляет наезды, врезки, титры и, если попросишь, новый фон, — а твоя речь остаётся нетронутой.
Запрос для Flow пишет Claude по раскадровке, и он подробный: посекундно, что происходит в кадре, плюс просьба про звук в конце. Начинается он так:
Смонтируй это видео точно по приложенному сториборду.
Плавные переходы, всё перетекает, в кадре всегда что-то движется…Полный посекундный промпт, настройки сцены и порядок ингредиентов — самое тонкое место конвейера. Разбираю его вживую на практикуме.
Смотреть на практикумеДисциплина одна: сначала гоняем только первый кусок и смотрим результат — те ли кадры, тот ли звук. Устроило — запускаем остальные. Так не тратишь генерации впустую, если что-то пошло не туда.
Монтаж в Flow — самый тонкий шаг: настройки сцены, ингредиенты, звук. Подробную видеоинструкцию, как это делать по шагам, я разобрал на практикуме.
Смотреть на практикумеШаг 5: сборка и бейдж на водяной знак
Из Flow приходят готовые куски — каждый уже смонтирован. Осталось собрать их в один ролик по порядку. Это делает ffmpeg — бесплатный инструмент, который склеивает видео встык. Когда куски в одном формате, он соединяет их вообще без пережатия, копированием потоков — быстро и без потери качества (FFmpeg, Concatenate).
Последний штрих — фирменный бейдж. Видео-модели Google оставляют свой водяной знак в углу кадра; мы аккуратно закрываем его собственным значком канала. Технически это тот же ffmpeg: накладываем картинку поверх видео в нужный угол. Всё это — по-прежнему одна команда Claude:
Склей эти куски по порядку в один вертикальный ролик.
Сверху наложи мой бейдж в правый нижний угол, чтобы он закрывал
водяной знак. Отдай финальный mp4.На выходе — готовый вертикальный Reels: твой голос, динамичная картинка, титры и врезки по смыслу, фирменный значок вместо чужого водяного знака. Ни одной программы для монтажа ты так и не открыл.
Хочешь повторить всю сборку и не спотыкаться на мелочах? Пошаговую видеоинструкцию по всему конвейеру я показываю на практикуме — с примерами последних роликов.
Смотреть на практикумеЧто ты увидишь
Одна и та же тридцатисекундная запись — по-старому и через конвейер. Разница не в том, что ты снял, а в том, кто собирал ролик. Вот она, вживую: слева кусок исходника с телефона, справа — тот же момент после конвейера.
Скинуть видео в монтажку, подрезать паузы вручную
Набить титры по одному, свести тайминги на глаз
Заказать дизайнеру врезки, ждать, править
…к ночи готов один ролик. Иногда.
ты: смонтируй этот ролик рилсом
claude: расшифровал, нарезал на 3 куска, собрал раскадровку и сториборды. Гоню первый кусок через Flow — проверь кадры и звук
ты: ок, гони остальные
…склеил, поставил бейдж. Готовый рилс на выходе.
Один дубль — одиннадцать разных рилсов
И это ещё не всё. Раскадровка отделена от видео, поэтому один и тот же дубль конвейер пересобирает в любом стиле: меняются только сториборды. Вот одна моя запись с телефона, прогнанная через одиннадцать стилей — листай:
Съёмка одна и та же. Пересборка в новом стиле — это только новые сториборды, без новой съёмки. Библиотеку стилей с готовыми формулами отдаю на практикуме.
Один рилс собрал. А как поставить это на поток?
Автомонтаж — это одна станция большого конвейера. Дальше идёт система: где брать темы, как искать виралки, как из ролика собрать воронку на кодовое слово, лид-магнит и оплату. Тот же принцип — команды словами плюс готовые шаги — масштабируется до целого контент-завода. Его собираем на практикуме, по шагам.
Что за практикум →Чтобы не споткнуться
Три места, где новички теряют время и генерации — и как пройти их сразу.
Нарезка по фразам, проверка сторибордов, дисциплина «первый кусок — потом остальные» — это команды, которые я уже упаковал в набор скиллов для Claude Code. Ставишь один раз — конвейер сразу едет как надо.
А если…
Четыре сомнения, которые ловят на входе. Отвечаю прямо.
Зачем тебе это на самом деле
Раньше между «есть что сказать» и «вышел рилс» стояла стена: монтаж. Он съедал вечер, требовал денег на дизайнера и навыка в программах, которого у тебя нет. Из-за этой стены большинство хороших мыслей так и не превращаются в ролики — просто некогда и некому собирать.
Конвейер убирает стену. Съёмка занимает те же тридцать секунд, а монтаж перестаёт быть твоей задачей — его ведёт машина, пока ты думаешь над следующей темой. Это тот самый рычаг: один человек с телефоном начинает выпускать контента столько, сколько раньше делала команда. Не потому что ты стал монтажёром, а потому что перестал им быть.
И это рычаг не только по времени, но и по деньгам:

А дальше
Автомонтаж закрывает производство: из одной записи выходит готовый рилс. Но собрать ролик — это ещё не собрать аудиторию и не собрать продажи.
Дальше идёт то, что не влезает в один конвейер: где брать темы, которые заходят, как искать и разбирать чужие виралки, как повесить на рилс воронку по кодовому слову, лид-магнит и приём оплаты. Это уже система от идеи до первых клиентов — у нас она собрана в контент-завод на Claude Code: тренды, карусели и рилсы пачкой, воронки на кодовые слова, лид-магниты и платёжки. Её разбираем на практикуме — по шагам, под твою нишу.
Что понадобится
Три вещи, без которых конвейер не поедет. Все — снаружи монтажки, подключаются один раз. Собрал ссылки, чтобы не искать:
Ссылки партнёрские — тебе не дороже, а нам помогает держать гайды бесплатными.
Источники
Факты в этом гайде — из официальной документации инструментов конвейера:
