Инструкция Автомонтаж в Claude Code
0 / 8
Скачать PDF
Автомонтаж · Claude Code · без монтажёра

Claude монтирует твои Reels
300 000 ₽ в год остаются у тебя

Кидаешь агенту сырое видео говорящей головы. На выходе — готовый вертикальный ролик: субтитры-караоке, плашки, врезки, счётчики, музыка, паузы вырезаны. Ты не открываешь ни одну программу монтажа и не пишешь ни строчки кода.

−300K₽ в год на монтажёре
7 минутот записи до готового ролика
1 промптчтобы всё поставить
0 ₽за сам монтаж

Почему это меняет правила игры

300 000 ₽ в год — прямая экономия. И это самое скучное из того, что тут происходит

Монтажёр Reels стоит 20–30 тысяч в месяц. Это 240–360 тысяч в год за работу, которая полностью описывается словами: нарежь, подпиши, подложи музыку, вырежи паузы, поставь плашку на цифре. Всё, что можно описать словами, — можно отдать агенту.

И дело даже не в деньгах. Монтажёр — это ожидание. Ты записал ролик на инфоповоде в понедельник, получил его в среду, а тренд уже остыл. Агент отдаёт ролик через 5–10 минут после того, как ты закончил говорить в камеру. Ночью, в выходные, в отпуске.

Монтажёр

25 000 ₽/мес × 12 = 300 000 ₽/год. Плюс правки по кругу, «пришлю к вечеру», болезни, отпуск, поиск нового, когда этот уходит. И один стиль на всё — хочешь второй, плати больше.

Claude Code

0 ₽ за монтаж. Минуты вместо дней. Одинаковое качество на первом и на сотом ролике. Стиль — твой, зашит один раз. 10 роликов в день даются так же легко, как один.
Что реально получаешь: записал видео в 22:00 — в 22:07 лежит готовый Reels. Субтитры по словам, плашки на ключевых фразах, картинки под смысл речи, вертикальный кадр со слежением за лицом, музыка на фоне, паузы и «ээ» вырезаны. Всё на твоём компьютере, без облачных подписок.
1

Как это устроено

Ты не ставишь чужой «движок». Агент собирает конвейер под твой стиль — из бесплатных инструментов

Монтаж — это не магия, а последовательность операций над файлом. Каждую такую операцию давно умеет делать бесплатная утилита. Проблема всегда была в том, что ими надо управлять руками из терминала. Теперь ими управляет агент: ты говоришь на русском, он собирает цепочку.

Важное отличие от «скачай готовый движок»: у тебя не появляется чужой чёрный ящик, который надо обновлять. У тебя появляется своя папка со своими скриптами, которые агент дописывает под каждый новый формат ролика. Не нравится, как встала плашка, — говоришь словами, он переписывает свой же код за 20 секунд.
2

Что именно он умеет

11 приёмов, за которые монтажёру платят те самые 25 000 ₽ в месяц

Всё включается одной фразой — «сделай субтитры», «подложи музыку», «переделай в вертикаль». Комбинировать можно как угодно, порядок не важен.

Правило по формату: на выходе тот же формат, что на входе. Прислал горизонтальное — получил горизонтальное. Перекадрирование в вертикаль — только когда ты явно попросил.
3

Установка — один промпт

Открываешь Claude Code в пустой папке и вставляешь текст ниже. Терминал трогать не нужно

Агент сам поставит всё, чего не хватает, и сам скажет, если что-то пошло не так. От тебя — только скопировать и нажать Enter.

Промпт установки
Собери у меня на компьютере конвейер автомонтажа вертикальных роликов.
Поставь ffmpeg, Python-пакеты faster-whisper и Pillow, Node-пакет playwright-core
и браузер Chromium для него. Создай папку проекта со структурой:
input/ (сырые видео), frames/ (кадры), build/ (черновая сборка), out/ (готовые ролики),
и файл style.py, куда вынеси мои цвета, шрифты и размер кадра 1080x1920, 30 fps.
Проверь, что каждый инструмент реально запускается, и напиши,
чего не хватает и как это доставить. Когда всё готово — скажи,
что можно присылать первое видео.

Что нужно на компьютере заранее

  • Claude Code (или Codex / Cursor) — сам агент.
  • Python 3.9+ и Node.js 18+ — обычно уже стоят. Агент проверит.
  • ffmpeg — бесплатный, агент даст команду под твою систему.
  • 10 ГБ свободного места — модель распознавания речи и кадры занимают место.

Особенности по системам

macOS: всё встаёт сразу, ffmpeg — через brew install ffmpeg.
Windows: Node.js и Python ставь с официальных сайтов, при установке Python обязательно отметь галочку «Add Python to PATH». ffmpeg — командой winget install Gyan.FFmpeg.
Linux: sudo apt install ffmpeg python3-pip — и дальше как обычно.

Заведи отдельную папку. Например ~/montage/. Так проект не смешается с остальными, а агент будет держать в голове только монтажные скрипты.
4

Первый ролик — три промпта на выбор

Положи видео в папку input/ и напиши агенту одну из фраз ниже

Логика простая: кинул видео → сказал что хочешь → забрал ролик. Если думать лень — напиши просто «смонтируй», агент предложит вариант и покажет результат.

Промпт 1 · Базовый монтаж
Смонтируй видео из папки input. Распознай речь через faster-whisper,
вырежи все паузы длиннее 0,3 секунды, вдохи и слова-паразиты.
Поставь субтитры по словам: белый жирный гротеск, чёрная обводка,
3-4 слова в строке, цифры и ключевые слова — жёлтым.
На ключевых фразах добавь плашки в моих цветах.
Подложи спокойную фоновую музыку тише голоса на 22 дБ.
Готовый файл положи в out/ с понятным именем.
Промпт 2 · Из горизонта в вертикальный Reels
Сделай из этого горизонтального видео вертикальный Reels 1080x1920, 30 fps.
Перекадрируй со слежением за лицом, чтобы я не уезжал из кадра.
Добавь ритм: новый план или зум каждые 2-3 секунды, статичных кусков
длиннее 3 секунд быть не должно. Субтитры и плашки — как обычно.
Субтитры подними на 15% от нижнего края, иначе их перекроет интерфейс площадки.
Промпт 3 · С врезками и генерацией картинок
Смонтируй ролик. Разбери, о чём я говорю в каждую секунду, и подставь картинку
под смысл: где говорю про переписку — собери мокап чата и сними его в браузере,
где говорю про цифры — нарисуй плашку со счётчиком, где нужен образ —
сгенерируй изображение. Врезки ставь на весь экран, звук не прерывай.
Плашки размещай так, чтобы не перекрывали моё лицо.
Покажи мне раскадровку до финального рендера.
Совет: первый прогон делай на коротком видео 30–60 секунд. Посмотри результат и говори правки словами: «субтитры крупнее», «музыку тише», «плашку в правый угол», «эту склейку убери». За 2–3 круга получится твой шаблон, дальше ты пишешь одну фразу «сделай как обычно».

Словарь правок — чем точнее фраза, тем меньше кругов

  • «Субтитры крупнее на 20% и подними на 100 пикселей» — вместо «субтитры не очень».
  • «Музыку тише на 4 дБ, на кадрах с экраном ещё тише» — вместо «музыка мешает».
  • «Убери склейку на 12-й секунде, там обрывается слово» — точное место, а не «перемонтируй».
  • «Пересобери только последние 10 секунд, остальное не трогай» — экономит время рендера.
  • «Плашку в правый нижний угол, она перекрывает лицо» — с причиной, агент учтёт её и дальше.
  • «Покажи раскадровку кадрами до рендера» — правки до финального просчёта, а не после.
  • «Запиши это в style.py как дефолт» — чтобы правку не повторять на каждом ролике.
5

Монтажное ТЗ — то, что отличает ролик от нарезки

Один раз отдаёшь агенту этот документ — и качество перестаёт зависеть от настроения

Разница между «агент что-то смонтировал» и «агент смонтировал как надо» — не в промпте, а в техническом задании. Это тот же документ, который отдают живому монтажёру. Скопируй, поправь под себя и скажи агенту: запомни это ТЗ и держи его на всех роликах

Монтажное ТЗ — вставить целиком
Формат: 1080x1920, 9:16, 30 fps. Длина 30-45 секунд, не больше.
Склейка каждые 1,5-3 секунды, статичных планов длиннее 3 секунд нет.
Все паузы, вдохи, «ээ» и повторы вырезаны, речь идёт встык.
Между кадрами простая резка, без переходов и эффектов.

Таймлайн:
0-4 сек — говорящая голова крупным планом, начинаем строго с первого слова,
воздуха перед речью нет. На ключевой цифре зум 5% и плашка с суммой.
4-12 сек — запись экрана, масштаб 130-150%, панорама за курсором,
код в кадре не дольше 1-2 секунд подряд.
12-25 сек — говорящая голова, каждое перечисление сопровождается строкой текста,
строки накапливаются списком и остаются на экране.
25-36 сек — экран с задачей, ускорение x3, только человеческий текст, без кода.
36-45 сек — самый крупный план, плашка с триггерным словом внизу до конца.

Звук: шумодав средней степени, нормализация -16 LUFS, де-эссер.
Музыка -22 дБ относительно голоса, на кадрах с интерфейсом ещё тише на 4-6 дБ.
Свуш-эффектов на склейках нет.

Субтитры: на всю длину, плотный гротеск, белый жирный, чёрная обводка 3-4 px,
3-4 слова в строке, максимум две строки, нижняя треть но выше на 15% от края,
цифры и ключевые слова жёлтым, появление по словам синхронно с речью.

Вырезать безжалостно: паузы длиннее 0,3 сек, моменты взгляда в сторону,
кадры где непонятный код висит дольше секунды, финальное «ну вот как-то так».
Проверка перед публикацией: посмотри первые 3 секунды без звука — если непонятно, о чём ролик, переснимай хук. Уменьши обложку до размера ногтя — если цифра не читается, увеличь кегль. Цифры в ролике, на обложке и в описании должны совпадать.
6

Продвинутые фишки

Свой стиль, генерация картинок, большие файлы, выбор модели распознавания

Свой брендовый стиль — один раз и навсегда

Скажи агенту: мои цвета: #3FE9FF основной, #F254D8 акцент, #07040F фон, шрифт заголовков — жирный гротеск. Запиши это в style.py и используй на всех роликах. Дальше все плашки, субтитры и счётчики выходят в твоём фирменном виде без напоминаний. Захотел поменять — меняешь одну строчку, а не двадцать роликов.

Генерация картинок — нужен ключ OpenAI

Без ключа всё остальное работает. Субтитры, плашки, счётчики, врезки, музыка, вертикаль, зум-ритм — бесплатно и локально. Ключ нужен только чтобы агент сам рисовал изображения под смысл речи. Берётся на platform.openai.com, платишь напрямую OpenAI — обычно копейки за картинку. Скажи агенту «вот мой ключ OpenAI», он подскажет, как положить его в переменную окружения OPENAI_API_KEY, а не в код.

Большие файлы через своего Telegram-бота

Удобно кидать видео боту прямо из телефона. Но у облачного Telegram Bot API лимит 20–50 МБ, а ролик с телефона весит больше. Решение:
  1. Поднять локальный telegram-bot-api (есть готовый Docker-образ) на своей машине, например на порту 8081.
  2. В настройках бота указать apiRoot = http://localhost:8081.
  3. После этого бот принимает и отдаёт видео до 2 ГБ без сжатия — сырьё не теряет качество.
Не хочешь возиться — передавай файлы через папку на диске или облако, а агенту говори путь.

Какую модель распознавания выбрать

Whisper — это то, что делает субтитры и тайминги. Скачивается один раз и дальше работает офлайн. По умолчанию бери large-v3-turbo: хороший баланс скорости и точности на русской речи. Слабый ноут — скажи «переключи на small» (легче, чуть хуже с именами и терминами). Много терминов и названий — large-v3.
Проще всего: в первый раз не трогай ничего. Дефолты нормально работают на обычном ноутбуке и обычном русском голосе. Крутить настройки стоит тогда, когда тебя перестанет устраивать конкретная деталь.

Чек-лист внедрения

Отмечай по мере готовности — прогресс сохраняется в браузере
?

Если что-то не работает

Восемь ситуаций, в которые упираются почти все
Агент пишет «ffmpeg не найден»
ffmpeg — отдельная утилита, её ставят руками один раз. macOS: brew install ffmpeg. Windows: winget install Gyan.FFmpeg. Ubuntu: sudo apt install ffmpeg. После установки перезапусти терминал и скажи агенту «поставил, проверь снова».
faster-whisper не ставится, ругается Python
Скорее всего Python старый или их два. Проверь: python3 --version, нужен 3.9 и выше. На Windows частая причина — при установке не отмечена галочка «Add Python to PATH», проще переустановить с ней. Скажи агенту свою версию, он подберёт способ.
Первый монтаж идёт очень долго
При первом запуске качается модель распознавания (около 1,5 ГБ) — это разово. Дальше ролик на 40 секунд собирается за 5–10 минут, из которых большая часть — рендер кадров. Хочешь быстрее: «переключи whisper на small» и «рендерь превью в 720p, финал — в 1080p».
Ролик получился «не мой» по стилю
Дай конкретику вместо оценки: «вот мои цвета #..., шрифт такой-то, субтитры крупнее на 20%, плашки только слева сверху. Запиши в style.py и пересобери». Оценочные формулировки вроде «сделай красиво» дают случайный результат — цифры и цвета дают повторяемый.
Плашки и субтитры перекрывают лицо
Скажи «проанализируй кадр и ставь графику там, где нет лица» — агент найдёт лицо и разложит элементы вокруг. Жёсткий вариант: «плашки только в правом нижнем углу, субтитры не выше 1500 пикселя».
Субтитры отстают от речи
Значит тайминги брались не из распознавания, а на глаз. Скажи: «перезапиши субтитры по словам из word-level таймингов whisper, синхронизируй по каждому слову». Заодно попроси проверить, что после вырезания пауз тайминги пересчитаны — это самая частая причина рассинхрона.
Нет ключа OpenAI — картинки не генерятся
Всё остальное работает без него. Скажи агенту «картинки не генерируй, вместо них собирай мокапы и плашки» — врезки будут из скриншотов и графики, это часто выглядит даже уместнее генерации.
Застрял, агент ходит по кругу
Скопируй последние строки ошибки из терминала, отдай агенту и напиши: «разберись, что не так, и покажи мне план из трёх шагов, прежде чем чинить». Если он второй раз чинит одно и то же — попроси «начни этот шаг с нуля, старый код удали».

А что ещё пора отдать агенту?

Монтаж — это одна задача из десятка, которые у тебя сейчас делаются руками или наёмными людьми. Заполни короткую форму — я посмотрю, что у тебя происходит, и отвечу, какую задачу стоит автоматизировать первой и как именно к ней подойти.

Получить разбор по своей задаче

Сохрани инструкцию себе

Вся методичка в PDF: экономика, что умеет агент, промпт установки, три сценария первого прогона, монтажное ТЗ, продвинутые фишки, чек-лист и разбор ошибок. Всегда под рукой, даже без интернета.

Скачать PDF
Ярослав Буймов · автоматизация на Claude Code
t.me/buimov_it