
Пошагово разбираю, как собрать короткое AI-видео без съёмки: придумать сценарий, создать последовательные кадры в Google Flow, озвучить их через Google AI Studio и смонтировать в CapCut.
Я всё чаще вижу в Shorts ролики, построенные по одной формуле: «Что, если бы ты проснулся в Винтерфелле?» или «Что, если бы McDonald’s появился в Древнем Риме?».
Такие видео цепляют не сложным сюжетом, а сочетанием узнаваемой идеи, необычного персонажа и быстрых смен кадров. При этом снимать ничего не нужно: сценарий, изображения, анимацию и голос можно собрать с помощью ИИ.
Я протестировал этот процесс на новом YouTube-канале. Первое видео набрало около тысячи просмотров. Это не доказательство того, что схема гарантированно приносит охваты, но достаточный результат, чтобы разобраться в ней подробнее.
В этом гайде покажу весь процесс: от идеи до готового вертикального ролика.
Я использую четыре инструмента:
Чтобы не писать сценарий и промпты для каждой сцены вручную, я использую конструктор коротких AI-видео на Korobka. В нём достаточно указать идею, выбрать персонажа, фон, длительность и язык. Сервис подготовит сценарий, референс персонажа, промпты для изображений и отдельные промпты для анимации каждой сцены.
Google Flow сейчас работает с Veo 3.1 и другими моделями Google. Возможности и стоимость генерации зависят от выбранной модели. У пользователей без подписки может быть 50 пробных кредитов в день, но полноценный доступ зависит от региона, типа аккаунта и тарифа. Перед началом лучше проверить актуальные условия Google Flow.
Для озвучки подойдёт Gemini 2.5 Flash Preview TTS. У модели есть бесплатный уровень, но Google отдельно предупреждает, что данные бесплатных запросов могут использоваться для улучшения продуктов. Актуальные условия опубликованы на странице тарифов Gemini API.
Самая удобная формула для этого формата:
What if you woke up in [место или эпоха]?
Например:
Я бы начинал не с абстрактной темы вроде «интересные факты о Египте», а с конкретной ситуации, в которую зритель может мысленно поставить себя.
Хорошая идея должна отвечать трём условиям:
Для англоязычного канала сценарий лучше сразу писать на английском. Перевод готового русского текста часто получается длиннее и хуже совпадает с видеорядом.
Если конкретной идеи нет, конструктор Korobka может предложить несколько вариантов. После выбора темы остаётся указать персонажа, фон, примерную длительность и язык.
Один ролик удобно делить на девять сцен. Каждая сцена должна содержать одно действие или одно наблюдение.
Пример структуры:
В конструкторе этот этап автоматизирован: он сначала пишет связный текст для озвучки, а затем делит историю на сцены и создаёт отдельные промпты.
Если пишешь сценарий вручную, попроси модель использовать простой разговорный английский, начинать с What if, избегать повторов и уложиться примерно в 120–140 слов. Иначе «короткий» текст легко превращается в озвучку на полторы минуты.
Главная проблема AI-видео — персонаж начинает меняться от кадра к кадру. В одной сцене у него длинный плащ, в другой короткий. Меняется лицо, цвет костюма и даже количество пальцев.
Поэтому сначала я создаю отдельный референс персонажа. Только после этого перехожу к сценам.
В описании референса важно зафиксировать:
В моём примере это скелет с большими выразительными глазами и прозрачной кожей. Он легко узнаётся даже при быстрой смене кадров и подходит для историй о разных эпохах.
Готовое изображение персонажа нужно добавлять как референс во все следующие запросы. Само описание героя тоже лучше не переписывать: даже небольшая смена формулировки может изменить его внешний вид.
Для каждой сцены нужен отдельный промпт. В нём меняется действие и окружение, но сохраняются описание персонажа, стиль и цветовая палитра.
Сначала скопируй из конструктора промпт для референса и создай первое изображение в Flow. Выбери вертикальную ориентацию.
Первое изображение лучше проверить вручную. Если персонаж уже на этом этапе выглядит неправильно, нет смысла запускать остальные восемь сцен.
После этого добавь готового персонажа в запрос как референс, отключи очистку поля после отправки и по очереди вставь промпты всех сцен. Так изображения можно запустить параллельно.
Перед анимацией проверь:
Google отмечает, что материалы, созданные в Flow с помощью Veo и Nano Banana, получают невидимую маркировку SynthID. Подробнее об этом и доступности сервиса можно прочитать в официальной инструкции Flow.
После генерации изображений каждую сцену нужно отдельно анимировать. В Flow выбери нужный кадр, нажми «Анимировать» и вставь соответствующий видеопромпт из конструктора.
Я не прошу модель придумать новое событие. Лучше описать одно простое движение: герой поворачивается к пирамиде, ветер поднимает песок, а камера немного приближается.
Чем больше действий в одном запросе, тем выше шанс получить хаотичный клип. Для короткой сцены обычно достаточно:
Flow поддерживает вертикальные клипы и режим создания видео из первого кадра. Конкретные функции и длина зависят от выбранной версии Veo 3.1 — это можно проверить в таблице возможностей моделей Flow.
Сгенерированные видео лучше скачать одним архивом и сразу переименовать: 01-hook, 02-desert, 03-pyramid и так далее. Иначе девять похожих файлов быстро превращаются в квест.
В Google AI Studio выбери модель Gemini 2.5 Flash Preview TTS и режим одного диктора. Вставь полный сценарий, который подготовил конструктор.
В инструкции для стиля можно попросить модель читать текст как динамичный документальный рассказчик, делать короткие паузы и выделить начальный вопрос.
После генерации обязательно прослушай первые десять секунд. Если голос звучит медленно, лучше создать дорожку заново или немного ускорить её в редакторе. Также полезно вырезать длинные паузы между предложениями.
Gemini 2.5 Flash Preview TTS поддерживает генерацию аудио и управление манерой речи. Ограничения модели перечислены в официальной документации Google.
Создай вертикальный проект 9:16 и сначала положи на временную шкалу озвучку. Затем импортируй все видеосцены.
Мой порядок работы:
Расставляй видео под смысл речи, а не просто по номерам. Если рассказчик говорит о песке, зритель должен видеть песок именно в этот момент.
Исходный звук Veo иногда получается слишком громким. Я обычно опускаю его примерно до −7 или −15 дБ, а музыку — ещё ниже, чтобы она не спорила с голосом.
CapCut обычно позволяет экспортировать вручную собранный проект без водяного знака. Логотип чаще появляется из-за шаблонной концовки или отдельных платных элементов — это подтверждает официальная справка CapCut.
Один длинный кадр в начале часто выглядит слишком спокойно. Поэтому поверх основной последовательности я добавляю три коротких фрагмента из самых сильных сцен.
Пример:
На стыки можно поставить короткий звук затвора или щелчка. Но звук должен подчёркивать монтаж, а не перекрикивать рассказчика.
После этих трёх кадров видео возвращается к обычному повествованию. Получается визуальное обещание: зрителю сразу показывают, что дальше будет происходить что-то интересное.
Автоматические субтитры нужно обязательно перечитать. ИИ часто ошибается в именах, датах и названиях мест.
Я использую крупный контрастный шрифт и размещаю текст немного выше нижней части экрана. Слишком низкие подписи перекрываются интерфейсом Shorts, Reels или TikTok.
Не стоит выводить на экран длинное предложение целиком. Лучше разбивать текст на короткие фразы по три–семь слов.
Можно, но сама генерация через ИИ не превращает ролик в монетизируемый контент.
Для дохода от рекламы Shorts канал должен войти в YouTube Partner Program. На сентябрь 2026 года один из путей требует 1 000 подписчиков и 10 миллионов квалифицированных просмотров Shorts за последние 90 дней. После достижения порога канал всё равно проходит проверку. Актуальные требования опубликованы в справке YouTube Partner Program.
YouTube отдельно ограничивает монетизацию массового и однообразного контента. Если канал состоит из почти одинаковых историй, собранных по одному шаблону без собственной идеи или образовательной ценности, его могут признать неаутентичным. Это прямо указано в правилах монетизации YouTube.
Поэтому я бы не выпускал сотню роликов, где меняется только эпоха. Меняй структуру сюжета, визуальный стиль, персонажей и подачу. Добавляй собственный отбор фактов и авторскую мысль.
У TikTok есть ещё одно важное ограничение: для Creator Rewards подходят оригинальные видео длительностью не менее одной минуты. Значит, 45-секундную версию можно использовать для охватов, но для прямой монетизации TikTok понадобится отдельный монтаж продолжительностью от минуты. У программы также есть требования к региону, возрасту, подписчикам и просмотрам — они перечислены в официальной справке TikTok.
Кроме выплат платформы, ролики могут вести зрителя на собственный продукт, рассылку или сайт. На старте этот вариант часто реалистичнее, чем ожидание дохода от каждого просмотра.
Если AI-видео выглядит реалистично и показывает событие, которого не происходило, при загрузке на YouTube нужно раскрыть использование изменённого или синтетического контента. YouTube объясняет маркировку в официальной справке.
TikTok требует отмечать реалистичные изображения, видео и аудио, полностью созданные или существенно изменённые с помощью ИИ. Платформа может также добавить автоматическую маркировку. Правила описаны в разделе об AI-контенте TikTok.
Я бы не пытался скрывать использование ИИ. Маркировка сама по себе не делает слабый ролик сильным и не превращает хороший ролик в плохой.
Для теста достаточно одного ролика и девяти сцен. Не нужно сразу строить «контент-завод» и генерировать пятьдесят видео.
Выбери одну понятную историческую ситуацию. Создай героя, собери черновой ролик и посмотри на три показателя:
Если ролик не удерживает внимание, проблема обычно не в модели Veo. Чаще всего слабый хук, медленная озвучка или кадры не совпадают со словами.
Мой вывод простой: этот формат подходит не для пассивного заработка, а для быстрых экспериментов. ИИ сильно сокращает стоимость производства, но идея, темп и монтаж по-прежнему остаются работой автора.
Полный практический процесс я разбираю в курсе «Google Flow. YouTube-канал без лица».

Пошаговый гайд по Claude Cowork: как подключить папку, выбрать режим подтверждений и безопасно разобрать рабочий стол и загрузки.

Пошагово разбираем, как научить Claude Cowork вашему стилю, создать Skill для поиска AI-новостей и настроить ежедневную подготовку сценариев для Reels.