Если вы хотите не просто экспериментировать с отдельными промптами, а внедрить системную AI-автоматизацию, автономных агентов и контент-конвейеры в свой бизнес или агентство - я проектирую и запускаю такие решения под ключ. От автоматической генерации вертикальных видео и каруселей до сквозных воронок продаж в соцсетях. Напишите мне напрямую в Telegram: @websansay.
1. Почему слепая генерация проигрывает подходу Reference-to-Video
Когда вы отдаете видеомодели общий абстрактный текст, она усредняет миллионы обучающих параметров. В результате получается случайный визуальный ряд без четкого ритма, без акцентов и с плохой типографикой. Чтобы получить предсказуемый ролик студийного уровня, генерация должна опираться на строгую формулу:
REFERENCE VIDEO // ANALYSIS // STYLE EXTRACTION // SCENE PLANNING // GEMINI GENERATION // ITERATION // FINAL ASSEMBLY
Смысл метода прост: мы не просим нейросеть «придумать дизайн с нуля». Мы берем проверенное видео с высоким удержанием (Retention) и заставляем языковую модель с пространственным зрением разложить его на атомарные составляющие:
- Animation Style: 2D, 3D, кинетическая типографика, flat-дизайн, неоморфизм или стеклянный блик (glassmorphism);
- Motion & Easing: Скорость движения, кривые разгона и торможения (snappy vs smooth, bounce-эффекты);
- Transitions: Типы склеек (wipes, zoom punch, morphs, glitch);
- Color Palette & Background: Точные приближенные HEX-цвета и геометрия градиентов;
- Typography: Расположение заголовков, начертание, анимация появления плашек;
- Camera Behavior: Поведение виртуальной камеры (push-in, pan, статичный фокус, легкий shake);
- Mood & Pacing: Плотность смены кадров (бит каждые 1.5-2 секунды);
- Sound Design: Аудио-акценты (sub-bass hits, paper slap, whooshes).
Только после того, как визуальный язык зафиксирован в виде структурированного промпта, мы накладываем на него наш собственный сценарий.
2. Необходимый стек инструментов
| Инструмент | Роль в пайплайне | Зачем нужен |
|---|---|---|
| Claude 5 / Claude 5 Sonnet | Аналитический мозг и режиссер | Декомпозиция референса, извлечение стиля и покадровая нарезка сценария |
| Gemini Omni Flash | Генератор видеофрагментов | Рендер видеоклипов по 8-10 секунд с учетом стиля переданного референса |
| Видео-референс | Визуальный донор | 1-2 эталонных ролика из соцсетей с нужной динамикой, цветом и графикой |
| Ваш сценарий (Script) | Смысловая основа | Текст ролика, разбитый на смысловые блоки (хук, суть, пруф, CTA) |
| Talking-Head исходник | Видео с лицом (опционально) | Фиксация вашего аватара и лица при создании экспертных разговорных видео |
| CapCut / Premiere / DaVinci | Финальный монтаж | Склейка сцен, наложение озвучки, саунд-дизайн и контроль качества титров |
Для стабильной работы с экосистемой Gemini, видеомоделями Google и высокими лимитами вам потребуется подходящий доступ к продвинутым инструментам Google. Если у вас нет активного тарифа, у меня на витрине Хаба доступно проверенное решение:
Google AI Pro на 18 месяцев - доступ на 18 месяцев прямо на ваш личный Google-аккаунт. На один аккаунт предоставляется 1 000 кредитов в месяц (до 10 аккаунтов / до 10 000 кредитов ежемесячно). Расход: на 10-секундный ролик в Google Omni тратится всего 15 кредитов, поэтому пакета в 1000 кредитов хватает более чем на 60 полноценных генераций в месяц. Активация без проблем работает даже на аккаунты РФ.
👉 Забрать доступ к Google AI Pro на 18 месяцев на витрине Хаба
ШАГ 1. Поиск и отбор правильного референса
Не пытайтесь повторить длинное видео целиком. Нам нужен короткий вертикальный фрагмент (5-15 секунд) с плотной концентрацией анимации. Откройте Instagram Reels, YouTube Shorts, TikTok или Pinterest и используйте точные поисковые запросы:
kinetic typography reel- динамичный текст с резкими ударами и плашками;motion design short- летающие карточки, изометрия, 3D-модели;AI video edit style- трендовые эффекты глитча, морфинга и зумов;SaaS explainer reel- продуктовые демонстрации интерфейсов с матовым стеклом.
Выберите 1-2 эталонных ролика с нужной вам энергетикой. Запишите экран (Screen Recording) или скачайте MP4-файл на устройство.
ШАГ 2. Анализ референса и экстракция стиля в Claude
Откройте Claude, прикрепите видеофайл референса (или серию ключевых скриншотов из него), вставьте ваш готовый текст сценария и отправьте системный мастер-промпт:
I'm attaching a reference video and my script. I want to recreate this video's STYLE for my own script using Gemini Omni.
Step 1: Analyze the reference video. Describe:
- Animation style (2D, 3D, kinetic typography, flat design)
- How things move (speed, easing, bounce, snappy or smooth)
- Transitions (cuts, wipes, morphs, zooms)
- Color palette and background
- Typography style and where text appears
- Camera behavior (static, zoom, pan, shake)
- Overall mood and pacing
- Sound feel (whooshes, bass hits, music style)
Step 2: Break my script into scenes of 8-10 seconds each.
Step 3: For EACH scene, write one prompt that includes:
- What appears on screen and how it animates
- Exact text shown on screen (max 5-6 words)
- Colors, background, and typography matching the reference
- Camera movement and transition into the next scene
- Sound effects and music mood
Here is my script:
[ВСТАВЬТЕ СЮДА ВАШ СЦЕНАРИЙ]
Промпт составлен на английском языке - именно на английском современные видеомодели Google и мультимодальные трансформеры понимают пространственные и колористические инструкции с максимальной точностью.
ШАГ 3. Получение покадровых Scene Prompts
Почему мы дробим сценарий именно на 8-10 секунд? Это фундаментальное правило работы с генеративным видео: на длинных дистанциях (15+ секунд) любая нейросеть начинает накапливать ошибки, плыть по цветам и терять композицию. Короткий отрезок позволяет зафиксировать идеальную динамику.
В ответе Claude выдаст последовательность готовых промптов под каждую сцену ролика. Пример структуры:
Scene 1 - Hook (0-8 sec):
Bold kinetic typography slams in from center screen with high-contrast drop shadow. Heavy sub-bass hit on word appearance. Deep dark graphite background (#121216) with subtle ambient grid. Fast snappy camera push-in.
Scene 2 - Proof (8-17 sec):
Digital glitch transition into floating 3D glass card showing metrics. Accent neon yellow (#FACC15) badges. Text zooms punchy on key trigger word. Smooth camera pan right.
Scene 3 - Breakdown (17-25 sec):
Sticker icons pop sequentially with bounce easing. Paper slap tactile sound effect. High-contrast typography in lower third. Subtle camera shake on impact.
Scene 4 - CTA (25-35 sec):
Spin FX transition into final branded action plate. Text bounces with elastic easing. Upbeat audio climax with crowd cheer atmosphere. Glow outline on action button.
Скопируйте полученные промпты - мы будем поочередно отправлять их в генератор.
Описанный процесс можно выполнять вручную, а можно превратить в полностью автоматизированный конвейер по методологии 5 стадий контент-завода. Сценарий генерируется по контент-плану, Claude через API декомпозирует свежие видео-тренды (как в нашей связке с YouTube), формирует сцены, передает их в видеогенераторы, после чего FFmpeg или рендер-движок автоматически склеивает ролик с готовой озвучкой и публикует в 10+ соцсетей через Meta Graph API.
Я занимаюсь проектированием таких сквозных AI-архитектур на базе n8n, Claude Code и готовой экосистемы GENESIS AI. Если вам нужно автоматизировать видеопроизводство под ключ - напишите мне в Telegram (@websansay).
ШАГ 4. Генерация видео в Gemini Omni Flash
Переходим в интерфейс Gemini:
- Выбор модели: Выберите видеомодель
Gemini Omni Flash(или актуальную видеомодель в вашей рабочей среде); - Вставка промпта: Скопируйте промпт первой сцены (
Scene 1); - Прикрепление референса: Прикрепите исходный видеофайл референса, чтобы модель ориентировалась на его цветовую гамму и физику движения;
- Запуск: Нажмите генерацию и дождитесь просчета клипа;
- Повторение: Повторите операцию для Scene 2, Scene 3 и Scene 4.
Если вы создаете экспертный ролик с ведущим (Talking Head), всегда прикрепляйте исходное видео со своим лицом к каждому запросу генерации сцены. Это фиксирует консистентность персонажа и не дает модели произвольно менять черты лица или одежду от сцены к сцене.
ШАГ 5. Итеративная доводка через чат (Prompt Feedback Loop)
Если первая версия сцены не попала в ожидания - не начинайте всё заново. Модели Gemini поддерживают диалоговый контекст: вы можете корректировать конкретные параметры прямо в чате на человеческом языке:
Make the text bigger
Slow down the animation
Change the background to red
Add more glitch on the transition
Применяйте принцип: generate // evaluate // edit // regenerate. Сохраняйте в рабочую папку только лучшие дубли каждого фрагмента.
ШАГ 6. Финальная сборка и проверка типографики
Финальный этап проходит в видеоредакторе (CapCut, Premiere Pro или DaVinci Resolve):
- Склейка сцен: Импортируйте готовые 8-10 секундные MP4-клипы и расположите их строго по таймлайну сценария;
- Озвучка (Voiceover): Наложите дорожку дикторского голоса (записанного вживую или сгенерированного через качественные TTS-движки вроде MiniMax / ElevenLabs);
- Звуковые эффекты: Подложите фоновую музыку и расставьте звуковые акценты (SFX) на смену сцен;
- Контроль типографики: Обязательно проверьте весь текст в кадре. Честное ограничение AI: видеомодели всё еще могут допускать артефакты в сложных кириллических надписях. Если буквы поплыли, просто наложите поверх чистую плашку с текстом прямо в монтажной программе;
- Экспорт: Выгрузите финальный ролик в формате
1080×1920 @ 60 FPS.
Резюме и архитектурные выводы
Связка Claude (анализ) + Gemini Omni (видеогенерация) + CapCut (сборка) полностью убирает зависимость от тяжелого софта вроде After Effects для типовых контентных задач. Вы получаете студийный моушн-дизайн за считанные минуты, опираясь на лучшие мировые визуальные референсы.
Читайте также смежные материалы на Хабе:
- Моушн-дизайн за 10 минут без After Effects: Промпт-реверс через Claude и Google Flow
- Связка 2026: Как вытягивать бесплатный трафик из YouTube-трендов в Telegram
- Skill Taste: как Claude копирует дизайн любого сайта себе в проект
- Google AI PRO на 18 месяцев: Gemini 3.8 Pro, Nano Banana и Veo
Если вашей компании, агентству или медиа-проекту требуется автоматизированный видеопродакшен, AI-агенты для создания контента или готовые воронки генерации лидов - свяжитесь со мной. Мы разработаем персональную архитектуру под ваши задачи и запустим её в работу.
👉 Написать лично: Telegram @websansay
