Цифровой аватар: как снимать контент, ничего не снимая
Человек прислал три обычных снимка с телефона. На выходе — студийный кадр, три ракурса одной сцены и видео, где он говорит на камеру. Без студии, без света, без оператора и без самого человека на площадке. Ниже весь путь по шагам за десять минут.
Человек прислал три обычных снимка с телефона. На выходе — студийный кадр, три ракурса одной сцены и видео, где он говорит на камеру. Без студии, без света, без оператора и без самого человека на площадке. Ниже весь путь по шагам за десять минут.
---
Если читать некогда: пять шагов
1. Нужно три-четыре фото человека с разных ракурсов. Обычных, с телефона.
2. Сначала карточка персонажа — лист со всеми ракурсами лица. Это основа, из которой строится всё дальнейшее.
3. Промпты не пишите. Есть готовые помощники, которым вы наговариваете задачу словами.
4. Из карточки собирается любая сцена — студия, интерьер, улица. Дальше меняется только ракурс камеры.
5. Кадр оживает в видео через второго помощника и раздел генерации. Весь путь — минут десять.
---
Из чего обычно состоит одна съёмка
Посчитайте, что нужно, чтобы получить пять минут говорящего человека в кадре.
Локация — студия или помещение, которое надо найти и оплатить. Свет — минимум три источника и человек, который умеет их ставить. Камера и оператор. Гримёр, если лицо будет крупно. Сам человек, у которого должен быть свободный день и настроение. Потом монтаж.
И всё это ради одного ролика. Понадобился второй с другой репликой — цикл повторяется целиком.
Поэтому регулярный видеоконтент есть у тех, кто может позволить себе съёмочный день раз в месяц. Остальные ограничиваются текстом.
Есть другой путь: три обычные фотографии на входе — и дальше сколько угодно кадров и роликов, без площадки и без присутствия человека. Ниже он разобран целиком, на настоящем прогоне.
И да, тот же путь работает для подарка — портрет, которого у человека нет, собирается из фотографий, которые уже лежат у вас в переписке. Но это только одно из применений, и самое простое.
---
Кто я и какого аватара я собирал
Я пять лет занимаюсь нейросетями, с 2019 года.
Разбор ниже — настоящий прогон, а не пример из учебника. Девушка прислала три своих снимка, я показываю всё, что делал дальше, со ссылками на каждый результат. Смотрите ровно то, что видел я.
Финальное видео, к которому мы придём, говорит само за себя — буквально: там человек в кадре объясняет, что так можно вести контент для бизнеса без аренды локации, найма модели и реальной съёмки.
---
Шаг 1. Три исходника
Вот что было на входе — обычные фотографии, не студийные:
Первый · второй · третий
![]()
![]()
![]()
Что просить у человека. Разные ракурсы: анфас, вполоборота, в полный рост. Свет ровный, без резких теней. Лицо не перекрыто.
Как получить незаметно. Обычно достаточно попросить «скинь пару своих фоток, хочу распечатать» — или взять из общей переписки, если они там есть.
---
Шаг 2. Карточка персонажа
Первое, что делается, — не портрет, а основа.
Я открыл помощника «Промпты Nano Banana» из раздела «Креатив» и наговорил задачу голосом: нужен лист персонажа, три полосы, портреты с разных сторон, фигура в полный рост, одинаковое лицо во всех кадрах, видимая текстура кожи, без ретуши.
Он собрал технический текст со всеми ракурсами в градусах и схемой света. Я его не писал — я объяснил задачу словами.
Результат — карточка персонажа
![]()
Зачем этот шаг. Карточка — не подарок, а фундамент. Дальше в любой сцене внешность берётся отсюда, а не додумывается заново. Именно поэтому во всех следующих кадрах один и тот же человек.
---
Шаг 3. Кадр в сцене
Теперь можно строить кадр. Я вернулся к тому же помощнику и попросил промпт под конкретную сцену — экспертную студию.
Получился развёрнутый текст: современная медиастудия с приглушённым светом, человек сидит на стуле, слегка подавшись вперёд, жестикулирует во время рассказа. Конденсаторный микрофон на кронштейне, ноутбук с графиками, раскрытый блокнот. Трёхточечная схема света — рисующий, заполняющий, контровой. Объектив 85 мм, малая глубина резкости, размытый задний план. Отдельной строкой — привязка внешности к карточке.
Результат
![]()
Что здесь важно. Про 85 мм, трёхточечный свет и малую глубину резкости я не думал. Я сказал «экспертная студия» — операторские решения подобрал помощник. Он и есть арт-директор, который знает, из чего складывается такой кадр.
---
Шаг 4. Те же кадры с других ракурсов
Одна фотография — это одна фотография. Серия из нескольких ракурсов выглядит как настоящая съёмка.
Я взял готовый портрет, снова обратился к помощнику и попросил промпты на смену ракурса камеры. Сцена та же, свет тот же, человек тот же — меняется только точка съёмки.
Ракурс второй · ракурс третий
![]()
![]()
Три кадра одной сцены — это уже не картинка, а мини-съёмка.
---
Шаг 5. Кадр начинает говорить
Здесь статика перестаёт быть статикой.
Я перешёл к другому помощнику — «Промпты Seedance», отдал ему каждое изображение по отдельности и попросил промпт для видео, где человек произносит конкретную фразу.
Дальше — раздел генерации, режим «Фото в видео», модель Seedance. Подходит и VEO.
Три видео с трёх ракурсов
![]()
И финал: пара минут в бесплатном CapCut на телефоне — склеить три ракурса в один ролик.
Готовый результат
Весь путь занял десять минут. От трёх снимков с телефона до говорящего ролика с монтажом по ракурсам.
---
Главное во всём этом
Ни один промпт я не писал сам. Ни для карточки, ни для сцены, ни для смены ракурса, ни для видео. Каждый раз я объяснял задачу обычными словами — часто голосовым, — а технический текст составлял готовый помощник.
Их больше 150, в каталоге они разложены по четырнадцати разделам: под каждую модель и под каждую задачу. Вы выбираете не «чем это сделать», а «что мне нужно получить».
Доступ — базовая подписка. То есть входной порог здесь не в умении писать промпты. Этого уметь не надо.
---
Если не знаете, какую сцену придумать
Студия — это то, что придумал я. Дальше упираешься в другое: а что ещё бывает?
Для этого есть отдельный помощник — «Арт-директор», тридцать лет опыта в визуальной стратегии и брендинге. Он не пишет промпты, он придумывает идеи.
Я попросил его дать концепции для фотосессии — он выдал три проработанные идеи.
![]()
![]()
![]()
![]()
Насколько подробно. Первая называлась «Интеллектуальный минимализм». В ней было всё: архетип образа, локация — библиотека с бетонными стенами и панорамными окнами в раннем свете, наряд вплоть до матовых стальных часов и низкого пучка, палитра из холодных серых и натурального дерева, поза с касанием подбородка, композиция по правилу третей с диагоналями оконных рам, крупность плана и даже что человек делает в кадре: делает паузу в работе, чтобы обдумать сложную мысль.
Дальше механика та же. Каждую идею я скопировал в генератор промптов — раз, два, три, четыре — и отправил в генерацию.
![]()
![]()
![]()
![]()
![]()
Три кадра, которые получились: первый · второй · третий
![]()
![]()
![]()
Цепочка целиком: идея от арт-директора → промпт от генератора → картинка. Ни на одном звене ничего не сочинялось вручную.
---
Что делать, если аватар получился не тот
Лицо похоже, но не то. Мало исходников. Добавьте ракурсы, которых не было: профиль, лицо крупно вполоборота.
Разные кадры — как разные люди. Вы генерируете каждый отдельно, без карточки. Вернитесь к шагу 2.
Слишком гладко, как с обложки. Скажите помощнику прямо: «видимая текстура кожи, без ретуши и без макияжа».
Видео дёргается или лицо плывёт. Обычно потому, что в кадре слишком много движения. Просите минимальное: лёгкий поворот головы и жест рукой.
---
Куда это ведёт дальше
Один ролик — первая задача. Дальше начинается то, ради чего многие сюда приходят.
#### Цифровой аватар
Карточка держит сходство в пределах одной сессии. Следующая ступень — обученный персонаж: вы загружаете 15–20 фотографий без ретуши, с разных ракурсов, при дневном свете, и получаете модель, которая генерирует именно этого человека месяцами, в любом количестве кадров.
Это и есть аватар, который не поплывёт ни на десятом кадре, ни на сотом.
#### Что в блоке «Фото и видео»
Самый большой блок программы, и он делится надвое.
Статика. Полный разбор Midjourney со всеми скрытыми командами: смешивание изображений, обратная разработка чужих картинок, копирование стиля по референсу, точечная замена объектов внутри кадра, бесшовное расширение границ, библиотека из 5 000+ стилей. Отдельно GPT Images и Nano Banana — гиперреализм с порами и естественными несовершенствами. И Flux, где тренируются собственные модели.
Движение. Кисть движения, которой вы выделяете область и задаёте ей направление отдельно от остального кадра. Ключевые кадры: загружаете первый и последний, переход просчитывается сам. Готовые пресеты операторских движений.
Всё это — модели раздела Gen AI, где они собраны в одном окне и оплачиваются с общего баланса по факту.
Четыре мини-курса внутри блока: Midjourney от новичка до Pro · GPT Images и Nano Banana с механикой постоянства героя · базовая генерация видео · AI Video: режиссура и контроль камеры.
---
Про монтаж отдельно
В этой статье я потратил на монтаж две минуты в CapCut — просто склеил три ракурса. Этого достаточно для подарка.
Но если контент нужен регулярно, монтаж перестаёт быть склейкой. В той же подписке лежит блок «Профессиональный видеомонтаж» — больше 35 уроков именно про экспертные ролики. Вот что там разбирается.
Правило полутора-двух секунд. Главный принцип виральных роликов: каждые 1,5–2 секунды в кадре должно происходить заметное изменение. Если картинка статична дольше трёх секунд, глаз замыливается и человек свайпает. Наезд камеры, всплывающее слово, футаж поверх головы, иконка — неважно что, важна частота.
Таймлайн на 20–25 секунд. Ноль-две секунды — крючок, самый динамичный монтаж. Две-десять — удержание, темп не сбавляется. Десять-двадцать пять — суть и призыв.
Метод якорей. Каждое визуальное изменение оправдано смыслом речи: сказал «семья» — появилась иконка, сказал «деньги» — полетела анимация.
Технический сетап спикера до съёмки. Два источника света — рисующий под 45 градусов и контурный сзади-сбоку, чтобы отделить силуэт от фона. Полметра-три метра до стены для глубины кадра, чтобы потом ставить плашки за головой. Паузы по полсекунды в начале и конце фразы — чтобы было чем склеивать. И честная оговорка: не полагайтесь на нейросетевое улучшение звука, оно даёт металлический призвук.
Разборы чужого монтажа покадрово — Даня Скоробогатый, Карина Исхакова, Мистер Бист. Не теория, а что именно работает у людей с большими охватами: текстурирование объектов, управление вниманием через размытие, контраст статики и динамики, сборка сцены из отдельных элементов.
Плюс отдельные части про маски и слои, ключевые кадры и универсальную формулу движения, автоматические субтитры с правилом двух слов, безопасные зоны, цветокоррекцию и авторские пресеты, звуковой дизайн со слоями и генерацией фоновой музыки, психологию первых двух секунд с библиотекой крючков, и «пасхалки» как стратегию удержания.
Вот что получается после этого курса — сравните с моей двухминутной склейкой выше.
---
Что ещё входит в Plus
Три блока программы: «Фото и видео», «Профессиональный видеомонтаж» и «Автоматизатор» — двенадцать уроков про то, как перестать делать руками повторяющееся.
Шесть экспресс-курсов:
«Midjourney с нуля до контроля» — доступ, основы, продвинутый уровень с собственными референсами.
«ChatGPT Images & Nano Banana» — семь глав от анатомии промпта до брендового контента с одним героем в серии.
«Google Veo 3» — коммерческое видео: 1080p, синхронный звук, кинематографический контроль.
«Видео-нейросети 2.0» — разбор Kling 3.0 и Seedance 2.0 от А до Я: работа с первым и последним кадром, многокадровые сцены с шестью ракурсами в одном запросе, замена фона и освещения в готовом видео, липсинк.
«Suno» — генерация музыки, триста с лишним страниц: формула промпта, атлас из 61 жанра, 41 профиль звучания, режим альбома, монетизация.
Плюс два общих — Perplexity и Grok.
---
И если захочется без подписок вообще
Отдельная история для тех, кто хочет поставить нейросети себе на компьютер.
На тарифе Full есть курс «Работа с AI софтом» — 36 уроков, больше сорока часов материала. Локальная установка Stable Diffusion и запуск в облаке, как устроены генерация из текста и из изображения, ControlNet, Inpaint, обучение собственных моделей, детализация лиц, сохранение личности человека между кадрами, апскейл, объёмные эффекты, Deforum.
Смысл простой: модель работает на вашем компьютере, интернет для генерации не нужен, платить за каждое обращение не надо.
---
С чего начать сегодня
Одно действие, десять минут.
Найдите три фотографии человека, которому хотите сделать подарок. В переписке они почти наверняка есть.
Зайдите к помощнику по промптам и наговорите голосом, что хотите получить: карточку персонажа со всеми ракурсами. Своими словами.
Отправьте полученный текст в раздел генерации.
Получилось? Возьмите вторую задачу. Поставьте того же человека в другую сцену — это уже одна строка обычным языком.
А если сцену придумать не получается — арт-директор выдаст три готовые концепции с локацией, светом, позой и палитрой.
Если персонаж нужен постоянный. Отдельный раздел ИИ-блогер обучает героя один раз — дальше он не меняет внешность от кадра к кадру. Туда же добавляется голос, и персонаж начинает говорить.
Важная деталь: проверка ваших фотографий там бесплатна и идёт до оплаты. Светофор с объяснением — красный не пускает дальше, потому что на плохом наборе герой навсегда получится искусственным. То есть заплатить за неудачный результат не получится.
Регистрация бесплатная и открывает три дня полного доступа — всех помощников, включая тех, что писали мне промпты.
---
Что почитать дальше
[Как сделать себе фотосессию](/blog/photoshoot-without-photographer) — та же механика, но для себя.
[Реставрация старого фото](/blog/restore-old-photo) — если исходник повреждён.
[Почему ИИ-персонаж выглядит пластиковым](/blog/why-ai-character-looks-plastic) — пять причин синтетичности и как чинится каждая.
[На чём зарабатывает ИИ-блогер](/blog/ai-blogger-monetization) — если аватар перерастает в проект.
---