Рекламный ролик выглядит собранным, когда персонаж, фон и голос взяты из того, что у бренда уже есть. В проекте, о котором пойдет речь, получилось семь шагов и пять инструментов: Nano Banana Pro, ElevenLabs, Claude, Seedance 2.0 и Sync 3. Медведь пришел с логотипа, горы — с этикеток линейки, голос собран один раз и остался за брендом навсегда.
Дальше по шагам: почему нейросетевая реклама чаще всего выглядит случайной, откуда брать персонажа и среду, как собрать из них кадр, зачем герою постоянный голос и почему видео с голосом приходится сводить отдельно.
Сразу оговорка: здесь разбор работы дизайнера. Если вы искали, где купить аккумулятор, вам нужен каталог производителя на mcmauto.ru.
Почему нейросетевая реклама выглядит случайной?
Потому что ее собирают с чистого листа. Открывается генератор, пишется промт «белый медведь и аккумулятор в горах», из двадцати вариантов берется самый эффектный. Картинка выходит красивая, и на этом все заканчивается: медведь не имеет отношения к знаку бренда, горы не имеют отношения к упаковке, а в следующем ролике будет другой медведь и другие горы.
Дальше конструкция ломается на масштабе. Один кадр еще держится, серия — уже нет: у бренда вместо героя набор случайных зверей. Проверка простая. Закройте логотип в углу кадра и спросите, чья это реклама. Если ответа нет, вы сгенерировали картинку, а не рекламу.
Нейросеть в этой цепочке отвечает за исполнение. За то, что именно исполняется, отвечает система бренда: знак, палитра, упаковка. Если системы нет, генератор ее не заменит.
Откуда берется персонаж?
Из знака. У бренда, о котором идет речь, в логотипе стоял белый медведь на горе — его перерисовали в полигональной графике, когда обновляли знак. Медведь уже был в упаковке, на коробках и на этикетках, покупатель встречал его на полке.
Медведь из знака: плоские грани, две плотности синего, гора под лапами. С этой фигуры начинается персонаж рекламы.
Дальше идея развернулась: тот же медведь, но живой, фотореалистичный, в солнцезащитных очках. Знак остается знаком и живет в плоской графике, персонаж живет в фотомире. Общего у них силуэт и повадка, и этого достаточно, чтобы зритель считал связь.
Расчет здесь простой. Образ, который уже стоит на упаковке, запоминается быстрее очередного кадра с продуктом, а бренд получает героя для роликов, баннеров и историй — то есть повод возвращаться. Разовая картинка такого не дает. Как собирался сам знак, разобрано в кейсе логотипа.
Откуда берется среда?
С этикеток. Каждая серия линейки получила свою гору: у одной плоские скалы, у другой рассветный хребет, у третьей заснеженный пик. Для двух серий эти горы я генерировал в нейросети еще на этапе упаковки, под конкретный формат этикетки.
Гора занимает нижнюю половину этикетки и различает серию. Она же потом стала фоном рекламы.
Когда дошло до рекламы, брать сток было незачем: гора уже нарисована и уже связана с продуктом. Из иллюстрации собрали реалистичный пейзаж — тот же силуэт пика, тот же свет, только в фотографической подаче. Фон рекламы вырос из полки, поэтому кадр и упаковка читаются как одна вещь.
Побочная выгода такого хода: горы стали активом. Один раз нарисованный пейзаж работает на этикетке, на баннере и в ролике, и каждый следующий носитель обходится дешевле предыдущего. Разбор всей упаковочной системы — в кейсе линейки.
Как собрать из этого кадр?
Три элемента сводятся в одно изображение: медведь, аккумулятор и горы. Собирал в Nano Banana Pro — по референсам персонажа и пейзажа, с продуктом в кадре.
Здесь важен порядок. Сначала утверждается, что именно должно быть в кадре и откуда каждый элемент взялся, и только потом идет генерация. Обратный порядок — сгенерировать и потом решить, что получилось, — как раз и дает красивую случайность.
На выходе получился рекламный кадр: продукт на снегу, пик на заднем плане, медведь справа. Из него дальше выросли и статичные баннеры, и видео.
Зачем персонажу постоянный голос?
Чтобы во всех роликах говорил один герой. Голос для медведя собран в ElevenLabs отдельно, один раз, и закреплен за брендом: следующий ролик озвучивается тем же голосом.
Это тот же принцип, что со шрифтом. Шрифт выбирается один раз и живет в фирменном стиле, иначе каждый макет выглядит чужим. С голосом ровно так же, только небрежность заметнее: смену шрифта половина зрителей не поймает, смену голоса ловят все.
Текст озвучки я написал в Claude, сразу с разметкой под ElevenLabs — паузами и интонациями. Без разметки синтез читает ровно и мертво; с ней подача становится живее. Дешевле, чем переписывать текст вслепую по десять раз.
Почему видео и голос сводятся отдельно?
Из-за ограничения генератора. Видео собиралось из готового изображения в Seedance 2.0, и задать ему тот самый голос медведя, который уже собран для бренда, нельзя: генератор либо озвучивает сам, либо отдает видео без звука.
Поэтому финальный шаг — синхронизация. Видео и голосовая дорожка сводятся в Sync 3, губы подгоняются под готовую запись. Шаг лишний с точки зрения красивого рассказа про ИИ и обязательный с точки зрения бренда: без него у персонажа каждый раз новый голос.
Полная цепочка выглядит так:
- Персонаж — из знака бренда.
- Горная среда — из иллюстраций упаковки.
- Рекламный кадр — Nano Banana Pro.
- Голос героя — ElevenLabs, один на все будущие ролики.
- Текст озвучки с разметкой пауз — Claude.
- Видео из готового кадра — Seedance 2.0.
- Сведение видео и голоса — Sync 3.
А выглядит все как «ну да, ИИ сам сделал, в пару кликов».
Что в итоге получил бренд?
Рекламные баннеры и ролик, которые продолжают упаковку. На баннере работает инверсия знака из правил фирменного стиля: белый логотип поверх фотографии, тот же пик, тот же медведь.
Баннер собран из тех же трех элементов. Знак стоит в инверсии — вариант, заранее заложенный в правила использования.
И, что важнее одного ролика, у бренда появился набор для следующих: персонаж, среда, голос и правило, по которому они собираются. Второй ролик обойдется дешевле первого, потому что заново придумывать нечего.
Чек-лист: как проверить, что реклама выглядит частью бренда
Прогоните готовый кадр по шести вопросам. Каждое «нет» — место, где реклама отклеится от бренда.
- Персонаж связан со знаком или придуман отдельно?
- Фон связан с упаковкой или взят из стока?
- Палитра кадра совпадает с палитрой продукта?
- Голос закреплен за брендом или генерируется заново под каждое видео?
- Если закрыть логотип, понятно, чья это реклама?
- Второй ролик соберется из тех же элементов или его придется придумывать с нуля?
Что нейросети меняют в работе, а что нет
Скорость. Локацию не надо искать, актера озвучки не надо звать, фон не надо рисовать неделю. Работа, на которую раньше уходили недели и подрядчики, укладывается в дни и в одного человека.
Решения остаются на дизайнере. Какой из двадцати вариантов взять. Откуда должен прийти персонаж. Что связывает кадр с полкой. Заметить, что медведь в новом ролике стал другим зверем. Открыть генератор сегодня может кто угодно, разница в том, что человек с ним делает.
Главное — собрать систему: персонаж связан с логотипом, фон с упаковкой, голос с образом. Тогда ролик выглядит частью одного бренда, и его не приходится оправдывать словами «зато быстро».