Как сделать креатив со знаменитостью: самый понятный гайд по озвучке селебы
С помощью видео вебмастер может вызвать у пользователя больше эмоций, здесь легче добиться WOW-эффекта, можно больше рассказать о продукте, отсеяв нецелевые клики и в целом видео-креатив лучше прогревает и добавляет траста воронке, чем просто статика. Сегодня поговорим как создать промо-ролик с селебой, используя дипфейк-технологии, где брать исходники, и какие нейросети для этого понадобятся.
Дисклеймер! Продвижение офферов OMNI CPA с помощью селебного подхода только по согласованию с менеджером.
Как найти подходящую локальную знаменитость и каких селеб брать не стоит
Нейросети сегодня позволяют делать потрясающие по качеству ролики с любой знаменитостью. Но не каждая селеба подойдет, Главное нюанс — чем больше вы найдете видеоматериалов, тем лучше результат сможет выдать AI. Кстати отличный пример дипфейк роликов — канал, который активно ведет "Илон Маск".
☝️Кстати, кто хочет лить УБТ трафик с YT — это отличный пример, чего можно добиться, нативно рекламируя нутро оффер в "передаче" какого-нибудь локального врача. Вы даже можете просто выдумать своего инфлюенсера, не опираясь на реально существующих селеб/врачей.
Немного ушли от темы. Вернемся к вопросу поиска селеб. Учитывая, что универсального совета тут быть не может, можем только порекомендовать сервисы, где их можно найти:
Hypeauditor — самые популярные блогеры с разбивкой по ГЕО;
Последний хоть и платный, но самый простой в поиске. Как минимум вы просто можете вбить "Dr." и уже дальше скопировать базу имен и просмотреть их на YouTube самостоятельно.
Также можете воспользоваться вот такой готовой шпаргалкой:
Италия: Dr. Med Cristina Tomasi - Inst, FB, site; Dr. Umberto Veronesi - Website, Wiki;
Германия: Dr. Med Ulrich Bauhofer - Inst, YT, TT, Прочее;
Болгария: Профессор Иво Христов - FB, Wiki, Видео; Мария Бакалова (актриса) - Inst, Wiki;
Кстати иногда достаточно немного просмотреть контента одного из представленных инфлюенсеров, как сразу в рекомендациях начнут появляться другие. Впрочем, теперь с поиском селеб, уверены, проблем не возникнет.
Какие нейросети понадобятся
Теперь о главном — куда потом эти исходники загружать. Давайте посмотрим, что обычно советуют:
Заменить лицо, поменять движение губ или все сразу на вашем видео-исходнике можно HeyGen (trial-версией), Swapface, Easy Wap2Lip или FaceFusion.
Что из этого мы будем использовать? Ответ — ничего, кроме Elevenlabs. Почему? Потому что это, либо дорого, либо долго, либо все вместе. Да, если вы хотите делать 15-минутные ролики с врачами и грузить их на YouTube, то придется разбираться в сложном софте. Но если ваша задача сделать 15-секундный креатив — то достаточно будет 5 минут вашего времени и гайда ниже.
Самый простой способ сделать быстрый дипфейк с селебой
Для начала идем в Elevenlabs.io → регистрируемся → идем во вкладку "VoiceLab". Как видите, изначально у нас была задумка сделать видео с Трампом, но не тут то было. Нейросеть распознала политика и сказала, что этот голос защищен законами о приватности. Но, уверены, что с врачами таких проблем не возникнет. Далее тут кликаем на "Add Generative or Cloned Voice".
У нас появляется вот такое меню и нас интересует пункт "Instant Voice Cloning".
Пока отставляем эту вкладку в сторону и идем на YouTube искать видео, где нужная нам селеба говорит 1 минуту и больше. Желательно, чтобы на фоне не было никаких других звуков и никто ее не перебивал. Чистый монолог.
После грузим нашу аудио-дорожку в меню вкладки "Instant Voice Cloning" и нажимаем на "Add Voice".
Все, голос будет сгенерирован и появится в меню с другими голосами. Вам останется только нажать на "Use" и вы попадете в меню, где нам нужно остановиться на вкладке "Text to Speach". Вписываем наш текст. Убедитесь, что нужный вам язык поддерживается Elevenlabs.
Важно: старайтесь ваш текст написать так, чтобы нейросети было легко его считать. Например, сначала мы написали "$100", название нашей партнерки написали на английском и нейросеть знак валюты не поняла, а наше название издала каким-то тонким голоском. Будьте готовы к экспериментам и нескольким тестам с адаптацией.
Внизу сразу можно прослушать результат. Если он вас устраивает — кликаем на значок загрузки.
☝️Так мы получили аудиофайл с нужным нам текстом и голосом нашей селебы. На этом ElevenLabs нам не понадобится.
Теперь идем снова на YouTube (или другой источник) и ищем отрывок с селебой, где он будет постоянно в кадре на протяжении всего хронометража нашей аудио-дорожки. Если в видео будут другие персонажи, то нейросеть может начать подставлять наш текст не тому персонажу.
Скачиваем видео с YouTube любым удобным расширением и идем его обрезать. Опять-таки просто пишем "Обрезать видео онлайн" и все прекрасно и быстро.
И теперь самое интересное. Куда нам закинуть наши исходники, чтобы не возиться с GitHub, не устанавливать нейросети на наш сервер и не перебирать десятки битых архивов? Есть вот такой онлайн-сервис: https://lalamu.studio/.
Нажимаем "Try for free" и попадаем во всеми нами любимую Canva в уже нужную нам вкладку. Грузим отдельно исходник видео и аудиодорожку, и кликаем на "Generate Lipsync Video".
Все. Вот варианты, что получились у нас на скорую руку. Естественно в этом деле большую роль играют исходники. Мы могли бы, конечно, взять прямо сидящего врача, который не будет особо жестикулировать в кадре, чтобы он произнес нужные нам слова и это смотрелось органично. Еще и с хорошим качеством картинки. Но, с ДиКаприо веселее.
Полезно, что гайд охватывает весь путь от поиска исходника до озвучки и дипфейка. Мы небольшой командой работаем для испаноязычной аудитории и в похожем креативе сначала восстановили повреждённое архивное фото через <a href="https://mejorarcalidaddeimagen.ai/
">Mejorar Calidad de Imagen</a>, а затем аккуратно оживили его для ролика. Важно лишь отдельно проверять лица и текст после обработки, получать согласие на использование образа и явно маркировать синтетический контент.
Для работы над такими проектами мне помогает <a href="https://planorial.com/
">Planorial</a> — удобно сразу визуализировать структуру ролика и раскадровку, начиная не с чистого листа, а с готового брифа или сценария. Это сильно ускоряет согласование концепции с командой, особенно когда нужно оперативно показать, как будет выглядеть видео с озвучкой или без, до этапа полного продакшена.
С исходниками у нас вечная комедия: я хватаю первый ролик со знаменитостью, а напарник ищет чистую речь без музыки. После разговора через <a href="https://knowuswell.com/
">KnowUsWell</a> договорились: он проверяет качество аудио и право на использование образа, я собираю озвучку и монтаж. Я бы ещё отдельно подчеркнул согласие и маркировку дипфейка — меньше шансов, что наш WOW-эффект потом превратится в «ой».
Прочитал про озвучку и дипфейки — тема шумная, но разбор по делу, особенно про то, где брать исходники. У меня задачи скромнее: на этой неделе снимал на телефон справку из поликлиники, и половину листа накрыла тень от окна.
Переснимать было некогда, открыл <a href="https://lensup.ai/ru/remove-shadow-from-scan/
">LensUp</a> и прямо в браузере стёр тень с фото, заодно выровнял завал по краям — лист лёг ровно. Файлы никуда не загружаются, всё считается на устройстве. Сжатие целится в выбранный размер, но может выйти чуть больше, так что если портал придирчивый, лучше оставить запас.
Рассматриваю создание дипфейков, как работу с новым материалом — всегда важно начать с качественного исходника. Часто в подборках находишь старые сканы или кадры с плохим освещением, где лицо знаменитости темное или зернистое. Вот тут на помощь приходит <a href="https://enhancerfree.com/
">Photo Enhancer Free</a>, который помогает прояснить тени и подтянуть детали перед тем, как нейросеть начнёт анализировать анимацию, иначе весь WOW-эффект от чистого видео может утонуть в пикселях.
В части про исходники и озвучку согласен — действительно, пока не подчистишь фон и свет в стоковых кадрах под стиль ролика, нарезка выглядит несогласованно и WOW-эффект получается кривым. На каждом отдельном кадре для превью и обложек я гоняю картинку через <a href="https://aibgremoverfree.com/
">AI Background Remover Free</a> — занимает пару секунд, зато можно быстро собрать несколько вариантов композиции и понять, какой кадр вообще стоит брать в монтаж, не открывая тяжёлый редактор.