Как сделать говорящий аватар из фото: пошаговая инструкция и цифровой аватар в нейросети без камеры

👉 Бот: https://t.me/neurochats_bot?start=sourceunic_rutube048 - здесь и озвучка текста, и Липсинк, всё в одной переписке. 🎁 Промпты и разборы бесплатно в моём Telegram-канале: https://t.me/+KjiGx0nO6GY3MTVi 📝 Текстовая версия с промптом и скриншотами: https://mylifetarget.ru/instrukczii-i-gajdy/govoryashchiy-avatar-iz-foto/?utm_source=rutube048 Одна фотография и один звуковой файл - и человек со снимка говорит ваши слова. Без камеры, без студии, без монтажа. Называется это говорящий аватар, а если искать посолиднее - цифровой аватар, и собирается он за пару минут прямо в переписке. В ролике весь путь по шагам: где взять голос, если записывать нечем, что нажимать в боте и на каких двух местах эта затея обрывается чаще всего. СОДЕРЖАНИЕ 0:00 - Говорящий аватар из фото: что получится в итоге 0:48 - Какое фото подойдёт и какая нужна запись голоса 1:54 - Озвучка текста в боте: где взять голос, если записывать нечем 2:42 - Ремарка тона: строчка, которая меняет интонацию 4:11 - Как сделать говорящий аватар в Липсинке: пошагово 4:24 - Промпт мимики и жестикуляция руками в кадре 5:53 - Почему голосовое сообщение не проходит: mp3, wav, m4a 6:36 - Кнопка «Начать генерацию»: пока не нажали, ничего не спишется 7:00 - Результат и сколько он стоит по времени 7:48 - Цифровой аватар: кому он нужен и зачем 8:59 - Поздравление голосом знаменитости: что можно и что нельзя 10:23 - Какая нейросеть делает говорящие аватары: Липсинк, Veo, Seedance, Sora 11:29 - Частые ошибки при создании говорящего аватара 12:22 - Что делать дальше ЧТО ПОНАДОБИТСЯ Фотография: лицо анфас или с небольшим поворотом, крупно, глаза видно. Профиль не годится - если рта почти не видно, синхронизировать нечего. Один человек в кадре: на групповом снимке нейросеть сама решит, кто заговорит. И запас по краям: голове должно быть куда шевелиться. Запись голоса: до пяти минут, чистая, без музыки и шума. Инструмент подгоняет губы под всё, что слышит. ГОЛОСА ПОД РУКОЙ НЕТ - СОБЕРЁМ ИЗ ТЕКСТА В том же боте: «Работа с аудио» - «Озвучка текста». Шесть голосов, выбор меняется в любой момент. Главная хитрость - ремарка тона перед репликой. Пишете, каким голосом её произнести, ставите двоеточие, дальше сама фраза. Слова до двоеточия вслух не прозвучат: они объясняют модели, как читать. «Тихо, с придыханием» даст интимную интонацию, «низкий эпичный голос диктора» - трейлер. Без ремарки выйдет ровное чтение: для инструкции годится, для поздравления мертво. ГЛАВНЫЙ ОБРЫВ: ФОРМАТ ЗВУКА Голосовое сообщение Липсинк не принимает: голосовые в Телеграме - это формат ogg, а его инструмент разворачивает. Работают mp3, wav и m4a - ровно то, что пишет диктофон на телефоне, и ровно то, что отдаёт озвучка текста в самом боте. Хотите свой голос - включайте диктофон, а не микрофон в поле сообщения. ВТОРОЙ ОБРЫВ: КНОПКА ЗАПУСКА Когда оба файла на месте, бот показывает, во сколько обойдётся ролик, и ждёт. Пока не нажата «Начать генерацию», не происходит ничего и не списывается ничего. Рядом есть «Изменить промпт» - поправить мимику можно прямо здесь, до запуска. ПРОМПТ МИМИКИ Необязательный, но с ним человек в кадре ведёт себя живее. И Липсинк оживляет не только рот: если руки в кадре и свободны, допишите про спокойную жестикуляцию в такт речи. Работает только вместе - рук в кадре нет, и никакой промпт их не дорисует. КОМУ НУЖЕН ЦИФРОВОЙ АВАТАР Экспертам и блогерам, у которых текст есть, а желания включать камеру нет. Соцсетям - поток коротких роликов без бюджета на съёмку. Продавцам и рекрутёрам: персональное видеообращение открывают чаще письма. И тем, кто делает подарки. Отдельный выигрыш, который замечают не сразу: поменять фразу в готовом ролике проще, чем переснять дубль. ПРО ЗАКОН, ЕСЛИ ХОЧЕТСЯ ЛИЦО АРТИСТА Изображение человека защищено статьёй 152.1 Гражданского кодекса: публиковать чужое лицо без согласия нельзя. Для себя и дома никто не запретит, а выкладывать в ленту, продавать как услугу или ставить в рекламу не стоит. Сильнее всего приём работает там, где снять уже нельзя: старая фотография деда, снимок бабушки из альбома. И там, где героя не существует - сгенерированный Дед Мороз с именем ребёнка. ЧЕМ ЕЩЁ ДЕЛАЮТ ГОВОРЯЩИХ ЛЮДЕЙ Липсинк тут основной: работает от звука, тянет до пяти минут, принимает фото и видео. Veo речь синтезирует сам, но за одну генерацию выдаёт не больше восьми секунд. Seedance тоже умеет говорящих людей, только речь придумывает сам, а ваш аудиофайл берёт как образец ритма. Sora людей с фотографии в кадр не берёт вовсе. Старый и потрёпанный снимок сначала прогоните через реставрацию: чем чётче лицо на входе, тем точнее ложится синхронизация. Третий разбор одной цепочки: сначала чиним старое фото, потом заставляем его двигаться, сегодня - говорить. #говорящийаватар #цифровойаватар #нейросети #аватаризфото #липсинк

12+
4 просмотра
10 дней назад
12+
4 просмотра
10 дней назад

👉 Бот: https://t.me/neurochats_bot?start=sourceunic_rutube048 - здесь и озвучка текста, и Липсинк, всё в одной переписке. 🎁 Промпты и разборы бесплатно в моём Telegram-канале: https://t.me/+KjiGx0nO6GY3MTVi 📝 Текстовая версия с промптом и скриншотами: https://mylifetarget.ru/instrukczii-i-gajdy/govoryashchiy-avatar-iz-foto/?utm_source=rutube048 Одна фотография и один звуковой файл - и человек со снимка говорит ваши слова. Без камеры, без студии, без монтажа. Называется это говорящий аватар, а если искать посолиднее - цифровой аватар, и собирается он за пару минут прямо в переписке. В ролике весь путь по шагам: где взять голос, если записывать нечем, что нажимать в боте и на каких двух местах эта затея обрывается чаще всего. СОДЕРЖАНИЕ 0:00 - Говорящий аватар из фото: что получится в итоге 0:48 - Какое фото подойдёт и какая нужна запись голоса 1:54 - Озвучка текста в боте: где взять голос, если записывать нечем 2:42 - Ремарка тона: строчка, которая меняет интонацию 4:11 - Как сделать говорящий аватар в Липсинке: пошагово 4:24 - Промпт мимики и жестикуляция руками в кадре 5:53 - Почему голосовое сообщение не проходит: mp3, wav, m4a 6:36 - Кнопка «Начать генерацию»: пока не нажали, ничего не спишется 7:00 - Результат и сколько он стоит по времени 7:48 - Цифровой аватар: кому он нужен и зачем 8:59 - Поздравление голосом знаменитости: что можно и что нельзя 10:23 - Какая нейросеть делает говорящие аватары: Липсинк, Veo, Seedance, Sora 11:29 - Частые ошибки при создании говорящего аватара 12:22 - Что делать дальше ЧТО ПОНАДОБИТСЯ Фотография: лицо анфас или с небольшим поворотом, крупно, глаза видно. Профиль не годится - если рта почти не видно, синхронизировать нечего. Один человек в кадре: на групповом снимке нейросеть сама решит, кто заговорит. И запас по краям: голове должно быть куда шевелиться. Запись голоса: до пяти минут, чистая, без музыки и шума. Инструмент подгоняет губы под всё, что слышит. ГОЛОСА ПОД РУКОЙ НЕТ - СОБЕРЁМ ИЗ ТЕКСТА В том же боте: «Работа с аудио» - «Озвучка текста». Шесть голосов, выбор меняется в любой момент. Главная хитрость - ремарка тона перед репликой. Пишете, каким голосом её произнести, ставите двоеточие, дальше сама фраза. Слова до двоеточия вслух не прозвучат: они объясняют модели, как читать. «Тихо, с придыханием» даст интимную интонацию, «низкий эпичный голос диктора» - трейлер. Без ремарки выйдет ровное чтение: для инструкции годится, для поздравления мертво. ГЛАВНЫЙ ОБРЫВ: ФОРМАТ ЗВУКА Голосовое сообщение Липсинк не принимает: голосовые в Телеграме - это формат ogg, а его инструмент разворачивает. Работают mp3, wav и m4a - ровно то, что пишет диктофон на телефоне, и ровно то, что отдаёт озвучка текста в самом боте. Хотите свой голос - включайте диктофон, а не микрофон в поле сообщения. ВТОРОЙ ОБРЫВ: КНОПКА ЗАПУСКА Когда оба файла на месте, бот показывает, во сколько обойдётся ролик, и ждёт. Пока не нажата «Начать генерацию», не происходит ничего и не списывается ничего. Рядом есть «Изменить промпт» - поправить мимику можно прямо здесь, до запуска. ПРОМПТ МИМИКИ Необязательный, но с ним человек в кадре ведёт себя живее. И Липсинк оживляет не только рот: если руки в кадре и свободны, допишите про спокойную жестикуляцию в такт речи. Работает только вместе - рук в кадре нет, и никакой промпт их не дорисует. КОМУ НУЖЕН ЦИФРОВОЙ АВАТАР Экспертам и блогерам, у которых текст есть, а желания включать камеру нет. Соцсетям - поток коротких роликов без бюджета на съёмку. Продавцам и рекрутёрам: персональное видеообращение открывают чаще письма. И тем, кто делает подарки. Отдельный выигрыш, который замечают не сразу: поменять фразу в готовом ролике проще, чем переснять дубль. ПРО ЗАКОН, ЕСЛИ ХОЧЕТСЯ ЛИЦО АРТИСТА Изображение человека защищено статьёй 152.1 Гражданского кодекса: публиковать чужое лицо без согласия нельзя. Для себя и дома никто не запретит, а выкладывать в ленту, продавать как услугу или ставить в рекламу не стоит. Сильнее всего приём работает там, где снять уже нельзя: старая фотография деда, снимок бабушки из альбома. И там, где героя не существует - сгенерированный Дед Мороз с именем ребёнка. ЧЕМ ЕЩЁ ДЕЛАЮТ ГОВОРЯЩИХ ЛЮДЕЙ Липсинк тут основной: работает от звука, тянет до пяти минут, принимает фото и видео. Veo речь синтезирует сам, но за одну генерацию выдаёт не больше восьми секунд. Seedance тоже умеет говорящих людей, только речь придумывает сам, а ваш аудиофайл берёт как образец ритма. Sora людей с фотографии в кадр не берёт вовсе. Старый и потрёпанный снимок сначала прогоните через реставрацию: чем чётче лицо на входе, тем точнее ложится синхронизация. Третий разбор одной цепочки: сначала чиним старое фото, потом заставляем его двигаться, сегодня - говорить. #говорящийаватар #цифровойаватар #нейросети #аватаризфото #липсинк

, чтобы оставлять комментарии