Przejdź do treści

UlazAI – narzędzia do tworzenia obrazów i wideo AI

Synchronizacja głosu między wideo

Generator synchronizacji wideo warg AI

Zmień istniejący mówiący klip w zsynchronizowaną wersję z nowym głosem, tłumaczeniem, narracją lub ścieżką wokalną. Ta trasa nie tworzy nowej twarzy ani sceny; wykorzystuje wideo źródłowe i steruje widocznym ruchem ust z docelowego dźwięku.

8 kredytów/s. Ostateczna długość wyjściowa jest zgodna z docelowym dźwiękiem.

Lokalizowanie filmów twórców, lekcji i objaśnień produktów bez konieczności odtwarzania całej sceny.

Zastąpienie szorstkiego nagrania czystym nagraniem końcowym.

Dopasowanie klipu prezentera do przetłumaczonego scenariusza lub nowego przebiegu narracji.

Wykorzystanie istniejących materiałów gadających głów do nowych wariantów kampanii.

Modelowe wideo

Wejście, próbka i trasa w jednym klipie startowym

Użyj tego do szybkiego sprawdzenia modelu przed wygenerowaniem: zaakceptowanych danych wejściowych, wygenerowanych danych wyjściowych i najczystszej trasy w Video Studio.

Wejście Wybierz trasę z zasobu, który już posiadasz.

Próbka Oglądaj wygenerowane klipy, zanim wydasz kredyty.

Trasa Jasne prompt, jasne ceny, jasny następny krok.

Wygenerowana próbka

Klip prezentera z zastąpionym głosem

Dane wejściowe: jeden publiczny adres URL wideo prezentera i jeden publiczny plik lektorski w formacie MP3.

Prompt

Source presenter video keeps its framing while the spoken line is replaced by the UlazAI launch voiceover.

Co kontroluje trasa synchronizacji ruchu warg

Jest to przepływ pracy typu wideo na wideo. Im lepsza widoczność twarzy źródłowej i docelowa ścieżka wokalna, tym silniejsza synchronizacja.

Źródło wideo i docelowy dźwięk

  • Dane wejściowe wymagają jednego adresu URL wideo i jednego adresu URL audio.
  • Pliki wideo mogą być kontenerami w stylu MP4, QuickTime lub Matroska o rozmiarze do 500 MB.
  • Pliki audio mogą być w formacie MP3, WAV, AAC, MP4 lub OGG o rozmiarze do 10 MB.

Wybór trybu, który ma znaczenie

  • Tryb uproszczony to najszybsza opcja do bezpośredniej wymiany i wyrównywania przepływów pracy.
  • Tryb podstawowy jest lepszy, gdy wymagana jest segmentacja sceny lub obsługa głośników.
  • Separacja wokalu może tłumić szumy tła, gdy ścieżka audio nie jest idealnie czysta.

Wyrównanie dźwięku

  • Jeśli dźwięk jest krótszy, źródło obrazu można przyciąć do długości dźwięku.
  • Jeśli dźwięk jest dłuższy, tryb uproszczony może odtwarzać wideo w pętli do przodu lub do tyłu, aby wypełnić ścieżkę.
  • Jeśli precyzja kształtu ust ma znaczenie, użyj czystego pliku wokalnego.

Gdzie to pasuje

Synchronizacja ust nie wymyśla nowej sceny z prompt. Wykorzystuje istniejące wideo jako źródło wizualne i wykorzystuje adres URL audio do sterowania synchronizacją ust.

Czas trwania 720p / baza 1080p
5s 40 kredyty -
10 s 80 kredyty -
lata 30 240 kredyty -
lata 60 480 kredyty -

Zastosowania produkcyjne

Użyj synchronizacji ruchu warg, gdy oryginalny wykonawca, twarz, kadrowanie lub wersja demonstracyjna produktu już działa, a jedynie ścieżka mówiona wymaga zmiany.

Lokalizacja kursów i szkoleń

Zachowaj ten sam film lekcyjny i dopasuj prezentera do przetłumaczonej ścieżki głosowej.

Wersje demonstracyjne produktu

Zastąp przestarzałą narrację w filmie demonstracyjnym, zachowując nienaruszone nagranie ekranu lub kadrowanie prezentera.

Reposty twórców

Zamień jeden klip gadającej głowy w wiele wariantów językowych lub scenariuszy bez konieczności przebudowywania sceny.

Zamiana głosów w kampanii

Testuj nowe mówione haczyki, oferty lub zlokalizowane linie pod kątem tej samej wydajności wizualnej.

Trasy studyjne

Video to Video Lip Sync

video_lip_sync

Szacowany na podstawie wybranej długości; sygnał wyjściowy podąża za czasem trwania dźwięku

Wymaga jednego źródłowego adresu URL wideo i jednego docelowego adresu URL dźwięku.

Otwarta trasa

Czym to się różni od zamiany tekstu na wideo

Synchronizacja ust nie wymyśla nowej sceny z prompt. Wykorzystuje istniejące wideo jako źródło wizualne i wykorzystuje adres URL audio do sterowania synchronizacją ust.

Przepływ pracy w produkcji

  1. Przygotuj film źródłowy, w którym usta są widoczne i nie są blokowane przez szybkie cięcia.
  2. Eksportuj docelowy dźwięk jako czystą mowę wokalną z ostatecznym scenariuszem i bez długiej ciszy.
  3. Wklej oba publiczne adresy URL w Video Studio i wybierz tryb pasujący do materiału filmowego.
  4. Użyj ustawień wyrównania, jeśli dźwięk jest dłuższy lub krótszy niż źródłowy film.
  5. Sprawdź czas wypowiadania ust, zanim przekształcisz wynik w reklamę, lekcję lub edycję społecznościową.

Często zadawane pytania

Jakiego wejścia potrzebuje AI Video Lip Sync?

Jeden publiczny adres URL źródła wideo i jeden publiczny docelowy adres URL dźwięku.

W jaki sposób ustalany jest ostateczny czas trwania?

Ostateczny wynik jest zgodny z czasem trwania dźwięku. Dłuższe źródło można przyciąć; krótsze źródło można zapętlić, gdy włączone jest wyrównanie.

Jakie formaty wideo są akceptowane?

Używaj plików wideo w formacie MP4, QuickTime lub Matroska o rozmiarze do 500 MB.

Jakie formaty audio są akceptowane?

Używaj plików audio w formacie MP3, WAV, AAC, MP4 lub OGG o rozmiarze do 10 MB. Najlepszy efekt daje zazwyczaj czysta ścieżka wokalna.

Jaka jest różnica pomiędzy trybem Lite i Podstawowym?

Lite to szybsza trasa dopasowująca. Podstawowy jest lepszy, gdy wymagana jest segmentacja sceny lub obsługa głośników.

Ile to kosztuje?

Trasa kosztuje 8 kredytów za sekundę wyjściową.

Kiedy nie należy używać synchronizacji ruchu warg?

Nie używaj go, gdy potrzebujesz nowej osoby, nowej sceny lub w pełni wygenerowanego wideo z prompt. Zamiast tego użyj modelu zamiany tekstu na wideo lub obrazu na wideo.