Wejście obrazu i dźwięku
- Dane wejściowe wymagają jednego adresu URL obrazu i jednego adresu URL dźwięku mowy.
- Obraz może mieć format JPEG, PNG lub WEBP o rozmiarze do 10 MB.
- Dźwięk może być w formacie MP3, WAV, AAC, MP4 lub OGG do 10 MB.
UlazAI – narzędzia do tworzenia obrazów i wideo AI
Mówiący model portretowy premium
Zamień portret, obraz postaci lub wybrany obiekt w mówiący film oparty na pliku dźwiękowym mowy. Tę metodę można zastosować, gdy tożsamość, ekspresja, wyczucie czasu i wydajność górnej części ciała mają większe znaczenie niż wymyślanie całej sceny od zera.
27 kredytów/s. Wyjście studyjne jest skonfigurowane na 1080.
Filmy założycieli, objaśnienia produktów i zlokalizowane klipy z rzecznikami.
Edukacja oparta na postaciach, w której ta sama twarz wymaga wielu scenariuszy.
Animacja portretowa, w której liczy się ruch ust, ekspresja i synchronizacja dźwięku.
Twórca AI, awatar i klipy kampanii, które wymagają jednej powtarzalnej twarzy w wielu wiadomościach.
Modelowe wideo
Użyj tego do szybkiego sprawdzenia modelu przed wygenerowaniem: zaakceptowanych danych wejściowych, wygenerowanych danych wyjściowych i najczystszej trasy w Video Studio.
Wejście Wybierz trasę z zasobu, który już posiadasz.
Próbka Oglądaj wygenerowane klipy, zanim wydasz kredyty.
Trasa Jasne prompt, jasne ceny, jasny następny krok.
OmniHuman służy do odtwarzania postaci sterowanej dźwiękiem. Obraz źródłowy nadaje tożsamość; ścieżka mowy wpływa na synchronizację, ruch ust i większą część ekspresji.
OmniHuman zaczyna od obrazu portretowego i dźwięku mowy. Synchronizacja ust rozpoczyna się od istniejącego wideo i zmienia synchronizację ust, aby dopasować ją do nowego dźwięku.
| Czas trwania | 720p / baza | 1080p |
|---|---|---|
| 5s | 135 kredyty | - |
| 10 s | 270 kredyty | - |
| lata 30 | 810 kredyty | - |
| lata 60 | 1620 kredyty | - |
Użyj OmniHuman, gdy aktywem marketingowym jest osoba lub postać, a nie scena w tle.
Utwórz krótki klip założyciela, eksperta lub prezentera marki na podstawie jednego portretu i dokładnie mówionego scenariusza.
Wykorzystaj ponownie tę samą twarz w przetłumaczonych ścieżkach audio, skupiając klip na mowie i ekspresji.
Twórz wiele mikrolekcji z tym samym obrazem postaci i różnymi czystymi ścieżkami głosowymi.
Twórz powtarzalne klipy w stylu twórcy, w których ta sama tożsamość dostarcza nowych haczyków, ofert lub ogłoszeń.
omnihuman_1_5
Szacowany na podstawie wybranej długości; ścieżka głosowa steruje tempem
Wymaga jednego adresu URL obrazu portretowego, jednego adresu URL dźwięku mowy i krótkiego zachowania prompt.
Otwarta trasaOmniHuman zaczyna od obrazu portretowego i dźwięku mowy. Synchronizacja ust rozpoczyna się od istniejącego wideo i zmienia synchronizację ust, aby dopasować ją do nowego dźwięku.
Jeden adres URL obrazu portretowego, jeden adres URL dźwięku mowy i prompt do wyrażenia lub zachowania.
Nie. Trasa Studio to trasa generowania wideo; pomocnicy wykrywania są oddzielnymi kontrolami i nie są ujawniane jako modele wideo.
Dźwięk musi być krótszy niż 60 sekund. Aby uzyskać lepszą jakość twarzy, klipy powinny trwać około 15 sekund lub krócej.
Użyj adresów URL obrazów JPEG, PNG lub WEBP o rozmiarze do 10 MB.
Maska pomaga wybrać jeden obiekt, gdy obraz zawiera wiele osób lub gdy tło nie powinno napędzać animacji.
Tryb szybki przyspiesza generowanie, ale może zmniejszyć szczegółowość i jakość ruchu.
Trasa kosztuje 27 kredytów za sekundę wyjściową.