Ingresso immagine e audio
- L'input richiede un URL immagine e un URL audio vocale.
- L'immagine può essere JPEG, PNG o WEBP fino a 10 MB.
- L'audio può essere in formato MP3, WAV, AAC, MP4 o OGG fino a 10 MB.
UlazAI: strumenti per immagini e video AI
Modello ritratto parlante premium
Trasforma un ritratto, l'immagine di un personaggio o un soggetto selezionato in un video parlato guidato da un file audio vocale. Questa è la strada da utilizzare quando l’identità, l’espressione, il tempismo della bocca e la performance della parte superiore del corpo contano più che inventare una scena completa da zero.
27 crediti/s. L'uscita Studio è configurata per 1080.
Video del fondatore, spiegazioni del prodotto e clip localizzate dei portavoce.
Educazione guidata dai personaggi in cui lo stesso volto necessita di più copioni.
Animazione di ritratto in cui il movimento della bocca, l'espressione e il timing audio contano.
Creatori di intelligenza artificiale, avatar e clip di campagne che necessitano di un volto ripetibile in molti messaggi.
Video del modello
Utilizzalo come controllo rapido del modello prima di generare: input accettato, output generato e il percorso più chiaro in Video Studio.
Ingresso Scegli il percorso dalla risorsa che già possiedi.
Campione Guarda le clip generate prima di spendere crediti.
Itinerario Cancella prompt, prezzi chiari, passaggio successivo chiaro.
OmniHuman è dedicato alla performance dei personaggi basata sull'audio. L'immagine sorgente dà identità; la traccia del parlato guida il tempismo, il movimento della bocca e gran parte dell'espressione.
OmniHuman inizia da un'immagine ritratto e da un audio vocale. La sincronizzazione labiale inizia da un video esistente e modifica il tempo della bocca per adattarlo al nuovo audio.
| Durata | 720p/base | 1080p |
|---|---|---|
| 5s | 135 crediti | - |
| 10 secondi | 270 crediti | - |
| '30 | 810 crediti | - |
| Anni '60 | 1620 crediti | - |
Utilizza OmniHuman quando la risorsa di marketing è la persona o il personaggio, non la scena di sfondo.
Crea una breve clip del fondatore, dell'esperto o del presentatore del marchio partendo da un ritratto e dall'esatta sceneggiatura parlata.
Riutilizza lo stesso volto nelle tracce audio tradotte mantenendo la clip incentrata sulla parola e sull'espressione.
Costruisci più micro-lezioni con la stessa immagine del personaggio e diverse tracce vocali pulite.
Crea clip ripetibili in stile creativo in cui la stessa identità fornisce nuovi hook, offerte o annunci.
omnihuman_1_5
Stimato dalla lunghezza selezionata; La traccia vocale controlla il ritmo
Richiede un URL di immagine verticale, un URL di audio vocale e un breve comportamento prompt.
Percorso apertoOmniHuman inizia da un'immagine ritratto e da un audio vocale. La sincronizzazione labiale inizia da un video esistente e modifica il tempo della bocca per adattarlo al nuovo audio.
Un URL dell'immagine verticale, un URL dell'audio vocale e un prompt per l'espressione o il comportamento.
No. Il percorso Studio è il percorso di generazione video; gli aiutanti di rilevamento sono controlli separati e non sono esposti come modelli video.
L'audio deve essere inferiore a 60 secondi. Per una migliore qualità del viso, mantieni le clip di circa 15 secondi o meno.
Utilizza URL di immagini JPEG, PNG o WEBP fino a 10 MB.
Una maschera aiuta a selezionare un soggetto quando l'immagine contiene più persone o quando lo sfondo non deve guidare l'animazione.
La modalità veloce accelera la generazione ma può ridurre i dettagli e la qualità del movimento.
Il percorso costa 27 crediti al secondo di uscita.