Bild- och ljudingång
- Indata kräver en bild-URL och en talljud-URL.
- Bilden kan vara JPEG, PNG eller WEBP upp till 10MB.
- Ljud kan vara MP3, WAV, AAC, MP4 eller OGG format upp till 10MB.
UlazAI - AI bild- och videoverktyg
Premium talande porträttmodell
Förvandla ett porträtt, karaktärsbild eller valt motiv till en talande video som drivs av en talljudfil. Det här är vägen att använda när identitet, uttryck, muntiming och överkroppsprestanda är viktigare än att uppfinna en hel scen från grunden.
27 krediter/s. Studioutgång är konfigurerad för 1080.
Grundarvideor, produktförklaringar och lokaliserade talesmansklipp.
Karaktärsledd utbildning där samma ansikte behöver flera manus.
Porträttanimation där munrörelser, uttryck och ljudtiming spelar roll.
AI-skapare, avatar och kampanjklipp som behöver ett ansikte som kan upprepas i många meddelanden.
Modell video
Använd detta som den snabba modellkontrollen innan du genererar: accepterad input, genererad utdata och den tydligaste vägen i Video Studio.
Input Välj rutten från den tillgång du redan har.
Prov Titta på genererade klipp innan du spenderar krediter.
Rutt Rensa prompt, tydlig prissättning, klara nästa steg.
OmniHuman är för ljuddriven karaktärsprestanda. Källbilden ger identitet; talspåret driver timing, munrörelser och mycket av uttrycket.
OmniHuman utgår från en porträttbild och talljud. Läppsynkronisering startar från en befintlig video och ändrar muntimingen för att matcha nytt ljud.
| Varaktighet | 720p / bas | 1080p |
|---|---|---|
| 5s | 135 krediter | - |
| 10s | 270 krediter | - |
| 30-talet | 810 krediter | - |
| 60-tal | 1620 krediter | - |
Använd OmniHuman när marknadsföringstillgången är personen eller karaktären, inte bakgrundsscenen.
Skapa ett kort klipp från grundaren, experten eller varumärkespresentatören från ett porträtt och det exakta talade manuset.
Återanvänd samma ansikte över översatta ljudspår samtidigt som du håller klippet fokuserat på tal och uttryck.
Bygg flera mikrolektioner med samma karaktärsbild och olika rena röstspår.
Skapa repeterbara klipp i kreatörsstil där samma identitet levererar nya hooks, erbjudanden eller tillkännagivanden.
omnihuman_1_5
Beräknad från vald längd; röstspår styr pacing
Kräver en webbadress för stående bild, en webbadress för talljud och en kort beteendeprompt.
Öppen ruttOmniHuman utgår från en porträttbild och talljud. Läppsynkronisering startar från en befintlig video och ändrar muntimingen för att matcha nytt ljud.
En URL för stående bild, en URL för talljud och en prompt för uttryck eller beteende.
Nej. Studio-rutten är videogenereringsvägen; detektionshjälpmedel är separata kontroller och exponeras inte som videomodeller.
Ljudet måste vara under 60 sekunder. För starkare ansiktskvalitet, behåll klippen i cirka 15 sekunder eller kortare.
Använd JPEG-, PNG- eller WEBP-bildadresser på upp till 10 MB.
En mask hjälper till att välja ett motiv när bilden innehåller flera personer eller när bakgrunden inte ska driva animeringen.
Snabbläge påskyndar genereringen men kan minska detaljer och rörelsekvalitet.
Rutten kostar 27 krediter per utgående sekund.