Bilde- og lydinngang
- Inndata krever én bilde-URL og én talelyd-URL.
- Bildet kan være JPEG, PNG eller WEBP opptil 10 MB.
- Lyd kan være MP3-, WAV-, AAC-, MP4- eller OGG-formater opptil 10 MB.
UlazAI - AI bilde- og videoverktøy
Premium snakkende portrettmodell
Gjør om et portrett, et karakterbilde eller et utvalgt motiv til en talevideo drevet av en talelydfil. Dette er ruten å bruke når identitet, uttrykk, timing i munnen og overkroppens ytelse betyr mer enn å finne opp en hel scene fra bunnen av.
27 kreditter/s. Studioutgang er konfigurert for 1080.
Grunnleggervideoer, produktforklaringer og lokaliserte talspersonklipp.
Karakterledet utdanning der samme ansikt trenger flere manus.
Portrettanimasjon der munnbevegelse, uttrykk og lydtiming betyr noe.
AI-skaper, avatar og kampanjeklipp som trenger ett repeterbart ansikt på tvers av mange meldinger.
Modellvideo
Bruk dette som en rask modellsjekk før generering: akseptert input, generert utgang og den klareste ruten i Video Studio.
Inndata Velg ruten fra ressursen du allerede har.
Prøve Se genererte klipp før du bruker kreditter.
Rute Tøm prompt, klar priser, klar neste trinn.
OmniHuman er for lyddrevet karakterytelse. Kildebildet gir identitet; talesporet driver timing, munnbevegelser og mye av uttrykket.
OmniHuman starter fra et portrettbilde og talelyd. Leppesynkronisering starter fra en eksisterende video og endrer munntidspunktet for å matche ny lyd.
| Varighet | 720p / base | 1080p |
|---|---|---|
| 5s | 135 kreditter | - |
| 10s | 270 kreditter | - |
| 30-årene | 810 kreditter | - |
| 60-tallet | 1620 kreditter | - |
Bruk OmniHuman når markedsføringselementet er personen eller karakteren, ikke bakgrunnsscenen.
Lag et kort grunnlegger-, ekspert- eller merkepresentantklipp fra ett portrett og det eksakte talte manuset.
Gjenbruk det samme ansiktet på tvers av oversatte lydspor mens du holder klippet fokusert på tale og uttrykk.
Bygg flere mikrotimer med samme karakterbilde og forskjellige rene stemmespor.
Lag repeterbare klipp i skaperstil der den samme identiteten leverer nye knagger, tilbud eller kunngjøringer.
omnihuman_1_5
Estimert fra valgt lengde; stemmespor kontrollerer pacing
Krever én URL for stående bilde, én URL for talelyd og en kort oppførsel prompt.
Åpen ruteOmniHuman starter fra et portrettbilde og talelyd. Leppesynkronisering starter fra en eksisterende video og endrer munntidspunktet for å matche ny lyd.
Én URL for stående bilde, én URL for talelyd og en prompt for uttrykk eller oppførsel.
Nei. Studio-ruten er videogenereringsruten; deteksjonshjelpere er separate kontroller og er ikke eksponert som videomodeller.
Lyden må være under 60 sekunder. For sterkere ansiktskvalitet, hold klippene rundt 15 sekunder eller kortere.
Bruk JPEG-, PNG- eller WEBP-bildeadresser på opptil 10 MB.
En maske hjelper til med å velge ett motiv når bildet inneholder flere personer eller når bakgrunnen ikke skal drive animasjonen.
Rask modus gir raskere generering, men kan redusere detalj- og bevegelseskvalitet.
Ruten koster 27 kreditter per utgangssekund.