Gå til indhold

UlazAI - AI billed- og videoværktøjer

Premium talende portrætmodel

OmniHuman 1.5 talende portrætgenerator

Gør et portræt, et karakterbillede eller et udvalgt motiv til en talevideo drevet af en talelydfil. Dette er ruten, der skal bruges, når identitet, udtryk, mundtiming og ydeevne på overkroppen betyder mere end at opfinde en hel scene fra bunden.

27 credits/sek. Studio-output er konfigureret til 1080.

Grundlæggervideoer, produktforklaringer og lokaliserede talsmandsklip.

Karakterstyret uddannelse, hvor det samme ansigt har brug for flere manuskripter.

Portrætanimation, hvor mundbevægelse, udtryk og lydtiming betyder noget.

AI-skaber, avatar og kampagneklip, der har brug for ét gentageligt ansigt på tværs af mange budskaber.

Model video

Input, sample og rute i ét lanceringsklip

Brug dette som det hurtige modeltjek før generering: accepteret input, genereret output og den klareste rute i Video Studio.

Input Vælg ruten fra det aktiv, du allerede har.

Prøve Se genererede klip, før du bruger kreditter.

Rute Klar prompt, klar prissætning, klar næste trin.

Hvorfor OmniHuman passer til talende video

OmniHuman er til lyddrevet karakterpræstation. Kildebilledet giver identitet; talesporet driver timing, mundbevægelse og meget af udtrykket.

Billede og lyd input

  • Input kræver én billed-URL og én talelyd-URL.
  • Billedet kan være JPEG, PNG eller WEBP op til 10MB.
  • Lyden kan være MP3, WAV, AAC, MP4 eller OGG formater op til 10MB.

Anbefalet lydlængde

  • Lyden skal forblive under 60 sekunder.
  • For en stærkere ansigtskvalitet skal du holde clips omkring 15 sekunder eller kortere.
  • Brug ren tale med det nøjagtige script; støjende musiksenge reducerer pålideligheden.

Maske- og emnehjælpere

  • Menneskelig identifikation og emnedetektion er hjælpertjek, ikke separate videomodeller.
  • Brug en maske, når et billede indeholder flere personer, eller når kun ét emne skal tale.
  • Et frø kan hjælpe med at gentage lignende resultater, når det samme billede, lyd og prompt genbruges.

Kvalitets- og hastighedskontrol

  • Output kan være 720p eller 1080p, hvor 1080p bruges til de fleste polerede præsentationsklip.
  • Hurtig tilstand bytter noget kvalitet for hurtigere generering.
  • Adfærdsprompten skal være kort: tonus, følelser, kropsholdning og naturlig bevægelse.

Hvor det passer

OmniHuman starter fra et portrætbillede og talelyd. Læbesynkronisering starter fra en eksisterende video og ændrer mundens timing, så den matcher ny lyd.

Varighed 720p / base 1080p
5s 135 kreditter -
10'erne 270 kreditter -
30'erne 810 kreditter -
60'erne 1620 kreditter -

Stærke use cases

Brug OmniHuman, når markedsføringsaktivet er personen eller karakteren, ikke baggrundsscenen.

Talsmandsforklaringer

Opret et kort klip fra grundlæggeren, eksperten eller brandet fra ét portræt og det nøjagtige talte manuskript.

Lokaliserede produktmeddelelser

Genbrug det samme ansigt på tværs af oversatte lydspor, mens du holder klippet fokuseret på tale og udtryk.

Karakterstyret uddannelse

Byg flere mikrolektioner med det samme karakterbillede og forskellige rene stemmespor.

Avatar- og skaberkampagner

Skab gentagelige klip i skaberstil, hvor den samme identitet leverer nye hooks, tilbud eller meddelelser.

Studieveje

Portrait Image to Talking Video

omnihuman_1_5

Estimeret ud fra valgt længde; stemmesporet styrer pacing

Kræver én URL til portrætbillede, én URL til talelyd og en kort adfærdsprompt.

Åben rute

Hvordan det adskiller sig fra lip sync

OmniHuman starter fra et portrætbillede og talelyd. Læbesynkronisering starter fra en eksisterende video og ændrer mundens timing, så den matcher ny lyd.

Produktions arbejdsgang

  1. Vælg et klart portræt- eller karakterbillede med god ansigtssynlighed og minimal visuel rod.
  2. Hvis billedet har flere emner, så kør et emnetjek og brug en maske til den person, der skal tale.
  3. Forbered ren talelyd med det endelige script, helst 15 sekunder eller kortere for den bedste kvalitet.
  4. Skriv en kort adfærdsprompt med tone, udtryk, kropsholdning og naturlig bevægelse.
  5. Brug 1080p til polerede klip eller hurtig tilstand, når du stadig tester scripts.
  6. Genbrug den samme portræt-, seed- og promptstil, når du har brug for en konsekvent oplægsserie.

FAQ

Hvad har OmniHuman brug for?

Én portrætbillede-URL, én talelyd-URL og en prompt til udtryk eller adfærd.

Er hjælperdetektionsværktøjet en videomodel?

Nej. Studio-ruten er videogenereringsruten; detektionshjælpere er separate kontroller og eksponeres ikke som videomodeller.

Hvor lang kan lyden være?

Lyden skal være under 60 sekunder. For en stærkere ansigtskvalitet skal du holde clips omkring 15 sekunder eller kortere.

Hvilke billedformater virker?

Brug JPEG, PNG eller WEBP billed-URL'er op til 10 MB.

Hvad gør maskeindgangen?

En maske hjælper med at vælge ét motiv, når billedet indeholder flere personer, eller når baggrunden ikke skal drive animationen.

Hvad gør hurtig tilstand?

Hurtig tilstand fremskynder genereringen, men kan reducere detaljer og bevægelseskvalitet.

Hvad koster det?

Ruten koster 27 credits pr. outputsekund.