Ugrás a tartalomra

UlazAI – AI kép- és videóeszközök

Prémium beszélő portré modell

OmniHuman 1.5 beszélő portré generátor

Változtasson portrét, karakterképet vagy kiválasztott témát beszédhangfájl által vezérelt beszélő videóvá. Ezt az utat kell használni, amikor az identitás, a kifejezés, a száj időzítése és a felsőtest teljesítménye többet jelent, mint egy teljes jelenet kitalálása a semmiből.

27 kredit/mp. A stúdió kimenet 1080-ra van konfigurálva.

Alapítói videók, termékmagyarázatok és lokalizált szóvivői klipek.

Karaktervezérelt oktatás, ahol ugyanannak az arcnak több szkriptre van szüksége.

Portréanimáció, ahol a szájmozgás, a kifejezés és a hang időzítése számít.

AI-alkotó, avatar és kampányklipek, amelyeknek egyetlen megismételhető arcra van szükségük sok üzenetben.

Modell videó

Bevitel, minta és útvonal egyetlen indító klipben

Használja ezt a gyors modellellenőrzésként a generálás előtt: elfogadott bemenet, generált kimenet és a legtisztább útvonal a Video Studio-ban.

Bemenet Válassza ki az útvonalat a már meglévő eszközből.

Minta Nézze meg a generált klipeket, mielőtt jóváírást költene el.

Útvonal Tiszta prompt, egyértelmű árak, egyértelmű a következő lépés.

Miért illik az OmniHuman beszélő videóhoz?

Az OmniHuman hangvezérelt karakter-előadásra szolgál. A forráskép azonosságot ad; a beszédsáv vezérli az időzítést, a szájmozgást és a kifejezés nagy részét.

Kép és hang bemenet

  • A bevitelhez egy kép URL-címe és egy beszédhang URL-címe szükséges.
  • A kép lehet JPEG, PNG vagy WEBP 10 MB-ig.
  • A hang lehet MP3, WAV, AAC, MP4 vagy OGG stílusú formátum 10 MB-ig.

Javasolt hanghossz

  • A hangnak 60 másodpercnél rövidebbnek kell lennie.
  • Az erősebb arcminőség érdekében tartsa a klipeket körülbelül 15 másodperces vagy rövidebb ideig.
  • Használjon tiszta beszédet a pontos szkripttel; a zajos zeneágyak csökkentik a megbízhatóságot.

Maszk és tantárgy segítők

  • Az emberazonosítás és az alanyérzékelés segítői ellenőrzés, nem különálló videomodellek.
  • Használjon maszkot, ha egy kép több embert tartalmaz, vagy ha csak egy alany beszélhet.
  • Egy mag segíthet hasonló eredmények megismétlésében, ha ugyanazt a képet, hangot és promptot újra felhasználják.

Minőség- és sebességszabályozás

  • A kimenet lehet 720p vagy 1080p, a legtöbb csiszolt előadói kliphez pedig 1080p-t használnak.
  • A gyors mód némi minőséget cserél a gyorsabb generálásra.
  • A prompt viselkedésnek rövidnek kell lennie: hang, érzelem, testtartás és természetes mozgás.

Ahova illik

Az OmniHuman portréképből és beszédhangból indul ki. Az ajakszinkronizálás egy meglévő videóból indul, és az új hanghoz igazítja a szájidőzítést.

Időtartam 720p / alap 1080p
5s 135 krediteket -
10-es évek 270 krediteket -
30-as évek 810 krediteket -
60-as évek 1620 krediteket -

Erős használati esetek

Használja az OmniHuman-t, ha a marketingeszköz a személy vagy a karakter, nem pedig a háttérjelenet.

Szóvivői magyarázók

Hozzon létre egy rövid alapítói, szakértői vagy márkabemutató klipet egyetlen portréból és a pontos kimondott forgatókönyvből.

Lokalizált terméküzenetek

Használja újra ugyanazt az arcot a lefordított hangsávokon, miközben a klip a beszédre és a kifejezésre összpontosít.

Karaktervezérelt oktatás

Építsen több mikroleckét ugyanazzal a karakterképpel és különböző tiszta hangsávokkal.

Avatár és alkotó kampányok

Készítsen megismételhető alkotói stílusú klipeket, ahol ugyanaz az identitás új horogokat, ajánlatokat vagy bejelentéseket biztosít.

Stúdióútvonalak

Portrait Image to Talking Video

omnihuman_1_5

A kiválasztott hosszból becsült; hangsáv vezérli az ingerlést

Egy álló kép-URL-t, egy beszédhang-URL-t és egy rövid viselkedésű prompt-t igényel.

Nyitott útvonal

Miben különbözik az ajakszinkrontól

Az OmniHuman portréképből és beszédhangból indul ki. Az ajakszinkronizálás egy meglévő videóból indul, és az új hanghoz igazítja a szájidőzítést.

Gyártási munkafolyamat

  1. Válasszon tiszta portrét vagy karakterképet, jól látható arccal és minimális vizuális zűrzavarral.
  2. Ha a kép több alanyból áll, futtasson egy témaellenőrzést, és használjon maszkot annak a személynek, akinek beszélnie kell.
  3. Készítsen tiszta beszédhangot a végső szkripttel, lehetőleg 15 másodpercig vagy rövidebb ideig a legjobb minőség érdekében.
  4. Írjon egy rövid viselkedést prompt hangszínnel, kifejezéssel, testtartással és természetes mozgással.
  5. Használjon 1080p-t csiszolt klipekhez, vagy gyors módot, amikor még szkripteket tesztel.
  6. Használja újra ugyanazt a portrét, magot és prompt stílust, ha egységes műsorvezető-sorozatra van szüksége.

GYIK

Mire van szüksége a OmniHuman-nek?

Egy álló kép URL, egy beszédhang URL és egy prompt a kifejezéshez vagy a viselkedéshez.

A segítő észlelési eszköz videomodell?

Nem. A Studio útvonal a videó generálási útvonal; Az észlelési segítők külön ellenőrzések, és nem láthatók videomodellként.

Milyen hosszú lehet a hang?

A hangnak 60 másodpercnél rövidebbnek kell lennie. Az erősebb arcminőség érdekében tartsa a klipeket körülbelül 15 másodperces vagy rövidebb ideig.

Milyen képformátumok működnek?

Használjon JPEG, PNG vagy WEBP kép URL-eket legfeljebb 10 MB-ig.

Mit csinál a maszk bemenet?

A maszk segít kiválasztani egy témát, ha a kép több embert tartalmaz, vagy ha a háttérnek nem kell mozgatnia az animációt.

Mit csinál a gyors mód?

A gyors mód felgyorsítja a generálást, de csökkentheti a részleteket és a mozgás minőségét.

Mibe kerül?

Az útvonal kimeneti másodpercenként 27 kreditbe kerül.