Entrada de imagen y audio
- La entrada requiere una URL de imagen y una URL de audio de voz.
- La imagen puede ser JPEG, PNG o WEBP hasta 10MB.
- El audio puede ser formatos de estilo MP3, WAV, AAC, MP4 u OGG de hasta 10 MB.
UlazAI - Herramientas de imagen y vídeo de IA
Modelo de retrato parlante premium
Convierta un retrato, una imagen de un personaje o un sujeto seleccionado en un video hablado impulsado por un archivo de audio de voz. Esta es la ruta a seguir cuando la identidad, la expresión, el ritmo de la boca y el desempeño de la parte superior del cuerpo importan más que inventar una escena completa desde cero.
27 créditos/s. La salida de estudio está configurada para 1080.
Vídeos de fundadores, explicaciones de productos y clips de portavoces localizados.
Educación basada en el carácter donde un mismo rostro necesita múltiples guiones.
Animación de retratos donde el movimiento de la boca, la expresión y la sincronización del audio son importantes.
Creador de IA, avatar y clips de campaña que necesitan una cara repetible en muchos mensajes.
Vídeo modelo
Utilice esto como verificación rápida del modelo antes de generar: entrada aceptada, salida generada y la ruta más clara en Video Studio.
Aporte Elija la ruta del activo que ya tiene.
Muestra Mire los clips generados antes de gastar créditos.
Ruta Borrar prompt, precios claros, siguiente paso claro.
OmniHuman es para la interpretación de personajes basada en audio. La imagen fuente da identidad; la pista del habla impulsa el tiempo, el movimiento de la boca y gran parte de la expresión.
OmniHuman comienza a partir de una imagen vertical y un audio de voz. La sincronización de labios comienza a partir de un vídeo existente y cambia el tiempo de la boca para que coincida con el nuevo audio.
| Duración | 720p/base | 1080p |
|---|---|---|
| 5s | 135 créditos | - |
| 10 | 270 créditos | - |
| 30 años | 810 créditos | - |
| años 60 | 1620 créditos | - |
Utilice OmniHuman cuando el activo de marketing sea la persona o el personaje, no la escena de fondo.
Cree un breve clip de fundador, experto o presentador de marca a partir de un retrato y el guión hablado exacto.
Reutilice la misma cara en las pistas de audio traducidas manteniendo el clip centrado en el habla y la expresión.
Crea múltiples microlecciones con la misma imagen de personaje y diferentes pistas de voz limpias.
Cree clips repetibles al estilo de los creadores donde la misma identidad ofrezca nuevos ganchos, ofertas o anuncios.
omnihuman_1_5
Estimado a partir de la longitud seleccionada; La pista de voz controla el ritmo.
Requiere una URL de imagen vertical, una URL de audio de voz y un comportamiento breve prompt.
Ruta abiertaOmniHuman comienza a partir de una imagen vertical y un audio de voz. La sincronización de labios comienza a partir de un vídeo existente y cambia el tiempo de la boca para que coincida con el nuevo audio.
Una URL de imagen vertical, una URL de audio de voz y un prompt para expresión o comportamiento.
No. La ruta Studio es la ruta de generación de video; Los ayudantes de detección son comprobaciones independientes y no se exponen como modelos de vídeo.
El audio debe ser inferior a 60 segundos. Para una calidad facial más fuerte, mantenga los clips de alrededor de 15 segundos o menos.
Utilice URL de imágenes JPEG, PNG o WEBP de hasta 10 MB.
Una máscara ayuda a seleccionar un sujeto cuando la imagen contiene varias personas o cuando el fondo no debe impulsar la animación.
El modo rápido acelera la generación pero puede reducir los detalles y la calidad del movimiento.
La ruta cuesta 27 créditos por segundo de salida.