Entrada de imagem e áudio
- A entrada requer um URL de imagem e um URL de áudio de fala.
- A imagem pode ser JPEG, PNG ou WEBP de até 10 MB.
- O áudio pode ser nos formatos MP3, WAV, AAC, MP4 ou OGG de até 10 MB.
UlazAI - Ferramentas de imagem e vídeo de IA
Modelo de retrato falante premium
Transforme um retrato, imagem de personagem ou assunto selecionado em um vídeo falado conduzido por um arquivo de áudio de fala. Este é o caminho a ser usado quando a identidade, a expressão, o timing da boca e o desempenho da parte superior do corpo são mais importantes do que inventar uma cena completa do zero.
27 créditos/s. A saída do Studio está configurada para 1080.
Vídeos de fundadores, explicadores de produtos e clipes localizados de porta-vozes.
Educação liderada por personagens onde o mesmo rosto precisa de vários roteiros.
Animação de retrato onde o movimento da boca, a expressão e o tempo do áudio são importantes.
Criador de IA, avatar e clipes de campanha que precisam de um rosto repetível em muitas mensagens.
Vídeo modelo
Use isso como uma verificação rápida do modelo antes de gerar: entrada aceita, saída gerada e a rota mais clara no Video Studio.
Entrada Escolha a rota do ativo que você já possui.
Amostra Assista aos clipes gerados antes de gastar créditos.
Rota Limpar prompt, definir preços, definir a próxima etapa.
OmniHuman é para desempenho de personagens baseado em áudio. A imagem fonte dá identidade; a faixa de fala determina o tempo, o movimento da boca e grande parte da expressão.
OmniHuman começa com uma imagem de retrato e áudio de fala. A sincronização labial começa a partir de um vídeo existente e altera o tempo da boca para corresponder ao novo áudio.
| Duração | 720p/básico | 1080p |
|---|---|---|
| 5s | 135 créditos | - |
| 10s | 270 créditos | - |
| 30 anos | 810 créditos | - |
| anos 60 | 1620 créditos | - |
Use OmniHuman quando o ativo de marketing for a pessoa ou personagem, não a cena de fundo.
Crie um pequeno clipe do fundador, especialista ou apresentador da marca a partir de um retrato e do roteiro falado exato.
Reutilize o mesmo rosto nas faixas de áudio traduzidas, mantendo o clipe focado na fala e na expressão.
Crie várias microlições com a mesma imagem de personagem e diferentes faixas de voz limpas.
Crie clipes repetíveis no estilo do criador, onde a mesma identidade oferece novos ganchos, ofertas ou anúncios.
omnihuman_1_5
Estimado a partir do comprimento selecionado; faixa de voz controla o ritmo
Requer um URL de imagem em retrato, um URL de áudio de fala e um breve prompt de comportamento.
Rota abertaOmniHuman começa com uma imagem de retrato e áudio de fala. A sincronização labial começa a partir de um vídeo existente e altera o tempo da boca para corresponder ao novo áudio.
Um URL de imagem de retrato, um URL de áudio de fala e um prompt de expressão ou comportamento.
Não. A rota Studio é a rota de geração de vídeo; auxiliares de detecção são verificações separadas e não são expostos como modelos de vídeo.
O áudio deve ser inferior a 60 segundos. Para uma qualidade facial mais forte, mantenha os clipes por cerca de 15 segundos ou menos.
Use URLs de imagens JPEG, PNG ou WEBP de até 10 MB.
Uma máscara ajuda a selecionar um assunto quando a imagem contém várias pessoas ou quando o fundo não deve conduzir a animação.
O modo rápido acelera a geração, mas pode reduzir os detalhes e a qualidade do movimento.
A rota custa 27 créditos por segundo de produção.