Passer au contenu

UlazAI - Outils d'image et de vidéo IA

Synchronisation vocale vidéo à vidéo

Générateur de synchronisation labiale vidéo AI

Transformez un clip parlant existant en une version synchronisée avec une nouvelle voix, traduction, narration ou piste vocale. Cet itinéraire ne crée pas de nouveau visage ou de nouvelle scène ; il utilise votre vidéo source et pilote le mouvement visible de la bouche à partir de l'audio cible.

8 crédits/s. La longueur de sortie finale suit l’audio cible.

Localisez les vidéos des créateurs, les leçons et les explications de produits sans régénérer toute la scène.

Remplacer une prise de voix approximative par un enregistrement final propre.

Faire correspondre un clip de présentateur à un script traduit ou à une nouvelle passe de narration.

Réutilisation des séquences de têtes parlantes existantes dans de nouvelles variantes de campagne.

Vidéo du modèle

Entrée, échantillon et itinéraire dans un seul clip de lancement

Utilisez-le comme vérification rapide du modèle avant de générer : entrée acceptée, sortie générée et itinéraire le plus clair dans Video Studio.

Saisir Choisissez l'itinéraire parmi l'actif que vous possédez déjà.

Échantillon Regardez les clips générés avant de dépenser des crédits.

Itinéraire Effacer prompt, clarifier les prix, effacer la prochaine étape.

Échantillon généré

Clip du présentateur avec voix remplacée

Entrée : une URL vidéo de présentateur public plus un MP3 de voix off publique.

Prompt

Source presenter video keeps its framing while the spoken line is replaced by the UlazAI launch voiceover.

Ce que contrôle la route de synchronisation labiale

Il s'agit d'un flux de travail vidéo à vidéo. Plus la visibilité du visage source et la piste vocale cible sont bonnes, plus la synchronisation est forte.

Vidéo source et audio cible

  • L'entrée nécessite une URL vidéo et une URL audio.
  • Les fichiers vidéo peuvent être des conteneurs de style MP4, QuickTime ou Matroska jusqu'à 500 Mo.
  • Les fichiers audio peuvent être aux formats de style MP3, WAV, AAC, MP4 ou OGG jusqu'à 10 Mo.

Des choix de mode qui comptent

  • Le mode simplifié est l'option la plus rapide pour les flux de travail de remplacement et d'alignement directs.
  • Le mode de base est préférable lorsqu'une segmentation de scène ou une gestion des enceintes est nécessaire.
  • La séparation vocale peut supprimer le bruit de fond lorsque la piste audio n'est pas parfaitement propre.

Alignement audio

  • Si l'audio est plus court, la source visuelle peut être ajustée à la longueur audio.
  • Si l'audio est plus long, le mode simplifié peut boucler la vidéo vers l'avant ou vers l'arrière pour remplir la piste.
  • Utilisez une lime vocale claire lorsque la précision de la forme de la bouche est importante.

Où ça correspond

La synchronisation labiale n'invente pas une nouvelle scène à partir d'un prompt. Il utilise votre vidéo existante comme source visuelle et utilise l'URL audio pour piloter le timing de la bouche.

Durée 720p / base 1080p
5s 40 crédits -
10s 80 crédits -
années 30 240 crédits -
années 60 480 crédits -

Utilisations de production

Utilisez la synchronisation labiale lorsque l'interprète, le visage, le cadrage ou la démonstration du produit d'origine fonctionnent déjà et que seule la piste parlée doit changer.

Localisation de cours et de formations

Conservez la même vidéo de leçon et alignez le présentateur sur une piste vocale traduite.

Révisions de la démonstration du produit

Remplacez la narration obsolète dans une vidéo de démonstration tout en conservant intact l’enregistrement d’écran ou le cadrage du présentateur.

Les créateurs republient

Transformez un clip de tête parlante en plusieurs variantes de langue ou de script sans reconstruire la scène.

Échanges de voix de campagne

Testez de nouvelles accroches parlées, offres ou lignes localisées par rapport aux mêmes performances visuelles.

Itinéraires en studio

Video to Video Lip Sync

video_lip_sync

Estimé à partir de la longueur sélectionnée ; la sortie suit la durée de l'audio

Nécessite une URL vidéo source et une URL audio cible.

Itinéraire ouvert

En quoi cela diffère du texte vers vidéo

La synchronisation labiale n'invente pas une nouvelle scène à partir d'un prompt. Il utilise votre vidéo existante comme source visuelle et utilise l'URL audio pour piloter le timing de la bouche.

Flux de travail de production

  1. Préparez une vidéo source où la bouche est visible et non bloquée par des coupes rapides.
  2. Exportez l'audio cible sous forme de discours vocal clair avec le script final et sans long silence.
  3. Collez les deux URL publiques dans Video Studio et choisissez le mode qui correspond au métrage.
  4. Utilisez les paramètres d'alignement lorsque l'audio est plus long ou plus court que la vidéo source.
  5. Vérifiez le timing de la bouche avant de découper le résultat dans une publicité, une leçon ou une modification sociale.

FAQ

De quelle entrée AI Video Lip Sync a-t-il besoin ?

Une URL vidéo source publique et une URL audio cible publique.

Comment est décidée la durée finale ?

La sortie finale suit la durée audio. Une source plus longue peut être coupée ; une source plus courte peut être mise en boucle lorsque l'alignement est activé.

Quels formats vidéo sont acceptés ?

Utilisez des fichiers vidéo de style MP4, QuickTime ou Matroska jusqu'à 500 Mo.

Quels formats audio sont acceptés ?

Utilisez des fichiers audio de style MP3, WAV, AAC, MP4 ou OGG jusqu'à 10 Mo. Une piste vocale claire donne généralement le meilleur résultat.

Quelle est la différence entre le mode léger et le mode basique ?

Lite est la voie d'alignement la plus rapide. Basic est préférable lorsqu'une segmentation de scène ou une gestion des haut-parleurs est nécessaire.

Qu'est-ce que ça coûte ?

L'itinéraire coûte 8 crédits par seconde de sortie.

Quand ne dois-je pas utiliser la synchronisation labiale ?

Ne l'utilisez pas lorsque vous avez besoin d'une nouvelle personne, d'une nouvelle scène ou d'une vidéo entièrement générée à partir d'un prompt. Utilisez plutôt un modèle texte-vidéo ou image-vidéo.