Accès illimité 3 jours à Seedance 2.5 + plusjusqu'à 25% de réduction

Réduction expire dans --

Synchronisation labiale IA

La synchronisation labiale IA réanime une bouche pour qu'elle corresponde à une nouvelle piste audio, ce qui alimente deux flux de travail : doubler une vidéo existante avec une parole différente et animer une seule photo en vidéo parlante complète. Le studio d'avatars d'Arteza héberge plusieurs moteurs de synchronisation labiale, du doublage vidéo 4K de Sync-3 aux avatars photo plus audio d'OmniHuman, sous un seul solde de crédits.

Comment ça marche

1

Fournir le visage

Téléchargez une vidéo à doubler ou une seule photo de portrait à animer. Les visages de face, bien éclairés avec la bouche clairement visible se synchronisent de manière plus convaincante.

2

Ajouter l'audio

Téléchargez un enregistrement ou générez d'abord la parole dans le studio audio avec la synthèse vocale ou une voix clonée. Le modèle associe chaque son de parole à la forme de bouche correspondante.

3

Générer la vidéo synchronisée

Le modèle régénère la région de la bouche image par image ou anime l'ensemble du visage à partir de la photo, de sorte que les lèvres, la mâchoire et les expressions se déplacent en synchronisation avec le son.

Modèles que vous pouvez utiliser dès maintenant

Chaque modèle ci-dessous est actif sur Arteza avec son coût de crédit actuel, extrait du même moteur de tarification utilisé par le studio au moment de la génération.

Sync-3 Lipsync

Video dubbing with 4K lip sync

à partir de 3 crédits

OmniHuman v1.5

Photo + Audio to talking avatar

à partir de 3 crédits

Kling Avatar v2

Versatile lip sync for any character

à partir de 2 crédits

Infini Talk

Audio-driven talking avatar

à partir de 5 crédits

Foire aux questions

Puis-je synchroniser les lèvres d'une photo ou ai-je besoin d'une vidéo ?

Les deux flux de travail sont pris en charge. Sync-3 Lipsync double les vidéos existantes avec un nouvel audio jusqu'à 4K. OmniHuman v1.5, Kling Avatar v2 et Infini Talk animent une seule photo plus un fichier audio en une vidéo parlante complète.

La synchronisation labiale IA fonctionne-t-elle dans n'importe quelle langue ?

Généralement oui. Le modèle associe les sons aux formes de bouche plutôt que de comprendre les mots, il peut donc synchroniser les bouches avec la plupart des langues parlées, ce qui est pourquoi la synchronisation labiale est l'épine dorsale de la traduction vidéo et du contenu localisé.

Quelles entrées donnent les meilleurs résultats ?

Un audio de parole propre sans musique lourde et un visage qui est raisonnablement grand, de face et dégagé. Les rotations rapides de la tête, les mains sur la bouche et les angles extrêmes sont les endroits où les artefacts apparaissent.

Puis-je utiliser le visage de quelqu'un d'autre ?

Uniquement avec son consentement. La synchronisation labiale est largement utilisée pour le doublage légitime, la traduction et le contenu d'avatar, mais vous ne devriez animer que la ressemblance de personnes qui y ont consenti.

Apprendre les concepts

Outils associés