MakeFun : vidéos et images par IA Télécharger sur iOS

Tutoriel : démarrer avec la plateforme MakeFun de synthèse vidéo d’humains numériques

Merci d’avoir choisi la plateforme MakeFun de synthèse vidéo d’avatars. Développée depuis 2021, la technologie MakeFun de synchro labiale et de clonage vocal vise à être la plateforme de génération d’avatars la plus simple et la plus puissante. Vous pouvez y créer votre propre avatar IA et votre voix, puis générer des vidéos de votre double numérique en tapant simplement du texte. Vous pouvez aussi utiliser des avatars et des voix prêts à l’emploi et créer des vidéos en configurant des scripts.

Connexion

  1. Connectez-vous avec votre adresse Gmail ou une autre adresse e-mail sur https://makefun.ai/app. Navigateurs recommandés : Microsoft Edge ou Chrome sur ordinateur pour une expérience optimale.

    Écran de connexion MakeFun pour démarrer la synthèse vidéo d’avatar
  2. Si vous n’avez pas encore de compte, cliquez sur « Register » pour en créer un. Si vous disposez d’un code d’invitation, reportez-vous à la section Q&R pour savoir comment le saisir.

    Écran d’inscription MakeFun pour les nouveaux utilisateurs
  3. Sur mobile, rendez-vous sur https://makefun.ai/app. Remarque : la version mobile propose moins de fonctionnalités. Privilégiez la version bureau si possible.

Créer votre première vidéo

Une fois connecté, essayez de créer une vidéo d’avatar :

  1. Ouvrez le module « Create ».

  2. Donnez un nom à votre vidéo.

  3. Saisissez le script que l’avatar doit lire.

  4. Choisissez la langue et le timbre de voix qui conviennent, puis cliquez sur « Preview Audio ».

    Écran de création de la première vidéo d’avatar avec les champs avatar, voix, langue et script
  5. Une fois l’aperçu audio validé, le bouton devient « Create Video ». Vous entendrez également la voix synthétisée de l’avatar sur votre ordinateur.

  6. Le système affiche le nombre de coins nécessaires pour générer la vidéo à partir de l’audio. Si l’aperçu et le coût vous conviennent, cliquez sur « Synthesize Video » pour lancer la génération.

    Bouton « Create Video » après l’aperçu audio de la narration de l’avatar
  7. La plateforme vous redirige vers la page des résultats, où vous pourrez télécharger la vidéo après une courte attente.

  8. Pour suivre l’avancement et retrouver les vidéos terminées, ouvrez le module « My Results ».

    Écran « My Results » affichant les vidéos d’avatar terminées

Fonctions avancées de synthèse vidéo

Choisir différents avatars

Vous pouvez sélectionner :

  • My Avatars : découvrez comment créer votre propre avatar ici.
  • Public Avatars : ils sont fournis à titre d’exemple. Remarque : ces avatars n’offrent pas nécessairement de garantie de droits d’auteur ou d’usage commercial dans votre pays.
Écran de sélection d’avatar entre My Avatars et Public Avatars

Types d’avatar : si vous cliquez sur « My Avatars », chaque avatar porte une étiquette ou .

  • Diamant : résultat de « Continue Training ». Ces avatars sont entraînés pour une synchro labiale et un réalisme de meilleure qualité. Découvrez comment utiliser « continue training » ici.
  • Éclair : résultat de « Quick Preview ». La qualité de synchro labiale est basique. Si vous avez lancé « continue training » mais que l’entraînement n’est pas terminé, vous verrez aussi. Autrement dit, seul l’avatar dont l’entraînement est terminé porte l’étiquette . Éclair convient aux avatars générés à partir d’une seule image ou aux vidéos d’entraînement sans synchronisation entre l’audio et le mouvement des lèvres.
Étiquettes de type d’avatar : Diamant pour continue training et Éclair pour quick preview

Choisir une voix

  • Choisissez une voix adaptée à votre script. MakeFun prend en charge des dizaines de langues et des centaines de timbres.
  • Vous pouvez aussi utiliser votre voix clonée pour le doublage. Découvrez comment créer votre propre voix clonée ici.
Écran de sélection entre voix publiques et voix clonées

Sous-titres automatiques

  • Pour ajouter des sous-titres à votre vidéo, activez « Caption » sous la vidéo d’avatar et réglez la police, la couleur et le fond.
  • Remarque : les sous-titres automatiques ne sont disponibles que pour les vidéos pilotées par texte, pas par audio.
Réglages des sous-titres automatiques pour la génération de vidéo d’avatar

Changer l’arrière-plan

  • Pour changer l’arrière-plan de votre vidéo d’avatar, cliquez sur « Background ». Notez que tous les avatars ne prennent pas en charge le changement d’arrière-plan. Vérifiez l’option « Background » ; si elle est indisponible, choisissez un autre avatar.
Disponibilité de l’option « Background » pour changer l’arrière-plan d’une vidéo d’avatar
  • Pour qu’un avatar personnalisé de « My Avatars » autorise le changement d’arrière-plan, configurez l’arrière-plan dès la création de l’avatar.
Réglage lors de la création de l’avatar pour activer le changement d’arrière-plan

Si l’avatar choisi prend en charge le changement d’arrière-plan, vous pourrez :

  • utiliser les images fournies par la plateforme.
  • importer votre propre image ou vidéo comme arrière-plan.
Réglage lors de la création de l’avatar pour activer le changement d’arrière-plan

Créer vos avatars personnalisés à partir de vidéos

Créer des avatars personnalisés en important une vidéo de base

MakeFun vous permet de créer un avatar à partir d’un court extrait vidéo (appelé vidéo de base) ou d’une image. Cette section explique comment importer une courte vidéo de base d’une personne réelle, qui servira de données d’entraînement pour générer vos vidéos d’avatar IA personnalisées. La vidéo de base détermine la résolution, le mouvement des lèvres, les gestes, les vêtements et les accessoires des futures vidéos. Pour des avatars de qualité, la vidéo de base doit respecter certaines exigences. Si vous souhaitez utiliser API, lisez cette section pour comprendre la signification de chaque paramètre de l’API. Nous proposons deux types d’entraînement pour obtenir « My Avatars » :

  • « Quick Preview  » : l’entraînement se termine généralement en moins d’une minute. Ce processus est gratuit (aucun diamant consommé). C’est la seule option adaptée aux avatars générés à partir d’une seule image ou aux vidéos d’entraînement sans synchronisation audio-lèvres. Le résultat portera l’étiquette .
  • « Continue Training  » : l’entraînement se termine généralement en moins de 60 minutes. Ce processus coûte 1 . Le résultat de « continue training » offre en général une synchro labiale bien meilleure que « Quick Preview ». Il portera l’étiquette . Pour lancer « continue training », importez d’abord une vidéo de base et effectuez un « quick preview », puis cliquez sur icône de l’icône de l’avatar. Vous verrez ensuite « Continue Training  » : cliquez dessus. Patientez environ 60 minutes. À la fin, l’icône de l’avatar portera l’étiquette dans le module « Create ».
Option « Continue Training » pour améliorer la qualité d’un avatar personnalisé

Étapes pour créer un avatar personnalisé à partir de vidéos

  1. Dans le module « Add Avatars », importez une vidéo conforme aux exigences

    • Nom : donnez un nom à votre avatar.
    • Genre : choisissez-le d’après la vidéo. Cela influence légèrement le résultat de la synchro labiale.
    • Matériau d’origine : choisissez Video pour le clonage.
    • Arrière-plan d’origine : si vous souhaitez supprimer l’arrière-plan, importez une image de fond. Découvrez comment capturer l’image de fond.
  2. Cliquez sur « Quick Preview » pour lancer le clonage en mode instantané.

  3. Après l’entraînement, retrouvez l’avatar dans « My Avatars » et utilisez-le pour créer des vidéos.

  4. Pour une meilleure qualité, cliquez sur l’ icône de l’icône de l’avatar, puis sur « Continue Training » dans la fenêtre qui s’ouvre.

Créer vos avatars personnalisés à partir d’images

MakeFun vous permet de créer un avatar à partir d’un court extrait vidéo (appelé vidéo de base) ou d’une image. Cette section explique comment utiliser l’image d’une personne réelle comme données d’entraînement pour générer vos vidéos d’avatar IA personnalisées. En mode image, « continue training » n’est pas possible. Après un clic sur « Quick Preview  », l’entraînement se termine généralement en moins d’une minute. Ce processus coûte 1 . Pour les avatars générés à partir d’images, « continue training » n’est ensuite ni nécessaire ni possible.

Écran de création d’avatar à partir d’une seule image

Étapes pour créer un avatar personnalisé à partir d’images

  1. Dans le module « Add Avatars », importez une vidéo conforme aux exigences

    • Nom : donnez un nom à votre avatar.
    • Genre : choisissez-le d’après la vidéo. Cela influence légèrement le résultat de la synchro labiale.
    • Matériau d’origine : choisissez Image mode de clonage.
    • Arrière-plan d’origine : si vous souhaitez supprimer l’arrière-plan, importez une image de fond.
  2. Cliquez sur « Quick Preview » pour lancer le clonage en mode instantané.

  3. Après l’entraînement, retrouvez l’avatar dans « My Avatars » et utilisez-le pour créer des vidéos.

Utiliser votre propre voix

MakeFun vous permet de créer une voix personnalisée à partir d’un court extrait audio. Notez que notre système détecte automatiquement les voix de personnalités publiques et de célébrités. Si votre envoi enfreint nos conditions d’utilisation, la voix sera désactivée et votre compte pourra être suspendu.

Écran de configuration du clonage vocal pour créer une voix personnalisée
  1. Cliquez d’abord sur Voice Clonepuis définissez le nom de la voix et sélectionnez le genre.

  2. (a) Importez un extrait audio et cliquez sur Start Training. Découvrez comment obtenir un enregistrement audio de qualité. (b) Si vous n’avez pas d’extrait sous la main, vous pouvez enregistrer directement sur notre page. Cliquez sur Start Recordingchoisissez un script adapté à votre usage, puis cliquez sur l’ icône pour démarrer. L’enregistrement doit durer entre 15 et 20 secondes. Une fois cette durée atteinte, cliquez sur Stop pour finaliser l’enregistrement.

  3. Les résultats sont généralement prêts en moins d’une minute et s’affichent dans le panneau de droite. La voix clonée se sélectionne dans la section Voices du module Create Dans le menu déroulant, votre voix clonée apparaît dans la section Voice Clone correspondante.

    Écran d’enregistrement audio pour les échantillons d’entraînement du clonage vocal

FAQ

Q : Comment obtenir une « Base Video » de qualité ?

Recommandations d’éclairage :

  • Utilisez un éclairage de portrait en studio, avec au moins une source frontale et un contre-jour (pour détourer la silhouette).
  • Avec un fond vert, gardez la personne à au moins 2 mètres du fond pour un détourage optimal.
  • Évitez les vêtements et accessoires qui reflètent la lumière verte.

Recommandations sur le bruit ambiant :

  • Veillez à ce que le bruit de fond reste sous 45 dB, sans écho ni réverbération.
  • Évitez le bruit de la climatisation et des ventilateurs d’ordinateur. Nous recommandons de couper la climatisation pendant la prise de vue.
  • Vérifiez toujours votre microphone avant d’enregistrer.

Recommandations pour la caméra :

  • Un reflex capable de filmer à au moins 30 FPS est recommandé. La plupart de nos avatars publics ont été filmés avec un Sony A7S3 ou A7M4.
  • Résolution : 2K à 30 ips (ou plus si la haute définition est nécessaire). MakeFun prend en charge 4K au maximum.
  • Format : sans HDR. MakeFun sait décoder la vidéo HDR de base, mais ce n’est pas recommandé.
  • Objectif : Pour le portrait, utilisez un 40 ou 50 mm (par exemple une focale fixe 50 mm F1.8). Ouverture F1.8–F2.5, vitesse d’obturation d’au plus 1/100 et ISO sous 800. Ajustez selon la lumière réelle.
  • Selon votre matériel, utilisez d’autres appareils — ordinateur, carte d’acquisition, prompteur — pour couvrir vos besoins d’enregistrement.

Recommandations pour le microphone :

  • Privilégiez les micros-cravates (à pince). Évitez de placer le micro trop loin de la personne.
  • Le micro doit être relié à la caméra pour une synchronisation optimale.
  • La vidéo enregistrée doit contenir l’audio enregistré, parfaitement synchronisé avec l’image.

Jeu du modèle :

  • La caméra doit capter clairement le visage du sujet.
  • Le modèle doit parler en continu et peut regarder un prompteur. Le prompteur doit être aligné avec la caméra.
  • La personne peut préparer son propre texte ou utiliser un support simple : poèmes connus, chiffres, lettres. Parlez distinctement et assez fort. Les erreurs occasionnelles n’ont pas d’importance : ne vous y attardez pas, concentrez-vous sur l’émotion et l’expression du visage.
  • Restez dans le cadre et ne masquez pas le visage. Les gestes généraux (légers mouvements de mains, hochements de tête) sont bienvenus ; évitez les gestes porteurs de sens, comme approuver ou désapprouver.
  • Les mouvements ne doivent être ni trop amples ni trop fréquents, et ne doivent pas masquer le visage.
  • Les mouvements des lèvres peuvent être légèrement plus marqués que dans une élocution naturelle.
  • Toutes les actions filmées apparaîtront dans le résultat généré, dans le même ordre.
  • Les lunettes à monture sont acceptées

Pour activer le changement d’arrière-plan :

  • Si un remplacement d’arrière-plan est nécessaire, filmez 1 à 2 secondes de « plan vide » sans personne dans le cadre. Importez ensuite une capture de ce plan vide comme Original Background lors de l’étape « Add Avatars ».
  • L’image de fond n’a pas besoin d’être un fond vert. Notre algorithme accepte n’importe quel arrière-plan, à condition qu’il corresponde parfaitement à celui de la vidéo d’avatar.
  • Si vous filmez le modèle sur fond vert, évitez les vêtements verts ou bleus, sous peine de problèmes de détourage.

Exigences relatives au matériau :

  • La vidéo source doit durer entre 30 secondes et 5 minutes.
  • La vidéo doit contenir de la parole, parfaitement synchronisée avec le mouvement des lèvres.
  • Un seul visage doit apparaître dans la vidéo.
  • Aucun bruit ambiant ni autre son (hormis la parole du sujet) n’est admis.
  • Gardez un débit de parole modéré.
  • Un débit trop lent peut réduire la précision de la synchro labiale.
  • Un débit trop rapide peut déformer la synchro labiale.
Q : Comment enregistrer un « Base Audio » de qualité ?

Durée de l’audio : 15 à 60 secondes.

Exigences relatives à l’environnement :

  • Le bruit de fond doit rester sous 45 dB, sans écho ni réverbération.
  • Faites des essais de son avant d’enregistrer.

Exigences relatives au matériel :

  • Utilisez un micro à condensateur directionnel (par exemple cardioïde).

Exigences relatives à l’enregistrement :

  • Enregistrez un audio dont le timbre et l’intention correspondent à l’usage visé (ce ton se retrouvera dans l’audio synthétisé).
  • Ne placez pas le micro trop près de la bouche, pour éviter les plosives.
  • En cas d’erreur, passez à la phrase suivante plutôt que de tout recommencer.
  • Veillez à désactiver la réverbération et n’appliquez aucun post-traitement au fichier audio d’origine.

Paramètres d’enregistrement :

  • Fréquence d’échantillonnage : 48 kHz
  • Profondeur : 16 bits
  • Canal : mono
  • Après normalisation, le gain doit dépasser 0,4.

Logiciel recommandé : Adobe Audition.