Disponible · BÊTA
Wan 3.0 : la vidéo IA tout-en-un
Le modèle vidéo tout-en-un nouvelle génération de Tongyi Wanxiang, disponible dès aujourd’hui sur MakeFun. Un plan-séquence natif de 30 secondes, quatre modes de génération réunis, jusqu’à 20 éléments de référence, et des documents ou pages web lus directement dans la vidéo.
Ce que le modèle produit
Tous les clips ci-dessous proviennent des démos de lancement de Tongyi Wanxiang : vous pouvez donc juger la qualité d’image avant de dépenser quoi que ce soit.
Cinq points forts
Les cinq annonces et leurs chiffres viennent de Tongyi Wanxiang ; les clips sont leurs démos. Ce que vous obtenez sur MakeFun, c’est le résultat de votre propre génération.
Omni-création — jusqu’à 20 éléments à la fois
Générez avec jusqu’à 20 éléments de référence en une seule tâche, y compris l’analyse de documents et de pages web complexes : doc, xls, ppt, pdf et md sont tous lus comme entrée de référence. Une fiche produit ou la page d’un concurrent peut devenir la matière première d’une vidéo, sans réécriture préalable.
30 secondes natives, sans assemblage
Un plan unique dure désormais 30 secondes en natif, ce qui permet une narration plus complète et plus de liberté créative, avec un réglage intelligent de durée qui déduit la longueur de votre prompt. Un seul clip peut porter un arc émotionnel entier : les mouvements de caméra continus et les plans-séquences ont enfin la place de s’exprimer.
Une cohérence au pixel près, pensée pour la livraison
Il reproduit fidèlement les détails de référence, avec la production en ligne de mire plutôt que l’expérimentation : personnages, accessoires, voix, relations spatiales et style global restent stables d’un plan à l’autre. Qu’un même visage survive à une coupe, c’est ce qui sépare une démo d’un livrable.
Image et son en une seule passe
Réalisme, texture visuelle et design sonore progressent ensemble, pour un impact audiovisuel plus fort. La génération audio est une simple option du formulaire : image et son sortent ensemble — sans passe de sonorisation séparée ni synchronisation a posteriori.
Montage précis — changez un élément, gardez le reste
Le montage vidéo gagne en précision dans cette version, avec la prise en charge de l’édition par instruction et par référence. Indiquez ce qui doit changer — l’image, l’action, une réplique — et le reste du plan reste tel quel au lieu d’être régénéré de zéro.
Choisissez le mode avant les réglages
MakeFun ouvre quatre modes pour Wan 3.0. Votre choix détermine ce que vous devez préparer et les réglages que vos éléments décident à votre place.
Texte vers vidéo
Un prompt, rien à importer. Décrivez la scène, ce que fait le sujet, le mouvement de caméra et l’ambiance recherchée : le modèle construit tout à partir de rien. La façon la plus rapide de tester une idée.
Image to Video
Importez une image comme première image et le modèle génère la suite à partir de votre prompt. Il accepte aussi un import audio, si bien que le résultat revient avec le son. Si vous avez déjà un visuel clé ou une photo produit, c’est le chemin le plus court.
Première & dernière image vers vidéo
Importez séparément une image de début et une image de fin : le modèle comble la transition entre les deux, et un bouton d’échange les inverse. C’est le choix sûr pour les changements d’expression, de pose et les transitions de scène — dès que vous devez contrôler précisément où le plan commence et se termine.
Référence vers vidéo
Importez plusieurs images, vidéos ou extraits audio de référence, ou pointez vers un document ou une page web : Wan 3.0 les lit ensemble pour orienter le résultat. Gardez la vidéo de référence sous 15 secondes au total — le système ajuste la sortie pour que l’entrée et la sortie tiennent ensemble dans 30 secondes.
Trois étapes jusqu’à votre premier clip
Voici l’ordre réel des opérations sur MakeFun. Rien d’autre à activer au préalable.
1. Choisissez le mode
Déterminez d’abord si la vidéo sera guidée par un prompt seul, une image, une première et une dernière image, ou des références multimodales. Les quatre modes sont décrits ci-dessus.
2. Importez et rédigez le prompt
Ajoutez ce que le mode réclame — images, vidéo, audio, document ou page web — puis décrivez l’action, le mouvement de caméra et l’atmosphère souhaitée. Le champ de prompt accepte jusqu’à 5 000 caractères, et la précision paie.
3. Réglez les paramètres et générez
Choisissez la durée et la résolution, puis lancez la génération. Le résultat arrive dans My Result, d’où vous pouvez l’envoyer vers l’agrandissement, la suppression de sous-titres et le reste de la boîte à outils.
Ce que vous pouvez régler à chaque génération
Voici les réglages que Wan 3.0 propose aujourd’hui sur MakeFun — de quoi juger s’il passe votre exigence de livraison.
| Réglage | Ce que vous obtenez |
|---|---|
| Durée | 3 s, 5 s, 10 s, 15 s ou 30 s. 5 s par défaut. En Référence vers vidéo, la plage disponible varie selon la durée du clip de référence importé. |
| Résolution | 480p, 720p ou 1080p. Plus haut coûte plus de crédits — dégrossir l’idée en 480p et finaliser en 1080p, c’est la façon économique de travailler. |
| Images d’entrée | JPG ou PNG, 20 Mo maximum chacune, largeur et hauteur comprises entre 240 et 7 680 pixels. |
| Prompt | Jusqu’à 5 000 caractères. Un prompt négatif exclut certains éléments (« flou, basse qualité, déformé »), et l’expansion de prompt laisse l’IA étoffer votre description. |
| Générer l’audio | Activé par défaut, désactivable. |
| Nombre de sorties | Plusieurs clips à partir d’une seule demande. |
| Graine aléatoire | Formule Ultra uniquement. Reproduit le même résultat à partir des mêmes entrées. |
Quatre réflexes qui évitent une seconde tentative
Partez d’un bon matériau
Des images et vidéos nettes et bien composées donnent de meilleurs résultats ; un matériau flou ou peu défini, non. La qualité de l’entrée plafonne celle de la sortie, et cela compte plus que n’importe quel réglage de cette page.
Nommez l’action
Les mouvements concrets dans le prompt — « marche lentement », « hoche doucement la tête » — sont bien plus fidèlement rendus que des adjectifs. Les mots d’ambiance vagues ne donnent aucune prise au modèle.
Utilisez première-et-dernière image à bon escient
Ce mode est conçu pour les changements d’expression, de pose et les transitions de scène — partout où le début et la fin du plan doivent être exacts. Si vous savez déjà où va le plan, ne le confiez pas à un prompt textuel.
Anticipez la durée des références
En Référence vers vidéo, les clips de référence doivent totaliser 15 secondes au plus, et le système raccourcit la sortie pour que l’entrée et la sortie tiennent dans 30 secondes. Des références plus longues vous laissent un film plus court — faites ce calcul avant d’importer.
Docs et API
Vous voulez intégrer Wan 3.0 à votre propre produit ? Endpoints, paramètres, authentification et facturation se trouvent dans la documentation développeur de MakeFun, où l’accès MCP est également disponible.
Pourquoi utiliser Wan 3.0 sur MakeFun
Démarrez gratuitement, sans abonnement
Générez sans formule mensuelle. Wan 3.0 fonctionne avec vos crédits existants, et il n’y a rien à activer avant votre premier clip.
Un seul endroit pour tous les modèles
Wan, Seedance, Kling, Sora, Veo, Seedream et d’autres tiennent dans un seul compte et un seul solde. Passez le même brief dans plusieurs d’entre eux au lieu de payer plusieurs outils.
Pensé pour la livraison
Synchro labiale, clonage vocal, échange de visage et de tête, suppression de sous-titres et agrandissement voisinent avec la génération : un clip passe du prompt au livrable sans quitter le site.
Modèles vidéo IA associés sur MakeFun
- Seedance 2.5 — le modèle multimodal professionnel de ByteDance, également disponible sur MakeFun. Comparez les deux sur le même brief.
- Wan 2.6 et Wan 2.6 Flash — la génération Wan précédente, toujours rapide et économique.
- Kling 2.6 et Sora 2 — d’autres modèles vidéo à essayer avec le même prompt.
- Synchro labiale et vidéo vers audio — des outils de finition pour vos rushes générés.