No ar · BETA
Wan 3.0: vídeo com IA tudo em um
O modelo de vídeo tudo em um de nova geração da Tongyi Wanxiang, no ar hoje no MakeFun. Um plano-sequência nativo de 30 segundos, quatro modos de geração no mesmo lugar, até 20 arquivos de referência e documentos ou páginas web lidos direto para dentro do vídeo.
O que o modelo entrega
Todos os clipes abaixo vêm das demonstrações de lançamento da própria Tongyi Wanxiang, então dá para julgar a qualidade da imagem antes de gastar qualquer coisa.
Cinco coisas que ele faz bem
Os cinco destaques e seus números são da própria Tongyi Wanxiang; os clipes são as demonstrações deles. O que você recebe no MakeFun é o retorno da sua própria geração.
Omni-criação — até 20 arquivos de uma vez
Gere com até 20 arquivos de referência em um único trabalho, incluindo a leitura de documentos e páginas web complexos — doc, xls, ppt, pdf e md são todos lidos como entrada de referência. Uma ficha técnica ou a página de um concorrente pode virar matéria-prima de um vídeo sem precisar ser reescrita antes.
30 segundos nativos, não emendados
Um plano único agora dura 30 segundos de forma nativa, o que permite narrativas mais completas e mais liberdade criativa, com um ajuste inteligente de duração que deduz o tempo a partir do seu prompt. Um clipe consegue sustentar um arco emocional inteiro, dando espaço para movimentos de câmera contínuos e planos-sequência.
Consistência pixel a pixel, feita para entrega
Ele reproduz os detalhes de referência com precisão, mirando o trabalho de produção em vez do experimento: personagens, objetos de cena, vozes, relações espaciais e estilo geral se mantêm firmes de plano em plano. Se o mesmo rosto sobrevive a um corte é o que separa uma demonstração de algo entregável.
Imagem e som em uma única passada
Realismo, textura visual e design de som avançam juntos, para um impacto audiovisual mais forte. A geração de áudio é um botão no formulário de geração, então imagem e som saem juntos — sem passada separada de trilha e sem sincronizar depois.
Edição precisa — mude uma coisa, mantenha o resto
A edição de vídeo ficou mais precisa nesta versão, com suporte a edição por instrução e por referência. Diga o que deve mudar — a imagem, a ação, uma fala — e o restante do corte permanece como estava, sem ser regerado do zero.
Escolha o modo antes das configurações
O MakeFun abre quatro modos para o Wan 3.0. O modo escolhido define o que você precisa preparar e quais configurações os seus arquivos decidem por você.
Texto para vídeo
Só prompt, sem envio de arquivos. Descreva a cena, o que a pessoa faz, como a câmera se move e o clima desejado, e o modelo constrói tudo do zero. A forma mais rápida de testar uma ideia.
Image to Video
Envie uma imagem como primeiro quadro e o modelo gera o que vem depois a partir do seu prompt. Ele também aceita o envio de áudio, então o resultado volta com som. Se você já tem um visual principal ou uma foto de produto, esse é o caminho mais curto.
Primeiro & último quadro para vídeo
Envie separadamente um quadro inicial e um final, e o modelo preenche a transição entre eles; um botão de troca inverte os dois. É a escolha segura para mudanças de expressão, mudanças de pose e transições de cena — sempre que for preciso controlar exatamente onde o plano começa e termina.
Referência para vídeo
Envie várias imagens, vídeos ou áudios de referência, ou aponte para um documento ou página web, e o Wan 3.0 lê tudo junto para guiar o resultado. Mantenha o vídeo de referência abaixo de 15 segundos no total: o sistema ajusta a saída para que entrada e saída somadas fiquem dentro de 30 segundos.
Três passos até o seu primeiro clipe
Esta é a ordem real das operações no MakeFun. Não há nada extra para ativar antes.
1. Escolha o modo
Decida primeiro se o vídeo vai ser conduzido só por um prompt, por uma imagem, por um primeiro e um último quadro ou por material de referência multimodal. Os quatro modos estão descritos acima.
2. Envie os arquivos e escreva o prompt
Adicione o que o modo exigir — imagens, vídeo, áudio ou um documento ou página web — e depois descreva a ação, o movimento de câmera e a atmosfera que você quer. O campo de prompt aceita até 5.000 caracteres, e ser específico faz diferença.
3. Ajuste os parâmetros e gere
Escolha duração e resolução e clique em gerar. O resultado aparece em My Result, de onde você pode levá-lo ao aumento de resolução, à remoção de legendas e ao resto das ferramentas.
O que dá para configurar em cada geração
Estes são os controles que o Wan 3.0 oferece hoje no MakeFun — o bastante para julgar se ele atende ao seu padrão de entrega.
| Configuração | O que você recebe |
|---|---|
| Duração | 3 s, 5 s, 10 s, 15 s ou 30 s. Padrão de 5 s. Em Referência para vídeo, a faixa disponível varia com a duração do clipe de referência enviado. |
| Resolução | 480P, 720P ou 1080P. Resoluções maiores custam mais créditos — esboçar a ideia em 480P e finalizar em 1080P é o jeito econômico de trabalhar. |
| Imagens de entrada | JPG ou PNG, com no máximo 20 MB cada, largura e altura entre 240 e 7.680 pixels. |
| Prompt | Até 5.000 caracteres. Um prompt negativo descarta elementos (“borrado, baixa qualidade, deformado”), e a expansão de prompt deixa a IA completar sua descrição. |
| Gerar áudio | Ligado por padrão; você pode desativar. |
| Número de saídas | Vários clipes a partir de um único envio. |
| Semente aleatória | Apenas no plano Ultra. Reproduz o mesmo resultado a partir das mesmas entradas. |
Quatro coisas que evitam uma segunda tentativa
Comece com bom material
Imagens e vídeos nítidos e bem compostos dão resultados melhores; material borrado ou de baixa resolução, não. A qualidade do que entra é o teto do que sai, e isso pesa mais que qualquer configuração desta página.
Nomeie a ação
Movimentos concretos no prompt — “caminha devagar”, “acena de leve com a cabeça” — são reproduzidos com muito mais precisão do que adjetivos. Palavras vagas de clima não dão nada em que o modelo possa se apoiar.
Use primeiro-e-último quadro de propósito
Esse modo foi feito para mudanças de expressão, mudanças de pose e transições de cena — sempre que o início e o fim do plano precisam ser exatos. Se você já sabe para onde o plano vai, não deixe isso por conta de um prompt de texto.
Calcule a duração das referências
Em Referência para vídeo, os clipes de referência devem somar no máximo 15 segundos, e o sistema encurta a saída para que entrada mais saída fiquem dentro de 30 segundos. Referências mais longas deixam um filme mais curto — faça essa conta antes de enviar.
Documentação e API
Quer integrar o Wan 3.0 ao seu próprio produto? Endpoints, parâmetros, autenticação e cobrança estão na documentação para desenvolvedores do MakeFun, onde também há acesso via MCP.
Por que rodar o Wan 3.0 no MakeFun
Comece grátis, sem assinatura
Gere sem plano mensal. O Wan 3.0 usa os créditos que você já tem, e não há nada extra para ativar antes do primeiro clipe.
Um só lugar para todos os modelos
Wan, Seedance, Kling, Sora, Veo, Seedream e outros ficam sob uma conta e um saldo. Rode o mesmo briefing em vários deles em vez de pagar por várias ferramentas.
Feito para entregar
Sincronia labial, clonagem de voz, troca de rosto e de cabeça, remoção de legendas e aumento de resolução ficam ao lado da geração, então um clipe vai do prompt ao material final sem sair do site.
Modelos de vídeo com IA relacionados no MakeFun
- Seedance 2.5 — o modelo multimodal profissional da ByteDance, também disponível no MakeFun. Compare os dois com o mesmo briefing.
- Wan 2.6 e Wan 2.6 Flash — a geração anterior do Wan, ainda uma opção rápida e econômica.
- Kling 2.6 e Sora 2 — outros modelos de vídeo que valem a pena testar com o mesmo prompt.
- Sincronia labial e vídeo para áudio — ferramentas de finalização para o material gerado.