MakeFun: vídeos e imagens com IA Baixar no iOS

No ar · BETA

Wan 3.0: vídeo com IA tudo em um

O modelo de vídeo tudo em um de nova geração da Tongyi Wanxiang, no ar hoje no MakeFun. Um plano-sequência nativo de 30 segundos, quatro modos de geração no mesmo lugar, até 20 arquivos de referência e documentos ou páginas web lidos direto para dentro do vídeo.

O que o modelo entrega

Todos os clipes abaixo vêm das demonstrações de lançamento da própria Tongyi Wanxiang, então dá para julgar a qualidade da imagem antes de gastar qualquer coisa.

Cinco coisas que ele faz bem

Os cinco destaques e seus números são da própria Tongyi Wanxiang; os clipes são as demonstrações deles. O que você recebe no MakeFun é o retorno da sua própria geração.

Omni-criação — até 20 arquivos de uma vez

Gere com até 20 arquivos de referência em um único trabalho, incluindo a leitura de documentos e páginas web complexos — doc, xls, ppt, pdf e md são todos lidos como entrada de referência. Uma ficha técnica ou a página de um concorrente pode virar matéria-prima de um vídeo sem precisar ser reescrita antes.

30 segundos nativos, não emendados

Um plano único agora dura 30 segundos de forma nativa, o que permite narrativas mais completas e mais liberdade criativa, com um ajuste inteligente de duração que deduz o tempo a partir do seu prompt. Um clipe consegue sustentar um arco emocional inteiro, dando espaço para movimentos de câmera contínuos e planos-sequência.

Consistência pixel a pixel, feita para entrega

Ele reproduz os detalhes de referência com precisão, mirando o trabalho de produção em vez do experimento: personagens, objetos de cena, vozes, relações espaciais e estilo geral se mantêm firmes de plano em plano. Se o mesmo rosto sobrevive a um corte é o que separa uma demonstração de algo entregável.

Imagem e som em uma única passada

Realismo, textura visual e design de som avançam juntos, para um impacto audiovisual mais forte. A geração de áudio é um botão no formulário de geração, então imagem e som saem juntos — sem passada separada de trilha e sem sincronizar depois.

Edição precisa — mude uma coisa, mantenha o resto

A edição de vídeo ficou mais precisa nesta versão, com suporte a edição por instrução e por referência. Diga o que deve mudar — a imagem, a ação, uma fala — e o restante do corte permanece como estava, sem ser regerado do zero.

Escolha o modo antes das configurações

O MakeFun abre quatro modos para o Wan 3.0. O modo escolhido define o que você precisa preparar e quais configurações os seus arquivos decidem por você.

Texto para vídeo

Só prompt, sem envio de arquivos. Descreva a cena, o que a pessoa faz, como a câmera se move e o clima desejado, e o modelo constrói tudo do zero. A forma mais rápida de testar uma ideia.

Image to Video

Envie uma imagem como primeiro quadro e o modelo gera o que vem depois a partir do seu prompt. Ele também aceita o envio de áudio, então o resultado volta com som. Se você já tem um visual principal ou uma foto de produto, esse é o caminho mais curto.

Primeiro & último quadro para vídeo

Envie separadamente um quadro inicial e um final, e o modelo preenche a transição entre eles; um botão de troca inverte os dois. É a escolha segura para mudanças de expressão, mudanças de pose e transições de cena — sempre que for preciso controlar exatamente onde o plano começa e termina.

Referência para vídeo

Envie várias imagens, vídeos ou áudios de referência, ou aponte para um documento ou página web, e o Wan 3.0 lê tudo junto para guiar o resultado. Mantenha o vídeo de referência abaixo de 15 segundos no total: o sistema ajusta a saída para que entrada e saída somadas fiquem dentro de 30 segundos.

Três passos até o seu primeiro clipe

Esta é a ordem real das operações no MakeFun. Não há nada extra para ativar antes.

1. Escolha o modo

Decida primeiro se o vídeo vai ser conduzido só por um prompt, por uma imagem, por um primeiro e um último quadro ou por material de referência multimodal. Os quatro modos estão descritos acima.

2. Envie os arquivos e escreva o prompt

Adicione o que o modo exigir — imagens, vídeo, áudio ou um documento ou página web — e depois descreva a ação, o movimento de câmera e a atmosfera que você quer. O campo de prompt aceita até 5.000 caracteres, e ser específico faz diferença.

3. Ajuste os parâmetros e gere

Escolha duração e resolução e clique em gerar. O resultado aparece em My Result, de onde você pode levá-lo ao aumento de resolução, à remoção de legendas e ao resto das ferramentas.

O que dá para configurar em cada geração

Estes são os controles que o Wan 3.0 oferece hoje no MakeFun — o bastante para julgar se ele atende ao seu padrão de entrega.

Configuração O que você recebe
Duração 3 s, 5 s, 10 s, 15 s ou 30 s. Padrão de 5 s. Em Referência para vídeo, a faixa disponível varia com a duração do clipe de referência enviado.
Resolução 480P, 720P ou 1080P. Resoluções maiores custam mais créditos — esboçar a ideia em 480P e finalizar em 1080P é o jeito econômico de trabalhar.
Imagens de entrada JPG ou PNG, com no máximo 20 MB cada, largura e altura entre 240 e 7.680 pixels.
Prompt Até 5.000 caracteres. Um prompt negativo descarta elementos (“borrado, baixa qualidade, deformado”), e a expansão de prompt deixa a IA completar sua descrição.
Gerar áudio Ligado por padrão; você pode desativar.
Número de saídas Vários clipes a partir de um único envio.
Semente aleatória Apenas no plano Ultra. Reproduz o mesmo resultado a partir das mesmas entradas.

Quatro coisas que evitam uma segunda tentativa

Comece com bom material

Imagens e vídeos nítidos e bem compostos dão resultados melhores; material borrado ou de baixa resolução, não. A qualidade do que entra é o teto do que sai, e isso pesa mais que qualquer configuração desta página.

Nomeie a ação

Movimentos concretos no prompt — “caminha devagar”, “acena de leve com a cabeça” — são reproduzidos com muito mais precisão do que adjetivos. Palavras vagas de clima não dão nada em que o modelo possa se apoiar.

Use primeiro-e-último quadro de propósito

Esse modo foi feito para mudanças de expressão, mudanças de pose e transições de cena — sempre que o início e o fim do plano precisam ser exatos. Se você já sabe para onde o plano vai, não deixe isso por conta de um prompt de texto.

Calcule a duração das referências

Em Referência para vídeo, os clipes de referência devem somar no máximo 15 segundos, e o sistema encurta a saída para que entrada mais saída fiquem dentro de 30 segundos. Referências mais longas deixam um filme mais curto — faça essa conta antes de enviar.

Documentação e API

Quer integrar o Wan 3.0 ao seu próprio produto? Endpoints, parâmetros, autenticação e cobrança estão na documentação para desenvolvedores do MakeFun, onde também há acesso via MCP.

Por que rodar o Wan 3.0 no MakeFun

Comece grátis, sem assinatura

Gere sem plano mensal. O Wan 3.0 usa os créditos que você já tem, e não há nada extra para ativar antes do primeiro clipe.

Um só lugar para todos os modelos

Wan, Seedance, Kling, Sora, Veo, Seedream e outros ficam sob uma conta e um saldo. Rode o mesmo briefing em vários deles em vez de pagar por várias ferramentas.

Feito para entregar

Sincronia labial, clonagem de voz, troca de rosto e de cabeça, remoção de legendas e aumento de resolução ficam ao lado da geração, então um clipe vai do prompt ao material final sem sair do site.

Modelos de vídeo com IA relacionados no MakeFun

  • Seedance 2.5 — o modelo multimodal profissional da ByteDance, também disponível no MakeFun. Compare os dois com o mesmo briefing.
  • Wan 2.6 e Wan 2.6 Flash — a geração anterior do Wan, ainda uma opção rápida e econômica.
  • Kling 2.6 e Sora 2 — outros modelos de vídeo que valem a pena testar com o mesmo prompt.
  • Sincronia labial e vídeo para áudio — ferramentas de finalização para o material gerado.