Diga quem ou o que está em cena e acrescente dois ou três detalhes visíveis: idade, roupa, material, cor. “Uma enfermeira cansada de pijama cirúrgico verde-água” dá ao modelo muito mais pistas do que “uma pessoa”. Deixe um único protagonista por clipe para que o olhar saiba onde ficar.
IAllegro
Gerador de vídeo a partir de texto com IA
Descreva uma cena com suas palavras e receba um clipe de vídeo. Este gerador de texto para vídeo permite escolher entre MiniMax H3, Wan 3.0 e Seedance 2.5, definir duração, resolução e formato e ver quantos créditos vai gastar antes de enviar. Abaixo do gerador você encontra como escrever um prompt que um modelo de vídeo consegue seguir, como escolher o modelo de acordo com a cena e como testar ideias sem gastar muito.
Modelo atualMiniMax H3
Andante
Os três modelos lado a lado
Tudo é ajustado no gerador acima. As faixas mudam de um modelo para outro, então compare com o que a sua cena precisa. Nenhum dos três é a escolha certa para todo clipe.
- Entrada
- Um prompt escrito de até 5.000 caracteres. O padrão é começar pelo texto; se preferir partir de uma imagem, dá para adicionar um primeiro quadro ou imagens de referência.
- Modelos
- MiniMax H3, Wan 3.0 e Seedance 2.5, trocados no seletor de modelo desta página.
- Duração
- MiniMax H3: de 4 a 15 segundos. Wan 3.0: de 2 a 30 segundos. Seedance 2.5: de 4 a 15 segundos.
- Resolução
- MiniMax H3: 768P ou 2K. Wan 3.0: 480P, 720P ou 1080P. Seedance 2.5: 480p, 720p ou 1080p.
- Formato
- 16:9, 9:16, 1:1, 4:3 e 3:4 nos três. 21:9 no MiniMax H3 e no Seedance 2.5. Uma opção adaptativa no Wan 3.0 e no Seedance 2.5.
- Som
- O MiniMax H3 sempre gera uma trilha estéreo junto com a imagem. No Wan 3.0 e no Seedance 2.5 o áudio pode ser desligado para sair um clipe sem som.
- Custo
- Pago em créditos. O número no botão Gerar muda assim que você troca o modelo, a duração ou a resolução, então você sabe o preço antes de enviar.
- Falhas
- Se uma geração falhar, os créditos dela são devolvidos automaticamente.
- Seus vídeos
- Ficam salvos no Histórico da sua conta. Para gerar, é preciso entrar na conta.
Adagio
Seis coisas que um prompt de texto para vídeo precisa dizer
Um modelo de vídeo só tem o que você escreve. O que ficar de fora, ele decide sozinho, e essa decisão raramente bate com a imagem que você tem na cabeça. Cobrindo estas seis partes, mais ou menos nesta ordem, uma cena recebe tudo de que precisa.
Scherzo
Do primeiro rascunho ao clipe final
Toda geração custa créditos, então vale achar os problemas em rascunhos baratos e só pagar pela duração completa e pela alta resolução quando o prompt já estiver funcionando.
Entre na conta e escolha um modelo
Depois de entrar, escolha MiniMax H3, Wan 3.0 ou Seedance 2.5 pelo que a cena pede: quanto tempo dura, quanta nitidez precisa, qual formato usa e se você quer som gerado. As faixas de cada modelo estão na tabela comparativa mais acima.
Escreva um único parágrafo
Junte as seis partes em poucas frases simples, começando pelo protagonista. O campo aceita até 5.000 caracteres, mas um clipe de poucos segundos não mostra uma página inteira de detalhes: gaste as palavras com o que o espectador vai ver e ouvir de verdade. Texto basta; imagens são opcionais.
Gere um rascunho barato
Escolha a menor duração e a resolução mais baixa que o modelo permite, por exemplo 480P no Wan 3.0 ou no Seedance 2.5, ou 768P no MiniMax H3, e veja o número do botão Gerar cair. Um rascunho já basta para avaliar enquadramento, movimento e clima.
Mude uma coisa por tentativa
Se a câmera ficou errada, reescreva só a frase da câmera; se a luz ficou chapada, mexa só na luz. Mudar tudo de uma vez esconde qual alteração fez diferença. Todo resultado fica no Histórico, então dá para voltar e comparar versões antes de fechar o texto final.
Gere a versão final
Quando um rascunho estiver certo, aumente a duração e a resolução e gere de novo. A versão final é uma geração nova, não uma ampliação do rascunho, então espere pequenas diferenças; um clipe mais longo também pode pedir mais um momento na ação. Se algo falhar, os créditos voltam sozinhos.
Adagio
Qual modelo combina com cada trabalho
Nenhum modelo aqui serve para tudo. Comece pelo que o clipe pronto precisa fazer e depois veja quais limites combinam com isso.
Adagio
Um prompt, parte por parte
Aqui vai um exemplo escrito para esta página, seguido do motivo de cada trecho. Aproveite a estrutura, não as palavras, e coloque o seu próprio protagonista.
Coda
Perguntas frequentes sobre texto para vídeo
Respostas rápidas sobre prompts, modelos, créditos e resultados nesta página.
01O que um gerador de vídeo a partir de texto faz, na prática?
Ele lê uma descrição escrita e gera um clipe curto que tenta corresponder a ela: o protagonista, o movimento, o cenário, a câmera e, nos modelos com áudio, o som. O clipe é gerado do zero, não montado a partir de imagens já gravadas; é por isso que a forma de escrever o prompt pesa tanto no resultado.
02Qual dos três modelos devo usar?
Depende do clipe, não de um ranking. Mais de 15 segundos? O Wan 3.0 vai até 30. Precisa de 21:9? MiniMax H3 ou Seedance 2.5. Quer som sempre? O MiniMax H3 sempre adiciona uma trilha estéreo. Quer sem som? Wan 3.0 ou Seedance 2.5 com o áudio desligado. Precisa de 2K? MiniMax H3.
03Qual deve ser o tamanho do prompt?
O campo aceita até 5.000 caracteres, mas uma única cena costuma ficar bem descrita em três a seis frases. Palavras a mais não aumentam o tempo de tela: um clipe de poucos segundos só consegue mostrar uma certa quantidade de coisas. Se o prompt não para de crescer, provavelmente há duas cenas nele, que funcionam melhor como duas gerações.
04Quantos créditos custa um vídeo?
Depende do modelo, da duração e da resolução escolhidos. O custo é atualizado quando você muda essas opções e aparece no botão Gerar antes do envio. Rascunhos curtos e em baixa resolução são os mais baratos, por isso funcionam tão bem como testes.
05O que acontece se uma geração falhar?
Os créditos daquela geração são devolvidos automaticamente, sem você precisar pedir nada. Um pedido pode falhar quando o modelo recusa o conteúdo do prompt ou quando acontece um erro temporário do lado dele. Se o mesmo prompt falhar duas vezes, reescreva a parte com mais chance de ser recusada e tente de novo.
06Por que meu vídeo não ficou parecido com o que escrevi?
As causas mais comuns são ações demais para a duração do clipe, instruções de câmera que se contradizem, palavras vagas como “lindo” ou “épico” sem nada concreto por trás, ou dois protagonistas disputando a imagem. Volte para um protagonista e uma ação, gere um rascunho curto e depois acrescente detalhes.
07Os vídeos têm som?
No MiniMax H3, sempre: todo clipe vem com uma trilha estéreo gerada. O Wan 3.0 e o Seedance 2.5 também podem gerar áudio, e os dois têm uma chave para desligá-lo quando você quer um clipe sem som para colocar sua própria música ou narração.
08Posso começar por uma imagem em vez de texto?
Pode. Aqui o texto é o padrão, mas a mesma página também aceita um primeiro quadro ou imagens de referência. Se o seu projeto parte principalmente de imagens, como animar a foto de um produto, as páginas dos modelos indicadas acima explicam esses fluxos com mais detalhes.
09Onde ficam salvos os meus vídeos?
Os vídeos prontos ficam no Histórico da sua conta, então você pode voltar a eles depois e comparar os rascunhos com a versão final. Para gerar, é preciso entrar na conta, porque os créditos e o Histórico estão ligados a ela.
10A Sonata AI tem vínculo com a MiniMax, a Alibaba ou a ByteDance?
Não. A Sonata AI é uma plataforma independente e não tem vínculo com a MiniMax, a Alibaba nem a ByteDance. MiniMax H3, Wan 3.0 e Seedance 2.5 são citados só para identificar os modelos que você pode usar aqui; esses nomes são marcas dos seus respectivos donos.