MiniMax H3 • Vídeo multimodal com IA em 2K

Crie vídeos cinematográficos com IA no MiniMax H3

Imagem para vídeo

Conteúdo de entrada

Imagem do quadro inicial

Imagem do primeiro quadro obrigatória

Configurações de geração

Hailuo 2.3 Pro

Custo estimado36 créditos

Modelo

Hailuo 2.3 Pro

Modo de geração

Primeiro quadro para vídeo

Duração

6s

Resolução

768P

Créditos

36 créditos

Comprar créditos

Gerado

MiniMax H3
Veja como pode ficar um vídeo com IA. Seu próprio resultado aparecerá aqui quando estiver pronto.

As configurações de geração usam atualmente os modelos da família Hailuo disponíveis neste workspace; a opção MiniMax H3 chegará quando o catálogo for atualizado.

Geração de vídeo multimodal com o MiniMax H3

Crie cenas mais fáceis de controlar com o MiniMax H3

O MiniMax H3 é um modelo de vídeo multimodal aberto e de uso geral, criado para geração e edição. Ele combina prompts com referências de imagem, vídeo e áudio, mantém a direção visual pelos quadros inicial e final e entrega vídeos em 2K de 5 a 15 segundos, com espaço para desenvolver uma ação completa.

Um modelo multimodal, várias formas de criar

Comece com texto, um quadro inicial, um par de quadros inicial e final ou referências visuais e sonoras. O MiniMax H3 pode gerar uma nova cena, desenvolver uma ideia visual ou editar um vídeo existente, preservando o elemento principal, o movimento e a atmosfera.

Leia a documentação oficial do MiniMax H3

Dirija cada cena com referências mais ricas

Defina o arco visual com quadros inicial e final ou combine até 9 imagens, 3 vídeos e 3 arquivos de áudio em um conjunto de no máximo 12 arquivos. O MiniMax H3 interpreta esses sinais em conjunto para que a identidade dos personagens, a direção de câmera, o ritmo e a atmosfera se reforcem entre si.

Modos de geração para qualquer ponto de partida

O MiniMax H3 se adapta ao material que você já tem, desde uma ideia escrita até um vídeo completo que precisa de uma edição específica.

01

Gere a partir de um prompt para explorar do zero uma nova cena, ação, movimento de câmera ou estilo visual.

02

Use o quadro inicial para fixar a composição, o final para guiar o encerramento ou ambos para uma transição mais intencional.

03

Reúna referências de imagem, vídeo e áudio em um único briefing ou edite um vídeo existente sem perder a direção criativa essencial.

Um fluxo de trabalho prático com o MiniMax H3

Um briefing objetivo ajuda o modelo a transformar contexto multimodal em movimento coerente. Comece pela referência mais importante e adicione apenas os sinais que realmente melhoram a cena.

  1. 1Escolha texto para vídeo, geração guiada por quadros, geração por referências ou edição de vídeo conforme o material desejado.
  2. 2Descreva uma ação clara do objeto, o movimento da câmera, a iluminação, a atmosfera e como a cena deve terminar.
  3. 3Defina uma duração de 5–15 segundos, gere a cena e altere uma única variável por vez para manter um objetivo claro em cada tentativa.

Casos de uso do MiniMax H3

  • Anime imagens de produtos em revelações curtas, detalhes em rotação e movimentos para landing pages.
  • Transforme ilustrações de personagens ou retratos em microcenas controladas com movimento de câmera claro.
  • Crie protótipos de vídeos sociais e ideias de campanha antes de investir em uma produção mais longa.

Como escrever um bom prompt para o MiniMax H3

Trate o prompt como um briefing de direção conciso. As referências definem identidade e textura; o texto deve esclarecer movimento, câmera, ritmo e encerramento.

Movimento do objeto

Dê ao objeto uma ação clara que possa se desenvolver e terminar dentro da cena escolhida de 5–15 segundos.

Direção de câmera

Indique um movimento específico, como aproximação lenta, órbita, acompanhamento, inclinação ou câmera fixa.

Continuidade visual

Descreva iluminação, atmosfera, movimento do fundo e o final desejado sem alterar a identidade da imagem de referência.

Monte um conjunto enxuto de referências para o MiniMax H3

Um conjunto maior de referências não produz automaticamente um resultado melhor. Escolha a menor combinação que defina composição, identidade e consistência visual do elemento principal, movimento, som e desfecho. Depois, use o prompt para eliminar qualquer ambiguidade restante.

01

Comece pelo mínimo necessário

Use apenas texto ao explorar um conceito do zero. Adicione um quadro inicial quando a composição ou a aparência do elemento principal for importante e inclua o quadro final somente quando a pose final, o enquadramento ou a transição precisarem chegar a um resultado específico.

02

Atribua uma função a cada referência

Antes do upload, defina no briefing o papel de cada imagem, vídeo ou arquivo de áudio. Respeite os limites aceitos — até 9 imagens, 3 vídeos, 3 arquivos de áudio e 12 arquivos no total — e lembre-se de que o áudio não pode ser a única entrada.

03

Prepare referências fáceis de interpretar

Recorte as imagens estáticas em torno do elemento que deseja preservar, corte o vídeo de referência para manter apenas o movimento relevante e selecione o trecho de áudio que define o ritmo ou a atmosfera pretendidos. Evite sobreposições conflitantes e elementos sem relação com a cena, pois eles disputam a atenção do modelo.

04

Avalie a cena por inteiro

Confira se o elemento principal continua reconhecível, se a ação termina dentro da duração escolhida e se o movimento de câmera segue o prompt. Se apenas um aspecto se desviar, ajuste somente essa instrução ou referência antes de gerar novamente; assim, fica claro qual alteração melhorou o resultado.

05

Use um critério de avaliação por vez

Separe o êxito técnico da avaliação criativa. Primeiro, confirme se a duração, o enquadramento e a função de cada referência foram respeitados. Depois, compare com o briefing a identidade do elemento principal, a trajetória do movimento, o ritmo, a iluminação, o comportamento do fundo, o som e o desfecho. Antes de testar outra variação, salve a combinação de prompt e referências que gerou o melhor resultado, para não perder uma configuração útil entre as rodadas.

Perguntas frequentes sobre o MiniMax H3

O que é o MiniMax H3?

O MiniMax H3 é o modelo de vídeo multimodal aberto e de uso geral da MiniMax. Ele foi criado para gerar e editar vídeos com contexto de texto, imagens, vídeo e áudio.

Quais referências posso usar?

Você pode guiar a cena com um quadro inicial, um final ou referências multimodais. O modo de referência aceita até 9 imagens, 3 vídeos e 3 áudios, com no máximo 12 arquivos no total; o áudio não pode ser a única entrada.

Quais são a resolução e as durações compatíveis com o MiniMax H3?

A API V2 oferece suporte ao MiniMax H3 em 2K, com durações inteiras de 5 a 15 segundos. As entradas podem incluir texto, um quadro inicial e/ou um quadro final, além de referências de imagem, vídeo e áudio. O modo de referência aceita até 9 imagens, 3 vídeos e 3 áudios, com 12 arquivos no total; o áudio não pode ser enviado sozinho.

O MiniMax H3 também permite editar vídeos?

Sim. O MiniMax H3 serve tanto para gerar novas cenas quanto para editar um vídeo existente. O texto e as referências ajudam a indicar o elemento principal, o movimento e a atmosfera que devem ser preservados.