Docs do Nodaro
DocumentaçãoReferência de nósModelosAgentes de IA (MCP)DesenvolvedoresSelf-hostingPesquisa
Modelos de vídeo

Modelos de vídeo

Todos os modelos de vídeo que você pode executar no Nodaro, com o que cada um faz e quanto custa em créditos.

Você pode executar 62 modelos de vídeo no Nodaro. Cada linha abaixo leva à página do modelo, com as configurações, os preços em créditos e as dicas de prompt.

MiniMax

ModeloDesenvolvedorModosCréditosDetalhes
Hailuo 02 I2V ProMiniMaxImagem para vídeo, Texto para vídeo158Hailuo 02 Pro — movimento fotorrealista convincente, em clipes fixos de 5 segundos. Aceita quadro final.
minimax-h3MiniMaxImagem para vídeo, Texto para vídeoa partir de 253MiniMax Hailuo 3 — nível multimodal premium: quadro inicial e final mais referências de imagem, vídeo e áudio, áudio nativo, saída em 2K (padrão) ou 768P e preço por segundo, de 4 a 15 s.
Hailuo 2.3 ProMiniMaxImagem para vídeoa partir de 143Hailuo 2.3 Pro — Hailuo mais novo, com resoluções de 768P e 1080P.
Hailuo 2.3 StandardMiniMaxImagem para vídeoa partir de 83Nível mais barato do Hailuo 2.3 — boa qualidade de base.
Hailuo 02 StandardMiniMaxImagem para vídeo, Texto para vídeoa partir de 83Hailuo 02 Standard — opção econômica com suporte a quadro final.

Google

ModeloDesenvolvedorModosCréditosDetalhes
VEO 3.1 QualityGoogleImagem para vídeo, Texto para vídeoa partir de 1.023Google VEO 3.1 Quality — vídeo cinematográfico premium. Clipes de 4, 6 ou 8 s, quadro final opcional e áudio nativo. Não tem o modo de referência para vídeo (só o Fast e o Lite têm). Preço fixo por geração, qualquer que seja a duração.
VEO 3.1 FastGoogleImagem para vídeo, Texto para vídeoa partir de 165VEO 3.1 Fast — nível mais barato do VEO 3.1, com áudio, em 4, 6 ou 8 s. Bom equilíbrio para a maioria dos usos. Preço fixo por geração, qualquer que seja a duração.
VEO 3.1 LiteGoogleImagem para vídeo, Texto para vídeoa partir de 83VEO 3.1 Lite — o nível do VEO com melhor custo-benefício para gerar em alto volume. Clipes de 4, 6 ou 8 s com áudio e suporte a quadro inicial e final.
Gemini OmniGoogleImagem para vídeo, Texto para vídeoa partir de 253Vídeo multimodal do Google com áudio nativo; texto ou imagem para vídeo, mais edição de vídeo.
Gemini Omni FlashGoogleImagem para vídeo, Texto para vídeoa partir de 176Google Gemini Omni Flash — nível mais rápido e mais barato do Omni: vídeo multimodal com áudio nativo, texto ou imagem para vídeo, mais edição de vídeo.
VEO ExtendGoogleExtensão de vídeoa partir de 209Estende um clipe existente do VEO 3.1 com mais um segmento.
VEO 1080p UpscaleGoogleUpscale de vídeo22Faz upscale de um vídeo do VEO para 1080p.
VEO 4K UpscaleGoogleUpscale de vídeo418Faz upscale de um vídeo do VEO para 4K.

Kuaishou

ModeloDesenvolvedorModosCréditosDetalhes
Kling 2.6KuaishouImagem para vídeo, Texto para vídeoa partir de 152Kling 2.6 I2V — movimento muito realista. Clipes de 5 ou 10 s, com áudio nativo opcional.
Kling 2.5 Turbo ProKuaishouImagem para vídeo, Texto para vídeoa partir de 121Kling mais rápido — boa qualidade por um custo menor. Aceita quadro final.
Kling 3.0KuaishouImagem para vídeo, Texto para vídeoa partir de 297Kling 3.0 premium — duração variável de 3 a 15 s, áudio nativo, 720P/1080P.
Kling 2.1 MasterKuaishouImagem para vídeoa partir de 440Nível Master de imagem para vídeo — ótima qualidade cinematográfica.
Kling 3 OmniKuaishouImagem para vídeoa partir de 275Kling 3 Omni — 3 a 15 s, 720p/1080p, quadro final e imagens de referência, áudio nativo.
Kling 2.6 Motion TransferKuaishouTransferência de movimentoa partir de 88Transfere o movimento de um vídeo guia para um personagem em uma imagem fixa. Baseado no Kling 2.6.
Kling 3.0 Motion TransferKuaishouTransferência de movimentoa partir de 165Transferência de movimento premium com o Kling 3.0.
Kling Avatar StandardKuaishouSincronização labial308Sincroniza os lábios de um retrato estático com um áudio guia. Qualidade padrão.
Kling Avatar ProKuaishouSincronização labial616Sincronização labial premium — formato da boca e tempo mais precisos.

xAI

ModeloDesenvolvedorModosCréditosDetalhes
Grok Imagine (I2V)xAIImagem para vídeoa partir de 55Grok de imagem para vídeo — movimento estilizado. Até 15 s.
Grok Imagine Video 1.5xAIImagem para vídeoa partir de 325Grok Imagine 1.5 de imagem para vídeo — de 1 a 15 s, 480p/720p, preço por segundo. Requer uma imagem de entrada.

Bytedance

ModeloDesenvolvedorModosCréditosDetalhes
Seedance 2BytedanceImagem para vídeo, Texto para vídeoa partir de 253Seedance 2 — nível premium com áudio nativo. Preço por segundo conforme a resolução.
Seedance 2 FastBytedanceImagem para vídeo, Texto para vídeoa partir de 198Nível mais barato e mais rápido do Seedance 2.
Seedance 2 MiniBytedanceImagem para vídeo, Texto para vídeoa partir de 132Nível econômico do Seedance 2 — só 480p/720p, preço por segundo conforme a resolução.
Seedance 2.5BytedanceImagem para vídeo, Texto para vídeoa partir de 374Seedance 2.5 — até 30 s em uma única tomada, áudio nativo e amplas referências multimodais. 480p/720p/1080p.
Bytedance Lite I2VBytedanceImagem para vídeo, Texto para vídeo63O nível de vídeo mais barato da Bytedance, com suporte a quadro final.
Bytedance Pro I2VBytedanceImagem para vídeo, Texto para vídeo193Nível Pro de vídeo da Bytedance — qualidade melhor.
Bytedance Pro Fast I2VBytedanceImagem para vídeo99Variante mais rápida do Bytedance Pro.
Seedance 2 ExtendBytedanceExtensão de vídeoa partir de 286Estende QUALQUER vídeo: gera a continuação (com áudio) e a corta e junta ao original em um único clipe contínuo.
OmniHuman 1.5BytedanceSincronização labiala partir de 1.122Avatar falante premium dirigido por prompt, a partir de uma imagem fixa e um áudio. 720p / 1080p, até 60 s. Pessoas, pets e anime.

Alibaba

ModeloDesenvolvedorModosCréditosDetalhes
Wan 3.0AlibabaImagem para vídeo, Texto para vídeoa partir de 176Wan 3.0 — multimodal: quadro inicial e final ou referências de imagem, vídeo e áudio, áudio nativo, de 2 a 30 s em 480p/720p/1080p.
Wan 3.0 PrimeAlibabaImagem para vídeo, Texto para vídeoa partir de 275Wan 3.0 Prime — o nível de alta velocidade do Wan 3.0, da Alibaba: os mesmos recursos multimodais e a mesma faixa de 2 a 30 s, com resultado mais rápido e preço por segundo maior.
Wan 2.6 I2VAlibabaImagem para vídeoa partir de 193Wan 2.6 de imagem para vídeo — 5, 10 ou 15 s em 720p/1080p.
Wan 2.2 TurboAlibabaImagem para vídeo, Texto para vídeoa partir de 110Wan turbo, barato e rápido — 5 s. Atende imagem para vídeo e texto para vídeo com um único ID.
Wan 2.6AlibabaVídeo para vídeo, Texto para vídeoa partir de 193Wan 2.6 — texto para vídeo e vídeo para vídeo com um único ID.
Wan Flash V2VAlibabaVídeo para vídeo110Variante mais rápida do Wan de vídeo para vídeo.
Wan 2.7 VideoEditAlibabaVídeo para vídeo352Edição de vídeo guiada, com imagem de referência opcional, controle de áudio e expansão do prompt.
Wan 2.7 I2VAlibabaImagem para vídeo207Wan 2.7 de imagem para vídeo — de 2 a 15 s em 720p/1080p, com suporte a quadro inicial e final.
Wan 2.7 T2VAlibabaTexto para vídeo207Wan 2.7 de texto para vídeo — de 2 a 15 s em 720p/1080p.

Lightricks

ModeloDesenvolvedorModosCréditosDetalhes
LTX 2.3 ProLightricksImagem para vídeo, Texto para vídeoa partir de 264Lightricks LTX 2.3 Pro — texto, imagem ou áudio para vídeo em até 4K, com 6, 8 ou 10 s e interpolação até o quadro final.
LTX 2.3 FastLightricksImagem para vídeo, Texto para vídeoa partir de 198Lightricks LTX 2.3 Fast — texto ou imagem para vídeo, até 20 s em 1080p (6, 8 ou 10 s em 2K e 4K). Sem entrada de áudio e sem extensão.

HappyHorse

ModeloDesenvolvedorModosCréditosDetalhes
HappyHorse 1.1HappyHorseTexto para vídeo311HappyHorse 1.1 de texto para vídeo — de 3 a 15 s em 720p/1080p, 9 proporções, incluindo 21:9 e 9:21, e preço por segundo.
HappyHorse 1.1 I2VHappyHorseImagem para vídeo311HappyHorse 1.1 de imagem para vídeo — de 3 a 15 s em 720p/1080p, proporção definida pela imagem de entrada e preço por segundo.
HappyHorse 1.1 Ref2VHappyHorseImagem para vídeo311HappyHorse 1.1 de referência para vídeo — de 1 a 9 imagens de referência, de 3 a 15 s em 720p/1080p e preço por segundo.
HappyHorse EditHappyHorseVídeo para vídeo385HappyHorse para edição de vídeo — transformação de vídeo para vídeo, com entrada de até 60 s e saída em 720p/1080p.

Runway

ModeloDesenvolvedorModosCréditosDetalhes
Runway Gen-3RunwayImagem para vídeo, Texto para vídeo33Runway Gen-3. Clipes de 5 ou 10 s em 720p/1080p.
Runway Aleph V2VRunwayVídeo para vídeo385Runway Aleph — conversão de vídeo para vídeo.
Runway ExtendRunwayExtensão de vídeo352Estende um vídeo do Runway com mais um clipe.

Topaz

ModeloDesenvolvedorModosCréditosDetalhes
Topaz Video UpscaleTopazUpscale de vídeo209Upscale e aprimoramento de vídeo de alta qualidade.

InfiniTalk

ModeloDesenvolvedorModosCréditosDetalhes
InfiniTalkInfiniTalkSincronização labiala partir de 121Cabeça falante guiada por áudio, a partir de uma imagem fixa. 480p / 720p.

Sync

ModeloDesenvolvedorModosCréditosDetalhes
Sync Lipsync v3SyncSincronização labiala partir de 1.100Dubla um vídeo existente — sincroniza de novo os lábios com uma nova faixa de áudio. Entrada de vídeo, cobrança por segundo.

Volcengine

ModeloDesenvolvedorModosCréditosDetalhes
Volcengine Lip SyncVolcengineSincronização labiala partir de 330Dublagem de vídeo para vídeo com IA — sincroniza de novo os lábios com uma nova faixa de voz. Vários falantes (detecção de cenas e identificação de falantes) no modo básico. Entrada de vídeo, cobrança por segundo.

Nodaro

ModeloDesenvolvedorModosCréditosDetalhes
Video Analysis (Fast)NodaroAnálise de vídeoa partir de 200Analisa um vídeo e gera uma lista de tomadas estruturada (cenas, câmera, áudio) — nível rápido e econômico. Cobrado por faixa de duração.
Video Analysis (Fast — legacy)NodaroAnálise de vídeoa partir de 225Modelo de análise antigo do nível rápido (atendeu o nível rápido de julho de 2026 até 29 de julho de 2026). Foi mantido para que as configurações salvas com esse modelo continuem funcionando e sendo cobradas pelo próprio identificador; as novas execuções do nível rápido usam o modelo rápido atual.
Video Analysis (Pro)NodaroAnálise de vídeoa partir de 238Analisa um vídeo e gera uma lista de tomadas estruturada (cenas, câmera, áudio) — nível padrão, de maior fidelidade. Cobrado por faixa de duração.
Video Analysis (Mixed)NodaroAnálise de vídeoa partir de 297Nosso nível de análise mais avançado — vários mecanismos de análise combinados em um único resultado, o mais completo e preciso possível. Cobrado por faixa de duração.
Video Analysis (Smart)NodaroAnálise de vídeoa partir de 455A análise mais precisa — uma passagem híbrida que combina uma leitura nativa da estrutura do vídeo com várias análises auxiliares e sempre refina o resultado para achar os limites das tomadas e identificar o elenco pela aparência. A melhor escolha quando a lista de tomadas vai guiar uma nova geração. Cobrado por faixa de duração.
AI AuditNodaroAuditoria de vídeoa partir de 237Assiste de novo a um clipe, comparando-o com uma análise conectada, aplica com proteções as correções confirmadas no vídeo e retorna um relatório que informa o que mudou. Cobrado por faixa de duração.
AI Audit (with analysis run)NodaroAuditoria de vídeoa partir de 436Faz a mesma auditoria confirmada no vídeo que o AI Audit, mas antes executa uma análise rápida quando nenhuma está conectada; depois aplica as correções com proteções e retorna um relatório com as alterações. Cobrado por faixa de duração.

Última atualização