Docs do Nodaro
DocumentaçãoReferência de nósModelosAgentes de IA (MCP)DesenvolvedoresSelf-hostingPesquisa
Guias

Como escolher um modelo

Escolha o modelo certo de imagem, vídeo, áudio ou texto para cada tarefa no Nodaro, de rascunhos baratos a renders finais premium, com preços atualizados.

O Nodaro executa mais de cem modelos de imagem, vídeo, áudio e texto. O certo depende do que você cria e de quanto quer gastar. Este guia agrupa os modelos por tarefa e por preço, para que você possa escolher sem ler a página de cada modelo. Comece pelas escolhas rápidas, faça rascunhos em um modelo barato e troque para um modelo premium no render final. As tabelas desta página são lidas do catálogo de modelos do Nodaro, então os preços estão sempre atualizados.

Escolhas rápidas por tarefa

Encontre o seu objetivo na coluna da esquerda e clique em um modelo para ver as configurações, os preços e as dicas de prompt dele.

O melhor para tipografia, logotipos e imagens com muito textoNano Banana Pro, GPT Image 2Nano Banana Pro para diagramas e textos complexos; GPT Image 2 para logotipos e textos curtos.
Imagem realista mais barataZ-Image, Qwen, Imagen 4 FastO Z-Image é o mais barato. Qwen ou Imagen4 Fast para uma qualidade um pouco maior.
Imagem com a maior fidelidadeNano Banana Pro, Imagen 4 Ultra, Flux 2 FlexEscolha pelo fabricante de sua preferência; os três são níveis premium.
Edição de imagem e novo estiloFlux Kontext Pro, Ideogram Remix, Seedream 5 Pro (I2I)O Flux Kontext preserva a identidade; o Ideogram Remix reconhece os personagens; o Seedream 5 Pro serve para edições por instruções (o 5 Lite é a opção econômica).
Imagem com a maior resoluçãoTopaz Image Upscale, Nano Banana Pro, GPT Image 2Gere no nível mais alto do modelo e depois faça upscale 4x com o Topaz (o único ajuste do Topaz é o fator 1x/2x/4x).
Remoção de fundo e recorteRecraft Remove BGBarato e sem necessidade de prompt.
O vídeo mais cinematográficoVEO 3.1 Quality, Kling 3.0, Seedance 2VEO 3.1 Quality para narrativas premium; Kling 3.0 para movimento sincronizado com música; Seedance 2 para consistência guiada por referências.
Clipes de vídeo baratos em loteVEO 3.1 Fast, Wan 2.2 Turbo, Bytedance Lite I2VO VEO 3.1 Fast tem o melhor equilíbrio entre preço e qualidade, com áudio nativo.
Vídeo com quadro inicial e finalVEO 3.1 Quality, VEO 3.1 Fast, Kling 2.5 Turbo Pro, Hailuo 02 I2V Pro, Hailuo 02 Standard, Seedance 2Todos os modelos listados aceitam quadro final; o VEO usa imageUrls[start, end].
Geração de música e cançõesSuno V6, Suno V6 Wild, Suno V6 Mini, Suno v5.5O V6 é o topo de linha e o padrão; o V6 Wild dá resultados mais ousados e menos previsíveis; o V6 Mini serve quando a velocidade importa; v5.5 / v5 / v4 mantêm o estilo próprio. Mesmo preço.
Locução e narraçãoElevenLabs v3, ElevenLabs Turbo v2.5O v3 aceita tags de áudio entre colchetes para emoção; o Turbo é mais barato para narração simples.
Sincronizar os lábios de um retrato com um áudioKling Avatar Pro, Kling Avatar Standard, InfiniTalkPro para o formato da boca mais preciso; InfiniTalk para controlar a resolução.
Transcrição e legendasElevenLabs STT, Incredibly Fast Whisper, WhisperLegendas precisam de marcações de tempo POR PALAVRA: ElevenLabs STT (sempre) ou Incredibly Fast Whisper. O Whisper comum retorna só segmentos por frase.
Transferência de movimento (animar um personagem com outro vídeo)Kling 2.6 Motion Transfer, Kling 3.0 Motion TransferO Kling 2.6 base é barato; o Kling 3.0 é premium.

Dia a dia, padrão e premium

Os modelos se dividem em três faixas de preço. As faixas são relativas dentro de cada tipo de mídia: cada faixa reúne cerca de um terço dos modelos de imagem, de vídeo ou de áudio, divididos pelo preço das configurações padrão. Modelos com o mesmo preço ficam na mesma faixa.

FaixaQuando usar
Dia a diaBaixo custo e rapidez. A escolha certa por padrão para rascunhos, iterações e a maior parte do trabalho.
PadrãoUm degrau acima em qualidade, por um preço moderado.
PremiumA melhor qualidade, pelo preço mais alto. Use para as tomadas principais e os renders finais.

Entre tipos de mídia diferentes, compare créditos, não nomes de faixa. Um modelo de imagem premium ainda custa muito menos do que um modelo de vídeo premium.

Os preços são das configurações padrão. Os créditos em cada tabela abaixo são o preço das configurações padrão do modelo. Uma resolução maior, um clipe mais longo ou áudio nativo custam mais. Veja Créditos para saber como os preços são cobrados.

Modelos de imagem

TarefaModeloPor quê
Imagens detalhadas, texto na imagem, diagramasNano Banana ProO padrão do nó Gerar imagem (Generate Image). O melhor para renderizar texto, diagramas e composições complexas.
Iteração rápida e trabalho em grande volumeGPT Image 2.5 FlareQualidade maior que a do GPT Image 2, em cerca de metade do tempo. Bom para posts em redes sociais, variações de campanha e miniaturas.
O render final, quando a marca exige precisãoGPT Image 2.5 SunburstDemora mais para ter mais controle e detalhe: embalagens, diagramas, retoque de produtos.
Os rascunhos e storyboards mais baratosZ-Image, Nano Banana 2 LiteO Z-Image é o modelo mais barato do catálogo, com um conjunto limitado de proporções.
Seguir instruções detalhadasSeedream 5 ProO melhor em seguir instruções e em raciocínio visual da família Seedream.
Editar mantendo o assuntoFlux Kontext ProPreserva a identidade do assunto em edições e mudanças de estilo.
Logotipos, textos curtos e ilustração estilizadaGPT Image 2, Ideogram V3Tipografia forte.
A resolução mais altaTopaz Image UpscaleGere na resolução máxima do modelo e depois amplie a imagem 2x ou 4x.
Remoção de fundoRecraft Remove BGBaixo custo e sem necessidade de prompt.

Se você estiver em dúvida entre os dois modelos GPT Image 2.5, faça o rascunho no Flare e finalize no Sunburst. Os dois custam o mesmo.

ModeloDesenvolvedorModosCréditosDetalhes
Z-ImageTongyi-MAITexto para imagem3O modelo mais barato do catálogo. Resultado rápido e estilizado. Poucas proporções disponíveis.
Nano Banana 2 LiteGoogleTexto para imagem, Imagem para imagem11Nano Banana 2 leve (Gemini 3.1 Flash-Lite) — geração e edição em 1K, rápidas e de baixo custo.
GPT Image 2.5 FlareOpenAITexto para imagema partir de 17GPT Image 2.5 rápido para o dia a dia — qualidade maior que a do GPT Image 2 com cerca de metade da latência. É o padrão da dupla: conteúdo para redes sociais e criadores, variações de campanha, thumbnails, iteração rápida e trabalho em alto volume.
GPT Image 2.5 SunburstOpenAITexto para imagema partir de 17GPT Image 2.5 de precisão — troca tempo de geração por mais controle e fidelidade aos detalhes. Escolha-o para trabalhos de produção e que exigem cuidado com a marca: embalagens, diagramas, retoque para e-commerce e peças de campanha bem acabadas.
Nano Banana 2GoogleTexto para imagem, Imagem para imagema partir de 22Versão mais nova do Nano Banana, com controle nativo de resolução (1K/2K/4K) e contexto da Pesquisa Google.
Nano Banana ProGoogleTexto para imagem, Imagem para imagema partir de 50Nano Banana topo de linha — o melhor para renderizar texto, diagramas e composições complexas.
Seedream 5 ProBytedanceTexto para imagema partir de 20Seedream 5 Pro, o topo de linha — a melhor aderência a instruções e o raciocínio visual mais forte. Básica = 1K, alta = 2K.
Flux Kontext ProBlack Forest LabsTexto para imagem, Edição de imagem15Edição sensível ao contexto e transferência de estilo. Preserva bem a identidade do personagem ou do objeto ao longo das edições.
Ideogram V3IdeogramTexto para imagem20Tipografia forte e ilustração estilizada. Níveis de velocidade e qualidade (TURBO/BALANCED/QUALITY).
Topaz Image UpscaleTopazUpscale de imagema partir de 28Upscale de imagem de alta qualidade em 1x (só aprimoramento), 2x ou 4x. Ideal quando o resultado vai direto para produção.
Recraft Remove BGRecraftRemoção de fundo4Remove o fundo da imagem. Utilitário barato.

Todos os modelos de imagem estão em Modelos de imagem.

Modelos de vídeo

Antes de escolher, confira três coisas na página do modelo. O modelo gera áudio nativo? Quais durações ele oferece? Ele aceita um quadro final além do quadro inicial? Muitos modelos de vídeo fazem texto para vídeo e imagem para vídeo com o mesmo nome. O nó Gerar vídeo (Generate Video) escolhe o modo pelo que você conecta: com um quadro inicial, ele anima a imagem; sem ele, trabalha a partir do prompt.

TarefaModeloPor quê
A maioria dos clipesVEO 3.1 FastO melhor equilíbrio entre preço e qualidade, com áudio nativo, em 4, 6 ou 8 segundos.
Muitos clipes pelo menor preçoVEO 3.1 Lite, Wan 2.2 Turbo, Bytedance Lite I2VFeitos para grande volume, como B-roll.
Tomadas cinematográficas premiumVEO 3.1 QualityVídeo narrativo premium com áudio nativo e um quadro final opcional.
Movimento sincronizado com músicaKling 3.0Movimento premium, de 3 a 15 segundos, com áudio nativo.
Consistência a partir de imagens de referênciaSeedance 2Vídeo guiado por referências, com áudio nativo. O Seedance 2 Mini é a opção econômica.
Uma tomada longaSeedance 2.5, Wan 3.0Até 30 segundos em uma única tomada.
Um quadro inicial e um quadro finalVEO 3.1 Quality, VEO 3.1 Fast, Kling 2.5 Turbo Pro, Hailuo 02 I2V Pro, Seedance 2Todos aceitam um quadro final.
Um retrato falanteKling Avatar Pro, Kling Avatar Standard, InfiniTalkO Kling Avatar Pro dá os melhores movimentos de boca. O InfiniTalk permite escolher a resolução.
Movimento a partir de outro vídeoKling 2.6 Motion Transfer, Kling 3.0 Motion TransferO Kling 2.6 é a opção de baixo custo. O Kling 3.0 é premium.
Um vídeo final mais nítidoTopaz Video UpscaleAmpliação e melhoria de alta qualidade.
ModeloDesenvolvedorModosCréditosDetalhes
VEO 3.1 LiteGoogleImagem para vídeo, Texto para vídeoa partir de 83VEO 3.1 Lite — o nível do VEO com melhor custo-benefício para gerar em alto volume. Clipes de 4, 6 ou 8 s com áudio e suporte a quadro inicial e final.
VEO 3.1 FastGoogleImagem para vídeo, Texto para vídeoa partir de 165VEO 3.1 Fast — nível mais barato do VEO 3.1, com áudio, em 4, 6 ou 8 s. Bom equilíbrio para a maioria dos usos. Preço fixo por geração, qualquer que seja a duração.
VEO 3.1 QualityGoogleImagem para vídeo, Texto para vídeoa partir de 1.023Google VEO 3.1 Quality — vídeo cinematográfico premium. Clipes de 4, 6 ou 8 s, quadro final opcional e áudio nativo. Não tem o modo de referência para vídeo (só o Fast e o Lite têm). Preço fixo por geração, qualquer que seja a duração.
Kling 3.0KuaishouImagem para vídeo, Texto para vídeoa partir de 297Kling 3.0 premium — duração variável de 3 a 15 s, áudio nativo, 720P/1080P.
Seedance 2 MiniBytedanceImagem para vídeo, Texto para vídeoa partir de 132Nível econômico do Seedance 2 — só 480p/720p, preço por segundo conforme a resolução.
Seedance 2BytedanceImagem para vídeo, Texto para vídeoa partir de 253Seedance 2 — nível premium com áudio nativo. Preço por segundo conforme a resolução.
Seedance 2.5BytedanceImagem para vídeo, Texto para vídeoa partir de 374Seedance 2.5 — até 30 s em uma única tomada, áudio nativo e amplas referências multimodais. 480p/720p/1080p.
Wan 2.2 TurboAlibabaImagem para vídeo, Texto para vídeoa partir de 110Wan turbo, barato e rápido — 5 s. Atende imagem para vídeo e texto para vídeo com um único ID.
Bytedance Lite I2VBytedanceImagem para vídeo, Texto para vídeo63O nível de vídeo mais barato da Bytedance, com suporte a quadro final.
Kling 2.5 Turbo ProKuaishouImagem para vídeo, Texto para vídeoa partir de 121Kling mais rápido — boa qualidade por um custo menor. Aceita quadro final.

Todos os modelos de vídeo estão em Modelos de vídeo. Para ver como dois deles, o Seedance 2.5 e o Seedance 2 Fast, seguem as direções de câmera, leia Camera Motion Lab.

Modelos de áudio, voz e música

TarefaModeloPor quê
Narração com emoçãoElevenLabs v3Aceita tags de áudio entre colchetes para emoção e ritmo.
Narração simples por um preço menorElevenLabs Turbo v2.5Rápido e mais barato.
Fala em vários idiomasElevenLabs Multilingual v2Feito para vários idiomas.
Uma conversa entre várias vozesElevenLabs Dialogue v3Dá voz a cada papel de um roteiro.
Efeitos sonorosElevenLabs Sound EffectsEfeitos curtos a partir de um prompt de texto, por um preço muito baixo.
Canções e músicaSuno V6O padrão. O Suno V6 Wild é mais ousado e menos previsível, e o Suno V6 Mini é mais rápido. Todos os modelos Suno custam o mesmo.
Transcrições para legendasElevenLabs STT, Incredibly Fast WhisperAs legendas precisam de um tempo para cada palavra, e estes modelos o retornam. O Whisper retorna só o tempo por frase.
ModeloDesenvolvedorModosCréditosDetalhes
ElevenLabs v3ElevenLabsTexto para fala33O modelo de texto para fala mais recente da ElevenLabs — aceita tags de áudio entre colchetes para emoção e ritmo. API direta.
ElevenLabs Turbo v2.5ElevenLabsTexto para fala17Texto para fala rápido e barato da ElevenLabs, pela API direta da ElevenLabs. Bom para narração.
ElevenLabs Multilingual v2ElevenLabsTexto para fala33Texto para fala multilíngue da ElevenLabs, pela API direta da ElevenLabs.
ElevenLabs Dialogue v3ElevenLabsDiálogo com vários falantes28Diálogo com vários falantes pela API direta da ElevenLabs — você fornece um roteiro e ele dá voz a cada papel (qualquer voz: pronta, da biblioteca ou clonada).
ElevenLabs Sound EffectsElevenLabsEfeitos sonoros4Gera efeitos sonoros curtos a partir de um prompt de texto.
ElevenLabs STTElevenLabsFala para texto25Fala para texto com marcações de tempo POR PALAVRA (sempre ativas), identificação de falantes e tags de eventos sonoros. É o mecanismo certo quando a transcrição alimenta legendas.
Incredibly Fast WhisperOpenAIFala para texto44Fala para texto rápido com o Whisper. Retorna marcações de tempo POR PALAVRA quando solicitado, então a transcrição pode alimentar legendas.
WhisperOpenAIFala para texto44Fala para texto com o Whisper — só segmentos POR FRASE, SEM marcações de tempo por palavra. Serve para uma transcrição ou uma legenda estática, mas não para legendas sincronizadas palavra por palavra (cinéticas).
Suno V6SunoMúsica33Suno V6 — maior expressividade musical, com vocais mais naturais e detalhes mais ricos. O topo de linha e o padrão.
Suno V6 WildSunoMúsica33Suno V6 Wild — amplia os limites criativos para uma expressão musical mais ousada e marcante; resultados mais variados e menos previsíveis.
Suno V6 MiniSunoMúsica33Suno V6 Mini — leve e rápido, equilibra qualidade e velocidade para criar sem esforço.

Todos os modelos de áudio estão em Modelos de áudio.

Modelos de texto

Os nós que escrevem texto, como Prompt, Gerar roteiro (Generate Script) e Verificar qualidade (QA Check), oferecem modelos de linguagem em três faixas de preço.

FaixaQuando usarPreço relativo
EconômicoTexto simples em grande volume: rascunhos rápidos, prompts curtos, verificações.O mais baixo
PadrãoA maior parte da escrita e das saídas estruturadas. O equilíbrio entre qualidade e preço.Intermediário
PremiumO raciocínio mais difícil: roteiros longos, planos de cena detalhados, reescritas cuidadosas.O mais alto

Os modelos oferecidos mudam de um nó para outro. O painel de configurações do nó mostra cada opção e o preço dela em créditos.

Rascunho barato, final premium

Faça o rascunho em um modelo do dia a dia

Monte o workflow em um modelo de baixo custo, com resolução baixa ou duração curta. Execute até a composição, o prompt e os seletores ficarem certos.

Mantenha o modelo em um só nó

Alimente um único nó de geração com tomadas parecidas a partir de uma Lista (List), em vez de copiar o nó para cada tomada. O nó é executado uma vez por item da lista, então passar do modelo de rascunho para o final é uma única alteração.

Você também pode conectar um nó Provedor (Provider) à entrada Configurações de todos os nós Gerar imagem, ou de todos os nós Gerar vídeo ou Gerar vídeo Pro (Generate Video Pro). Assim, o nó Provedor define o modelo de todos eles.

Renderize a versão final

Troque para um modelo premium ou uma resolução maior e execute de novo. Compare o resultado com o rascunho antes de gastar com o resto do workflow.

promptListaTrês prompts de cenaGerar imagemÉ executado três vezes
Uma Lista com três prompts de cena alimenta um único nó Gerar imagem, então uma execução de rascunho e uma execução final diferem por uma única troca de modelo.

Dicas

  • Use o modelo certo para texto em imagens. Para uma placa, um rótulo ou um pôster com palavras, use o Nano Banana Pro ou o GPT Image 2.
  • Confira primeiro os recursos de vídeo. Um modelo sem áudio nativo precisa de uma faixa separada de voz ou música. Um modelo sem suporte a quadro final não consegue terminar em um último quadro planejado.
  • Economize nas novas tentativas. Rascunhos em um modelo do dia a dia custam uma fração de uma execução premium, então faça as suas tentativas ali.

Perguntas frequentes

Última atualização

Nesta página