# Como escolher um modelo

> Escolha o modelo certo de imagem, vídeo, áudio ou texto para cada tarefa no Nodaro, de rascunhos baratos a renders finais premium, com preços atualizados.

Source: https://nodaro.ai/pt-BR/docs/guides/choosing-models

O Nodaro executa mais de cem modelos de imagem, vídeo, áudio e texto. O certo depende do que você cria e de quanto quer gastar. Este guia agrupa os modelos por tarefa e por preço, para que você possa escolher sem ler a página de cada modelo. Comece pelas escolhas rápidas, faça rascunhos em um modelo barato e troque para um modelo premium no render final. As tabelas desta página são lidas do catálogo de modelos do Nodaro, então os preços estão sempre atualizados.

## Escolhas rápidas por tarefa
Encontre o seu objetivo na coluna da esquerda e clique em um modelo para ver as configurações, os preços e as dicas de prompt dele.

- best for typography / logos / text-heavy: Nano Banana Pro, GPT Image 2. Nano Banana Pro for diagrams / complex text; GPT Image 2 for logos and short copy.
- cheapest realistic image: Z-Image, Qwen, Imagen 4 Fast. Z-Image is the cheapest. Qwen / Imagen4 Fast for slightly higher quality.
- highest fidelity image: Nano Banana Pro, Imagen 4 Ultra, Flux 2 Flex. Pick by family preference; all three are premium tiers.
- image edit / restyle: Flux Kontext Pro, Ideogram Remix, Seedream 5 Pro (I2I). Flux Kontext preserves identity; Ideogram Remix is character-aware; Seedream 5 Pro for instruction-based edits (5 Lite is the budget option).
- highest-resolution image: Topaz Image Upscale, Nano Banana Pro, GPT Image 2. Generate at the model's top tier, then Topaz upscale 4x (Topaz's only lever is the 1x/2x/4x factor).
- background removal / cutout: Recraft Remove BG. Cheap, no prompt needed.
- best cinematic video: VEO 3.1 Quality, Kling 3.0, Seedance 2. VEO 3.1 Quality for premium narrative; Kling 3.0 for music-synced motion; Seedance 2 for reference-driven consistency.
- cheap batch video clips: VEO 3.1 Fast, Wan 2.2 Turbo, Bytedance Lite I2V. VEO 3.1 Fast is the best price/quality balance with native audio.
- video with start + end frame: VEO 3.1 Quality, VEO 3.1 Fast, Kling 2.5 Turbo Pro, Hailuo 02 I2V Pro, Hailuo 02 Standard, Seedance 2. All listed support an end frame; VEO uses imageUrls[start, end].
- music / song generation: Suno V6, Suno V6 Wild, Suno V6 Mini, Suno v5.5. V6 is the default flagship; V6 Wild for bolder, less predictable results; V6 Mini when speed matters; v5.5 / v5 / v4 keep their own character. Same price.
- voice over / narration: ElevenLabs v3, ElevenLabs Turbo v2.5. v3 supports [audio tags] for emotion; Turbo is cheaper for plain narration.
- lip-sync a portrait to audio: Kling Avatar Pro, Kling Avatar Standard, InfiniTalk. Pro for best mouth shape; InfiniTalk for resolution control.
- transcription / captions: ElevenLabs STT, Incredibly Fast Whisper, Whisper. Captions need WORD timestamps: ElevenLabs STT (always) or Incredibly Fast Whisper. Plain Whisper returns phrase segments only.
- motion transfer (drive a subject by another video): Kling 2.6 Motion Transfer, Kling 3.0 Motion Transfer. Kling 2.6 base is cheap; Kling 3.0 is premium.

## Dia a dia, padrão e premium
Os modelos se dividem em três faixas de preço. As faixas são relativas dentro de cada tipo de mídia: cada faixa reúne cerca de um terço dos modelos de imagem, de vídeo ou de áudio, divididos pelo preço das configurações padrão. Modelos com o mesmo preço ficam na mesma faixa.

| Faixa | Quando usar |
| --- | --- |
| **Dia a dia** | Baixo custo e rapidez. A escolha certa por padrão para rascunhos, iterações e a maior parte do trabalho. |
| **Padrão** | Um degrau acima em qualidade, por um preço moderado. |
| **Premium** | A melhor qualidade, pelo preço mais alto. Use para as tomadas principais e os renders finais. |

**Entre tipos de mídia diferentes, compare créditos, não nomes de faixa.** Um modelo de imagem premium ainda custa muito menos do que um modelo de vídeo premium.

**Os preços são das configurações padrão.** Os créditos em cada tabela abaixo são o preço das configurações padrão do modelo. Uma resolução maior, um clipe mais longo ou áudio nativo custam mais. Veja [Créditos](https://nodaro.ai/docs/concepts/credits) para saber como os preços são cobrados.

## Modelos de imagem
| Tarefa | Modelo | Por quê |
| --- | --- | --- |
| Imagens detalhadas, texto na imagem, diagramas | [Nano Banana Pro](https://nodaro.ai/docs/models/image/nano-banana-pro) | O padrão do nó **Gerar imagem** (Generate Image). O melhor para renderizar texto, diagramas e composições complexas. |
| Iteração rápida e trabalho em grande volume | [GPT Image 2.5 Flare](https://nodaro.ai/docs/models/image/gpt-image-2-5-flare) | Qualidade maior que a do GPT Image 2, em cerca de metade do tempo. Bom para posts em redes sociais, variações de campanha e miniaturas. |
| O render final, quando a marca exige precisão | [GPT Image 2.5 Sunburst](https://nodaro.ai/docs/models/image/gpt-image-2-5-sunburst) | Demora mais para ter mais controle e detalhe: embalagens, diagramas, retoque de produtos. |
| Os rascunhos e storyboards mais baratos | [Z-Image](https://nodaro.ai/docs/models/image/z-image), [Nano Banana 2 Lite](https://nodaro.ai/docs/models/image/nano-banana-2-lite) | O Z-Image é o modelo mais barato do catálogo, com um conjunto limitado de proporções. |
| Seguir instruções detalhadas | [Seedream 5 Pro](https://nodaro.ai/docs/models/image/seedream-5-pro) | O melhor em seguir instruções e em raciocínio visual da família Seedream. |
| Editar mantendo o assunto | [Flux Kontext Pro](https://nodaro.ai/docs/models/image/flux-kontext-pro) | Preserva a identidade do assunto em edições e mudanças de estilo. |
| Logotipos, textos curtos e ilustração estilizada | [GPT Image 2](https://nodaro.ai/docs/models/image/gpt-image-2), [Ideogram V3](https://nodaro.ai/docs/models/image/ideogram-v3) | Tipografia forte. |
| A resolução mais alta | [Topaz Image Upscale](https://nodaro.ai/docs/models/image/topaz-image-upscale) | Gere na resolução máxima do modelo e depois amplie a imagem 2x ou 4x. |
| Remoção de fundo | [Recraft Remove BG](https://nodaro.ai/docs/models/image/recraft-remove-bg) | Baixo custo e sem necessidade de prompt. |

Se você estiver em dúvida entre os dois modelos GPT Image 2.5, faça o rascunho no Flare e finalize no Sunburst. Os dois custam o mesmo.

| Model | Maker | Modes | Credits | Details |
| --- | --- | --- | --- | --- |
| [Z-Image](https://nodaro.ai/docs/models/image/z-image) | Tongyi-MAI | Text to image | 3 | Cheapest model in catalog. Fast, stylized output. Limited aspect ratios. |
| [Nano Banana 2 Lite](https://nodaro.ai/docs/models/image/nano-banana-2-lite) | Google | Text to image, Image to image | 11 | Lightweight Nano Banana 2 (Gemini 3.1 Flash-Lite) — fast, low-cost 1K generation and editing. |
| [GPT Image 2.5 Flare](https://nodaro.ai/docs/models/image/gpt-image-2-5-flare) | OpenAI | Text to image | a partir de 17 | Fast everyday GPT Image 2.5 - higher quality than GPT Image 2 at about half the latency. The default of the pair: social and creator content, campaign variants, thumbnails, rapid iteration, high-volume work. |
| [GPT Image 2.5 Sunburst](https://nodaro.ai/docs/models/image/gpt-image-2-5-sunburst) | OpenAI | Text to image | a partir de 17 | Precision GPT Image 2.5 - trades generation time for tighter control and detail fidelity. Pick it for brand-sensitive and production work: packaging, diagrams, ecommerce retouching, polished campaign creative. |
| [Nano Banana 2](https://nodaro.ai/docs/models/image/nano-banana-2) | Google | Text to image, Image to image | a partir de 22 | Newer Nano Banana with native resolution control (1K/2K/4K) and Google Search context. |
| [Nano Banana Pro](https://nodaro.ai/docs/models/image/nano-banana-pro) | Google | Text to image, Image to image | a partir de 50 | Top-tier Nano Banana — best for text rendering, diagrams, and complex compositions. |
| [Seedream 5 Pro](https://nodaro.ai/docs/models/image/seedream-5-pro) | Bytedance | Text to image | a partir de 20 | Flagship Seedream 5 Pro — strongest instruction following and visual reasoning. Basic = 1K, high = 2K. |
| [Flux Kontext Pro](https://nodaro.ai/docs/models/image/flux-kontext-pro) | Black Forest Labs | Text to image, Image editing | 15 | Context-aware editing and style transfer. Strong at preserving subject identity through edits. |
| [Ideogram V3](https://nodaro.ai/docs/models/image/ideogram-v3) | Ideogram | Text to image | 20 | Strong typography and stylized illustration. Speed/quality tiered (TURBO/BALANCED/QUALITY). |
| [Topaz Image Upscale](https://nodaro.ai/docs/models/image/topaz-image-upscale) | Topaz | Image upscaling | a partir de 28 | High-quality image upscale at 1x (enhance only), 2x or 4x. Best for production-ready output. |
| [Recraft Remove BG](https://nodaro.ai/docs/models/image/recraft-remove-bg) | Recraft | Background removal | 4 | Remove image background. Cheap utility. |

Todos os modelos de imagem estão em [Modelos de imagem](https://nodaro.ai/docs/models/image).

## Modelos de vídeo
Antes de escolher, confira três coisas na página do modelo. O modelo gera **áudio nativo**? Quais **durações** ele oferece? Ele aceita um **quadro final** além do quadro inicial? Muitos modelos de vídeo fazem texto para vídeo e imagem para vídeo com o mesmo nome. O nó [**Gerar vídeo** (Generate Video)](https://nodaro.ai/docs/nodes/video/generate-video) escolhe o modo pelo que você conecta: com um quadro inicial, ele anima a imagem; sem ele, trabalha a partir do prompt.

| Tarefa | Modelo | Por quê |
| --- | --- | --- |
| A maioria dos clipes | [VEO 3.1 Fast](https://nodaro.ai/docs/models/video/veo-3-1-fast) | O melhor equilíbrio entre preço e qualidade, com áudio nativo, em 4, 6 ou 8 segundos. |
| Muitos clipes pelo menor preço | [VEO 3.1 Lite](https://nodaro.ai/docs/models/video/veo-3-1-lite), [Wan 2.2 Turbo](https://nodaro.ai/docs/models/video/wan-2-2-turbo), [Bytedance Lite I2V](https://nodaro.ai/docs/models/video/bytedance-lite-i2v) | Feitos para grande volume, como B-roll. |
| Tomadas cinematográficas premium | [VEO 3.1 Quality](https://nodaro.ai/docs/models/video/veo-3-1-quality) | Vídeo narrativo premium com áudio nativo e um quadro final opcional. |
| Movimento sincronizado com música | [Kling 3.0](https://nodaro.ai/docs/models/video/kling-3-0) | Movimento premium, de 3 a 15 segundos, com áudio nativo. |
| Consistência a partir de imagens de referência | [Seedance 2](https://nodaro.ai/docs/models/video/seedance-2) | Vídeo guiado por referências, com áudio nativo. O [Seedance 2 Mini](https://nodaro.ai/docs/models/video/seedance-2-mini) é a opção econômica. |
| Uma tomada longa | [Seedance 2.5](https://nodaro.ai/docs/models/video/seedance-2-5), [Wan 3.0](https://nodaro.ai/docs/models/video/wan-3-0) | Até 30 segundos em uma única tomada. |
| Um quadro inicial e um quadro final | [VEO 3.1 Quality](https://nodaro.ai/docs/models/video/veo-3-1-quality), [VEO 3.1 Fast](https://nodaro.ai/docs/models/video/veo-3-1-fast), [Kling 2.5 Turbo Pro](https://nodaro.ai/docs/models/video/kling-2-5-turbo-pro), [Hailuo 02 I2V Pro](https://nodaro.ai/docs/models/video/hailuo-02-i2v-pro), [Seedance 2](https://nodaro.ai/docs/models/video/seedance-2) | Todos aceitam um quadro final. |
| Um retrato falante | [Kling Avatar Pro](https://nodaro.ai/docs/models/video/kling-avatar-pro), [Kling Avatar Standard](https://nodaro.ai/docs/models/video/kling-avatar-standard), [InfiniTalk](https://nodaro.ai/docs/models/video/infinitalk) | O Kling Avatar Pro dá os melhores movimentos de boca. O InfiniTalk permite escolher a resolução. |
| Movimento a partir de outro vídeo | [Kling 2.6 Motion Transfer](https://nodaro.ai/docs/models/video/kling-2-6-motion-transfer), [Kling 3.0 Motion Transfer](https://nodaro.ai/docs/models/video/kling-3-0-motion-transfer) | O Kling 2.6 é a opção de baixo custo. O Kling 3.0 é premium. |
| Um vídeo final mais nítido | [Topaz Video Upscale](https://nodaro.ai/docs/models/video/topaz-video-upscale) | Ampliação e melhoria de alta qualidade. |

| Model | Maker | Modes | Credits | Details |
| --- | --- | --- | --- | --- |
| [VEO 3.1 Lite](https://nodaro.ai/docs/models/video/veo-3-1-lite) | Google | Image to video, Text to video | a partir de 83 | VEO 3.1 Lite — most cost-effective VEO tier for high-volume generation. 4/6/8s with audio, supports first+last frame. |
| [VEO 3.1 Fast](https://nodaro.ai/docs/models/video/veo-3-1-fast) | Google | Image to video, Text to video | a partir de 165 | VEO 3.1 Fast — cheaper VEO 3.1 tier, 4/6/8s with audio. Good balance for most uses. Flat per-generation pricing across durations. |
| [VEO 3.1 Quality](https://nodaro.ai/docs/models/video/veo-3-1-quality) | Google | Image to video, Text to video | a partir de 1.023 | Google VEO 3.1 Quality — premium cinematic video. 4/6/8s clips, optional end frame, native audio. No reference-to-video mode (Fast/Lite only). Flat per-generation pricing across durations. |
| [Kling 3.0](https://nodaro.ai/docs/models/video/kling-3-0) | Kuaishou | Image to video, Text to video | a partir de 297 | Premium Kling 3.0 — variable 3-15s duration, native audio, 720P/1080P. |
| [Seedance 2 Mini](https://nodaro.ai/docs/models/video/seedance-2-mini) | Bytedance | Image to video, Text to video | a partir de 132 | Budget Seedance 2 tier — 480p/720p only, per-second pricing by resolution. |
| [Seedance 2](https://nodaro.ai/docs/models/video/seedance-2) | Bytedance | Image to video, Text to video | a partir de 253 | Seedance 2 — premium tier with native audio. Per-second pricing by resolution. |
| [Seedance 2.5](https://nodaro.ai/docs/models/video/seedance-2-5) | Bytedance | Image to video, Text to video | a partir de 374 | Seedance 2.5 — up to 30s in one shot, native audio, wide multimodal references. 480p/720p/1080p. |
| [Wan 2.2 Turbo](https://nodaro.ai/docs/models/video/wan-2-2-turbo) | Alibaba | Image to video, Text to video | a partir de 110 | Cheap, fast Wan turbo — 5s. Serves both i2v and t2v under one id. |
| [Bytedance Lite I2V](https://nodaro.ai/docs/models/video/bytedance-lite-i2v) | Bytedance | Image to video, Text to video | 63 | Cheapest Bytedance video tier with end-frame support. |
| [Kling 2.5 Turbo Pro](https://nodaro.ai/docs/models/video/kling-2-5-turbo-pro) | Kuaishou | Image to video, Text to video | a partir de 121 | Faster Kling — good quality at lower cost. Supports end frame. |

Todos os modelos de vídeo estão em [Modelos de vídeo](https://nodaro.ai/docs/models/video). Para ver como dois deles, o Seedance 2.5 e o Seedance 2 Fast, seguem as direções de câmera, leia [Camera Motion Lab](https://nodaro.ai/docs/research/camera-motion-lab).

## Modelos de áudio, voz e música
| Tarefa | Modelo | Por quê |
| --- | --- | --- |
| Narração com emoção | [ElevenLabs v3](https://nodaro.ai/docs/models/audio/elevenlabs-v3) | Aceita tags de áudio entre colchetes para emoção e ritmo. |
| Narração simples por um preço menor | [ElevenLabs Turbo v2.5](https://nodaro.ai/docs/models/audio/elevenlabs-turbo-v2-5) | Rápido e mais barato. |
| Fala em vários idiomas | [ElevenLabs Multilingual v2](https://nodaro.ai/docs/models/audio/elevenlabs-multilingual-v2) | Feito para vários idiomas. |
| Uma conversa entre várias vozes | [ElevenLabs Dialogue v3](https://nodaro.ai/docs/models/audio/elevenlabs-dialogue-v3) | Dá voz a cada papel de um roteiro. |
| Efeitos sonoros | [ElevenLabs Sound Effects](https://nodaro.ai/docs/models/audio/elevenlabs-sound-effects) | Efeitos curtos a partir de um prompt de texto, por um preço muito baixo. |
| Canções e música | [Suno V6](https://nodaro.ai/docs/models/audio/suno-v6) | O padrão. O [Suno V6 Wild](https://nodaro.ai/docs/models/audio/suno-v6-wild) é mais ousado e menos previsível, e o [Suno V6 Mini](https://nodaro.ai/docs/models/audio/suno-v6-mini) é mais rápido. Todos os modelos Suno custam o mesmo. |
| Transcrições para legendas | [ElevenLabs STT](https://nodaro.ai/docs/models/audio/elevenlabs-stt), [Incredibly Fast Whisper](https://nodaro.ai/docs/models/audio/incredibly-fast-whisper) | As legendas precisam de um tempo para cada palavra, e estes modelos o retornam. O [Whisper](https://nodaro.ai/docs/models/audio/whisper) retorna só o tempo por frase. |

| Model | Maker | Modes | Credits | Details |
| --- | --- | --- | --- | --- |
| [ElevenLabs v3](https://nodaro.ai/docs/models/audio/elevenlabs-v3) | ElevenLabs | Text to speech | 33 | Latest ElevenLabs TTS — supports [audio tags] for emotion / pacing. Direct API. |
| [ElevenLabs Turbo v2.5](https://nodaro.ai/docs/models/audio/elevenlabs-turbo-v2-5) | ElevenLabs | Text to speech | 17 | Fast, cheap ElevenLabs TTS via the direct ElevenLabs API. Good for narration. |
| [ElevenLabs Multilingual v2](https://nodaro.ai/docs/models/audio/elevenlabs-multilingual-v2) | ElevenLabs | Text to speech | 33 | Multi-language ElevenLabs TTS via the direct ElevenLabs API. |
| [ElevenLabs Dialogue v3](https://nodaro.ai/docs/models/audio/elevenlabs-dialogue-v3) | ElevenLabs | Multi-speaker dialogue | 28 | Multi-speaker dialogue via the direct ElevenLabs API — give it a script, it voices each role (any voice: premade, library, or cloned). |
| [ElevenLabs Sound Effects](https://nodaro.ai/docs/models/audio/elevenlabs-sound-effects) | ElevenLabs | Sound effects | 4 | Generate short sound effects from a text prompt. |
| [ElevenLabs STT](https://nodaro.ai/docs/models/audio/elevenlabs-stt) | ElevenLabs | Speech to text | 25 | Speech-to-text with WORD-level timestamps (always on), speaker diarization and audio-event tags. The engine to use when the transcript feeds captions. |
| [Incredibly Fast Whisper](https://nodaro.ai/docs/models/audio/incredibly-fast-whisper) | OpenAI | Speech to text | 44 | Fast Whisper speech-to-text. Returns WORD-level timestamps when asked, so its transcript can feed captions. |
| [Whisper](https://nodaro.ai/docs/models/audio/whisper) | OpenAI | Speech to text | 44 | Whisper speech-to-text — PHRASE-level segments only, NO word timestamps. Fine for a transcript or a static subtitle; not for word-timed (kinetic) captions. |
| [Suno V6](https://nodaro.ai/docs/models/audio/suno-v6) | Suno | Music | 33 | Suno V6 — greater musical expression with more natural vocals and richer details. The flagship and the default. |
| [Suno V6 Wild](https://nodaro.ai/docs/models/audio/suno-v6-wild) | Suno | Music | 33 | Suno V6 Wild — pushes creative boundaries for bolder, more distinctive musical expression; more varied, less predictable results. |
| [Suno V6 Mini](https://nodaro.ai/docs/models/audio/suno-v6-mini) | Suno | Music | 33 | Suno V6 Mini — lightweight and fast, balancing quality and speed for effortless creation. |

Todos os modelos de áudio estão em [Modelos de áudio](https://nodaro.ai/docs/models/audio).

## Modelos de texto
Os nós que escrevem texto, como [**Prompt**](https://nodaro.ai/docs/nodes/automate/prompt), [**Gerar roteiro** (Generate Script)](https://nodaro.ai/docs/nodes/video/generate-script) e [**Verificar qualidade** (QA Check)](https://nodaro.ai/docs/nodes/automate/qa-check), oferecem modelos de linguagem em três faixas de preço.

| Faixa | Quando usar | Preço relativo |
| --- | --- | --- |
| **Econômico** | Texto simples em grande volume: rascunhos rápidos, prompts curtos, verificações. | O mais baixo |
| **Padrão** | A maior parte da escrita e das saídas estruturadas. O equilíbrio entre qualidade e preço. | Intermediário |
| **Premium** | O raciocínio mais difícil: roteiros longos, planos de cena detalhados, reescritas cuidadosas. | O mais alto |

Os modelos oferecidos mudam de um nó para outro. O painel de configurações do nó mostra cada opção e o preço dela em créditos.

## Rascunho barato, final premium
### Faça o rascunho em um modelo do dia a dia
Monte o workflow em um modelo de baixo custo, com resolução baixa ou duração curta. Execute até a composição, o prompt e os seletores ficarem certos.

### Mantenha o modelo em um só nó
Alimente um único nó de geração com tomadas parecidas a partir de uma [**Lista** (List)](https://nodaro.ai/docs/nodes/automate/list), em vez de copiar o nó para cada tomada. O nó é executado uma vez por item da lista, então passar do modelo de rascunho para o final é uma única alteração.

Você também pode conectar um nó [**Provedor** (Provider)](https://nodaro.ai/docs/nodes/settings/provider) à entrada **Configurações** de todos os nós Gerar imagem, ou de todos os nós Gerar vídeo ou **Gerar vídeo Pro** (Generate Video Pro). Assim, o nó Provedor define o modelo de todos eles.

### Renderize a versão final
Troque para um modelo premium ou uma resolução maior e execute de novo. Compare o resultado com o rascunho antes de gastar com o resto do workflow.

Workflow: Uma Lista com três prompts de cena alimenta um único nó Gerar imagem, então uma execução de rascunho e uma execução final diferem por uma única troca de modelo.

- Lista → Gerar imagem (prompt)

## Dicas
- **Use o modelo certo para texto em imagens.** Para uma placa, um rótulo ou um pôster com palavras, use o Nano Banana Pro ou o GPT Image 2.
- **Confira primeiro os recursos de vídeo.** Um modelo sem áudio nativo precisa de uma faixa separada de voz ou música. Um modelo sem suporte a quadro final não consegue terminar em um último quadro planejado.
- **Economize nas novas tentativas.** Rascunhos em um modelo do dia a dia custam uma fração de uma execução premium, então faça as suas tentativas ali.

## Frequently asked questions

### Com qual modelo de imagem devo começar?

Comece pelo Nano Banana Pro, o padrão do Gerar imagem, para imagens detalhadas e texto legível. Use o GPT Image 2.5 Flare para iterar rápido e o GPT Image 2.5 Sunburst para o render final, quando a marca exige precisão. Use o Z-Image para os rascunhos mais baratos.

### Qual modelo de vídeo dá os melhores resultados?

O VEO 3.1 Quality para tomadas cinematográficas premium, o Kling 3.0 para movimento sincronizado com música e o Seedance 2 para consistência guiada por imagens de referência. O VEO 3.1 Fast é o melhor equilíbrio entre preço e qualidade para a maioria dos clipes, com áudio nativo.

### Qual modelo devo usar para fazer legendas?

Use o ElevenLabs STT ou o Incredibly Fast Whisper, porque as legendas precisam de um tempo para cada palavra. O Whisper comum retorna só o tempo por frase, o que serve para uma transcrição, mas não para legendas palavra por palavra.

### Por que o preço de um modelo aparece como preço inicial?

O número nas tabelas é o preço das configurações padrão do modelo. Uma resolução maior, um clipe mais longo ou áudio nativo custam mais. A página de cada modelo lista todos os preços dele.

### Posso trocar o modelo de vários nós de uma vez?

Para o Gerar imagem e os nós de vídeo, sim. Conecte um nó Provedor à entrada “Configurações” de cada nó Gerar imagem, ou de cada nó Gerar vídeo ou Gerar vídeo Pro, e depois troque o modelo no nó Provedor. Para os outros nós, alimente um único nó de geração com tomadas parecidas a partir de uma Lista; ele é executado uma vez por item, com o mesmo modelo.
