# Texto para diálogo

> Dê voz a uma conversa inteira em um só áudio: uma voz por fala, tags de áudio para emoção ou falas preenchidas com um roteiro. ElevenLabs Dialogue v3.

Source: https://nodaro.ai/pt-BR/docs/nodes/audio/text-to-dialogue

O nó **Texto para diálogo** (Text to Dialogue) dá voz a uma conversa inteira em um só arquivo de áudio. Você escreve as falas, dá uma voz a cada uma, e o ElevenLabs Dialogue v3 as fala em ordem, como uma troca natural. Use-o para entrevistas, conversas no estilo podcast e cenas de diálogo, em vez de gerar clipes de fala separados e emendá-los.

- Found in: Audio › Speech & Voiceover
- Output: audio
- API type: `text-to-dialogue`

## Quando usar
- Uma conversa no estilo podcast entre dois ou mais falantes.
- Uma entrevista com uma voz de apresentador e uma voz de convidado.
- Uma faixa de diálogo para um vídeo animado ou um vídeo explicativo.
- Uma cena de diálogo em um audiolivro, com uma voz por personagem.
- Um protótipo rápido, em áudio, de uma conversa.

Para uma única voz lendo um texto, use [**Texto para fala** (Text to Speech)](https://nodaro.ai/docs/nodes/audio/text-to-speech).

## Início rápido
### Adicione o nó
Pressione Tab no canvas e escolha **Áudio › Fala e narração › Texto para diálogo**.

### Escreva as falas
Abra o painel de configurações. Em **Falas**, escolha uma voz para a primeira fala e digite o texto dela. Clique em **Adicionar fala** para cada nova fala da conversa.

### Ou preencha as falas com um roteiro
Conecte a saída **Diálogo** de um nó [**Gerar roteiro** (Generate Script)](https://nodaro.ai/docs/nodes/video/generate-script) à entrada **Prompt**. No painel de configurações, clique no botão que preenche as falas, como **Preencher falas do roteiro (12)**. Depois, escolha uma voz para cada falante.

### Execute
Clique em **Executar** no nó. O nó retorna um só arquivo de áudio com todas as falas em ordem.

Workflow: Um roteiro preenche as falas do diálogo, e a conversa é mixada sobre um som ambiente gerado.

- Gerar roteiro → Texto para diálogo (prompt)
- Texto para diálogo → Mixar áudio (áudio)
- Texto para áudio → Mixar áudio (áudio)

## Entradas
| Entrada | Aceita | O que faz |
| --- | --- | --- |
| **Prompt** | Nós de texto, como Gerar roteiro | Quando a saída **Diálogo** de um nó Gerar roteiro está conectada, o painel de configurações oferece um botão que preenche as falas com o roteiro. As falas do painel são o que o nó fala. |

A saída, **Áudio**, é um só arquivo de áudio contínuo, com todas as falas ditas em ordem.

## Configurações
| Configuração | O que faz |
| --- | --- |
| **Falas** | As falas da conversa, em ordem. Cada fala tem a própria voz e o próprio texto. Digite `[` ou `/` em uma fala para inserir uma tag de áudio. Falas vazias são ignoradas. |
| **Adicionar fala** | Adiciona uma fala no final. O botão de lixeira remove uma fala. |
| **Preencher falas do roteiro (…)** | Aparece quando a saída Diálogo de um nó Gerar roteiro está conectada. Substitui as falas por uma fala para cada linha do roteiro. Cada fala mantém o nome do falante e começa com a voz padrão, **Sarah**. |
| **Estabilidade** | **Mais variável (0)**, **Equilibrado (0,5)** (o padrão) ou **Mais estável (1,0)**. Mais baixo é mais dramático, e mais alto é mais uniforme. |
| **Idioma** | **Detecção automática** (o padrão) ou um idioma. |
| **Seed** | Um número inteiro de 0 a 4.294.967.295. A mesma seed, as mesmas falas e as mesmas configurações reproduzem o mesmo áudio. Deixe vazio para ter um take aleatório. |
| **Normalização de texto** | **Automática** (o padrão), **Ativada** ou **Desativada**. Quando ativada, números, datas e abreviações são escritos por extenso, para soarem naturais. |

O painel conta as vozes e os caracteres enquanto você escreve, por exemplo `2/10 voices` e `840/5000`.

## Limites
| Limite | Valor |
| --- | --- |
| Texto somando todas as falas | 5.000 caracteres. Até 2.000 caracteres dá a melhor qualidade. |
| Vozes diferentes por execução | 10. Usar uma voz em várias falas conta uma vez só. |

Um diálogo precisa de pelo menos uma fala com texto. Uma execução sem texto em nenhuma fala é recusada antes de começar.

## Vozes e tags de áudio
Cada fala pode usar qualquer voz: vozes prontas, vozes da Biblioteca de vozes e as suas próprias vozes, em qualquer combinação. Não existe uma lista separada de vozes para diálogo.

As falas entendem as mesmas tags de áudio que o ElevenLabs v3 no [Texto para fala](https://nodaro.ai/docs/nodes/audio/text-to-speech#add-emotion-with-audio-tags), como `[laughs]`, `[whispers]` e `[sighs]`.

## Modelos
O Texto para diálogo executa o ElevenLabs Dialogue v3. O preço dele é definido por 1.000 caracteres de roteiro.

| Model | Maker | Modes | Credits | Details |
| --- | --- | --- | --- | --- |
| [ElevenLabs Dialogue v3](https://nodaro.ai/docs/models/audio/elevenlabs-dialogue-v3) | ElevenLabs | Multi-speaker dialogue | 28 | Multi-speaker dialogue via the direct ElevenLabs API — give it a script, it voices each role (any voice: premade, library, or cloned). |

## Dicas
- **Dê a cada falante uma voz claramente diferente.** Assim, quem ouve acompanha a conversa com mais facilidade. Ouça as prévias das vozes no explorador de vozes antes de atribuí-las.
- **Mantenha as falas no tom de conversa.** Várias falas curtas soam mais naturais que um parágrafo longo em uma só fala.
- **Comece com a estabilidade em Equilibrado.** Diminua para uma cena dramática ou emotiva, e aumente para uma leitura formal, no estilo de narração.
- **Defina o idioma em conversas com mais de um idioma.** A detecção automática funciona bem para um idioma só. Quando os falantes trocam de idioma, escolha o idioma principal explicitamente.
- **Junte conversas longas.** Divida uma conversa longa em vários nós e junte as partes, uma após a outra, com [**Combinar áudio** (Combine Audio)](https://nodaro.ai/docs/nodes/audio/combine-audio).

## Pela API
A mesma geração está disponível como a ferramenta MCP `generate_dialogue`. Veja as [ferramentas MCP](https://nodaro.ai/docs/mcp/tools) e [Voz e mídia](https://nodaro.ai/docs/developers/api/voice-and-media).

## Frequently asked questions

### Quantas vozes um diálogo pode ter?

Até 10 vozes diferentes por execução. Usar a mesma voz em várias falas conta uma vez só, então uma conversa entre duas pessoas com 40 falas usa só 2 das 10.

### Qual pode ser o tamanho de um diálogo?

Até 5.000 caracteres somando todas as falas, e até 2.000 caracteres dá a melhor qualidade. Divida uma conversa mais longa em vários nós “Texto para diálogo” e junte as partes com “Combinar áudio”.

### Posso receber cada fala como um arquivo de áudio separado?

Não. O “Texto para diálogo” retorna um único arquivo contínuo com todas as falas em ordem. Para ter clipes separados, use um nó “Texto para fala” por fala.

### Posso transformar um roteiro escrito em falas de diálogo automaticamente?

Sim. Conecte a saída “Diálogo” de um nó “Gerar roteiro” à entrada “Prompt” do nó. No painel de configurações, clique no botão que preenche as falas, como “Preencher falas do roteiro (12)”, e escolha uma voz para cada falante.

### Como obtenho o mesmo take de novo?

Defina uma “Seed”. A mesma seed, as mesmas falas e as mesmas configurações reproduzem o mesmo áudio. Deixe “Seed” vazia para ter um take novo a cada execução.
