Docs do Nodaro
DocumentaçãoReferência de nósModelosAgentes de IA (MCP)DesenvolvedoresSelf-hostingPesquisa
Áudio

Texto para diálogo

Dê voz a uma conversa inteira em um só áudio: uma voz por fala, tags de áudio para emoção ou falas preenchidas com um roteiro. ElevenLabs Dialogue v3.

O nó Texto para diálogo (Text to Dialogue) dá voz a uma conversa inteira em um só arquivo de áudio. Você escreve as falas, dá uma voz a cada uma, e o ElevenLabs Dialogue v3 as fala em ordem, como uma troca natural. Use-o para entrevistas, conversas no estilo podcast e cenas de diálogo, em vez de gerar clipes de fala separados e emendá-los.

Quando usar

  • Uma conversa no estilo podcast entre dois ou mais falantes.
  • Uma entrevista com uma voz de apresentador e uma voz de convidado.
  • Uma faixa de diálogo para um vídeo animado ou um vídeo explicativo.
  • Uma cena de diálogo em um audiolivro, com uma voz por personagem.
  • Um protótipo rápido, em áudio, de uma conversa.

Para uma única voz lendo um texto, use Texto para fala (Text to Speech).

Início rápido

Adicione o nó

Pressione Tab no canvas e escolha Áudio › Fala e narração › Texto para diálogo.

Escreva as falas

Abra o painel de configurações. Em Falas, escolha uma voz para a primeira fala e digite o texto dela. Clique em Adicionar fala para cada nova fala da conversa.

Ou preencha as falas com um roteiro

Conecte a saída Diálogo de um nó Gerar roteiro (Generate Script) à entrada Prompt. No painel de configurações, clique no botão que preenche as falas, como Preencher falas do roteiro (12). Depois, escolha uma voz para cada falante.

Execute

Clique em Executar no nó. O nó retorna um só arquivo de áudio com todas as falas em ordem.

promptáudioáudioGerar roteiroSaída DiálogoTexto para diálogoDuas vozesTexto para áudioAmbiente de caféMixar áudio
Um roteiro preenche as falas do diálogo, e a conversa é mixada sobre um som ambiente gerado.

Entradas

EntradaAceitaO que faz
PromptNós de texto, como Gerar roteiroQuando a saída Diálogo de um nó Gerar roteiro está conectada, o painel de configurações oferece um botão que preenche as falas com o roteiro. As falas do painel são o que o nó fala.

A saída, Áudio, é um só arquivo de áudio contínuo, com todas as falas ditas em ordem.

Configurações

ConfiguraçãoO que faz
FalasAs falas da conversa, em ordem. Cada fala tem a própria voz e o próprio texto. Digite [ ou / em uma fala para inserir uma tag de áudio. Falas vazias são ignoradas.
Adicionar falaAdiciona uma fala no final. O botão de lixeira remove uma fala.
Preencher falas do roteiro (…)Aparece quando a saída Diálogo de um nó Gerar roteiro está conectada. Substitui as falas por uma fala para cada linha do roteiro. Cada fala mantém o nome do falante e começa com a voz padrão, Sarah.
EstabilidadeMais variável (0), Equilibrado (0,5) (o padrão) ou Mais estável (1,0). Mais baixo é mais dramático, e mais alto é mais uniforme.
IdiomaDetecção automática (o padrão) ou um idioma.
SeedUm número inteiro de 0 a 4.294.967.295. A mesma seed, as mesmas falas e as mesmas configurações reproduzem o mesmo áudio. Deixe vazio para ter um take aleatório.
Normalização de textoAutomática (o padrão), Ativada ou Desativada. Quando ativada, números, datas e abreviações são escritos por extenso, para soarem naturais.

O painel conta as vozes e os caracteres enquanto você escreve, por exemplo 2/10 voices e 840/5000.

Limites

LimiteValor
Texto somando todas as falas5.000 caracteres. Até 2.000 caracteres dá a melhor qualidade.
Vozes diferentes por execução10. Usar uma voz em várias falas conta uma vez só.

Um diálogo precisa de pelo menos uma fala com texto. Uma execução sem texto em nenhuma fala é recusada antes de começar.

Vozes e tags de áudio

Cada fala pode usar qualquer voz: vozes prontas, vozes da Biblioteca de vozes e as suas próprias vozes, em qualquer combinação. Não existe uma lista separada de vozes para diálogo.

As falas entendem as mesmas tags de áudio que o ElevenLabs v3 no Texto para fala, como [laughs], [whispers] e [sighs].

Modelos

O Texto para diálogo executa o ElevenLabs Dialogue v3. O preço dele é definido por 1.000 caracteres de roteiro.

ModeloDesenvolvedorModosCréditosDetalhes
ElevenLabs Dialogue v3ElevenLabsDiálogo com vários falantes28Diálogo com vários falantes pela API direta da ElevenLabs — você fornece um roteiro e ele dá voz a cada papel (qualquer voz: pronta, da biblioteca ou clonada).

Dicas

  • Dê a cada falante uma voz claramente diferente. Assim, quem ouve acompanha a conversa com mais facilidade. Ouça as prévias das vozes no explorador de vozes antes de atribuí-las.
  • Mantenha as falas no tom de conversa. Várias falas curtas soam mais naturais que um parágrafo longo em uma só fala.
  • Comece com a estabilidade em Equilibrado. Diminua para uma cena dramática ou emotiva, e aumente para uma leitura formal, no estilo de narração.
  • Defina o idioma em conversas com mais de um idioma. A detecção automática funciona bem para um idioma só. Quando os falantes trocam de idioma, escolha o idioma principal explicitamente.
  • Junte conversas longas. Divida uma conversa longa em vários nós e junte as partes, uma após a outra, com Combinar áudio (Combine Audio).

Pela API

A mesma geração está disponível como a ferramenta MCP generate_dialogue. Veja as ferramentas MCP e Voz e mídia.

Perguntas frequentes

Última atualização

Nesta página