Texto para diálogo
Dê voz a uma conversa inteira em um só áudio: uma voz por fala, tags de áudio para emoção ou falas preenchidas com um roteiro. ElevenLabs Dialogue v3.
O nó Texto para diálogo (Text to Dialogue) dá voz a uma conversa inteira em um só arquivo de áudio. Você escreve as falas, dá uma voz a cada uma, e o ElevenLabs Dialogue v3 as fala em ordem, como uma troca natural. Use-o para entrevistas, conversas no estilo podcast e cenas de diálogo, em vez de gerar clipes de fala separados e emendá-los.
Quando usar
- Uma conversa no estilo podcast entre dois ou mais falantes.
- Uma entrevista com uma voz de apresentador e uma voz de convidado.
- Uma faixa de diálogo para um vídeo animado ou um vídeo explicativo.
- Uma cena de diálogo em um audiolivro, com uma voz por personagem.
- Um protótipo rápido, em áudio, de uma conversa.
Para uma única voz lendo um texto, use Texto para fala (Text to Speech).
Início rápido
Adicione o nó
Pressione Tab no canvas e escolha Áudio › Fala e narração › Texto para diálogo.
Escreva as falas
Abra o painel de configurações. Em Falas, escolha uma voz para a primeira fala e digite o texto dela. Clique em Adicionar fala para cada nova fala da conversa.
Ou preencha as falas com um roteiro
Conecte a saída Diálogo de um nó Gerar roteiro (Generate Script) à entrada Prompt. No painel de configurações, clique no botão que preenche as falas, como Preencher falas do roteiro (12). Depois, escolha uma voz para cada falante.
Execute
Clique em Executar no nó. O nó retorna um só arquivo de áudio com todas as falas em ordem.
Entradas
| Entrada | Aceita | O que faz |
|---|---|---|
| Prompt | Nós de texto, como Gerar roteiro | Quando a saída Diálogo de um nó Gerar roteiro está conectada, o painel de configurações oferece um botão que preenche as falas com o roteiro. As falas do painel são o que o nó fala. |
A saída, Áudio, é um só arquivo de áudio contínuo, com todas as falas ditas em ordem.
Configurações
| Configuração | O que faz |
|---|---|
| Falas | As falas da conversa, em ordem. Cada fala tem a própria voz e o próprio texto. Digite [ ou / em uma fala para inserir uma tag de áudio. Falas vazias são ignoradas. |
| Adicionar fala | Adiciona uma fala no final. O botão de lixeira remove uma fala. |
| Preencher falas do roteiro (…) | Aparece quando a saída Diálogo de um nó Gerar roteiro está conectada. Substitui as falas por uma fala para cada linha do roteiro. Cada fala mantém o nome do falante e começa com a voz padrão, Sarah. |
| Estabilidade | Mais variável (0), Equilibrado (0,5) (o padrão) ou Mais estável (1,0). Mais baixo é mais dramático, e mais alto é mais uniforme. |
| Idioma | Detecção automática (o padrão) ou um idioma. |
| Seed | Um número inteiro de 0 a 4.294.967.295. A mesma seed, as mesmas falas e as mesmas configurações reproduzem o mesmo áudio. Deixe vazio para ter um take aleatório. |
| Normalização de texto | Automática (o padrão), Ativada ou Desativada. Quando ativada, números, datas e abreviações são escritos por extenso, para soarem naturais. |
O painel conta as vozes e os caracteres enquanto você escreve, por exemplo 2/10 voices e 840/5000.
Limites
| Limite | Valor |
|---|---|
| Texto somando todas as falas | 5.000 caracteres. Até 2.000 caracteres dá a melhor qualidade. |
| Vozes diferentes por execução | 10. Usar uma voz em várias falas conta uma vez só. |
Um diálogo precisa de pelo menos uma fala com texto. Uma execução sem texto em nenhuma fala é recusada antes de começar.
Vozes e tags de áudio
Cada fala pode usar qualquer voz: vozes prontas, vozes da Biblioteca de vozes e as suas próprias vozes, em qualquer combinação. Não existe uma lista separada de vozes para diálogo.
As falas entendem as mesmas tags de áudio que o ElevenLabs v3 no Texto para fala, como [laughs], [whispers] e [sighs].
Modelos
O Texto para diálogo executa o ElevenLabs Dialogue v3. O preço dele é definido por 1.000 caracteres de roteiro.
| Modelo | Desenvolvedor | Modos | Créditos | Detalhes |
|---|---|---|---|---|
| ElevenLabs Dialogue v3 | ElevenLabs | Diálogo com vários falantes | 28 | Diálogo com vários falantes pela API direta da ElevenLabs — você fornece um roteiro e ele dá voz a cada papel (qualquer voz: pronta, da biblioteca ou clonada). |
Dicas
- Dê a cada falante uma voz claramente diferente. Assim, quem ouve acompanha a conversa com mais facilidade. Ouça as prévias das vozes no explorador de vozes antes de atribuí-las.
- Mantenha as falas no tom de conversa. Várias falas curtas soam mais naturais que um parágrafo longo em uma só fala.
- Comece com a estabilidade em Equilibrado. Diminua para uma cena dramática ou emotiva, e aumente para uma leitura formal, no estilo de narração.
- Defina o idioma em conversas com mais de um idioma. A detecção automática funciona bem para um idioma só. Quando os falantes trocam de idioma, escolha o idioma principal explicitamente.
- Junte conversas longas. Divida uma conversa longa em vários nós e junte as partes, uma após a outra, com Combinar áudio (Combine Audio).
Pela API
A mesma geração está disponível como a ferramenta MCP generate_dialogue. Veja as ferramentas MCP e Voz e mídia.
Perguntas frequentes
Páginas relacionadas
Texto para fala
Gerar roteiro
Combinar áudio
Mixar áudio
ElevenLabs Dialogue v3
Última atualização
Texto para fala
Transforme texto em fala natural com o ElevenLabs v3, Turbo v2.5 ou Multilingual v2. Escolha uma voz, dê emoção com tags de áudio e fale em até 46 idiomas.
Modificador de voz
Troque a voz de uma gravação ou de um vídeo com fala por outra voz e mantenha a emoção, o ritmo e o timing originais. Fala para fala com o ElevenLabs.