Design de voz
Crie uma nova voz a partir de uma descrição, com controle de modelo, volume, orientação e seed. Receba uma prévia em áudio e um ID de voz reutilizável.
O nó Design de voz (Voice Design) cria uma nova voz a partir de uma descrição escrita. Você descreve a voz e dá a ela um texto para falar, e o nó retorna uma prévia em áudio da nova voz e o ID dessa voz. Ao contrário do Remix de voz (Voice Remix), ele dá controle sobre o modelo, o volume, a orientação, a seed e a qualidade, para que você possa refinar uma voz e reproduzi-la.
Quando usar
- Você quer uma voz de marca com configurações que possa reproduzir em todo um projeto.
- Você quer vozes de personagens com qualidades específicas, como idade, sotaque, tom e forma de falar.
- Você quer refinar uma voz passo a passo, uma configuração de cada vez.
- Você quer um ID de voz para guardar, e não só uma prévia.
Início rápido
Adicionar o nó
Pressione Tab no canvas e escolha Áudio › Vozes › Design de voz.
Descrever a voz
Abra o painel de configurações e escreva a Descrição da voz, por exemplo: “A warm, deep male voice with a British accent and a calm delivery.”
Escrever o texto da prévia
Escreva de 100 a 1.000 caracteres em Texto da prévia. A nova voz fala esse texto na prévia. Você também pode conectar um nó de texto à entrada Prompt para fornecer esse texto.
Executar
Clique em Executar no nó. A prévia aparece no nó com um player, e o ID da voz aparece logo abaixo. Clique no ID da voz para copiá-lo.
Entradas e saídas
| Entrada | Aceita | O que faz |
|---|---|---|
| Prompt | Nós de texto, como Texto (Text) e Prompt | O texto da prévia. Quando conectado, ele é usado no lugar do campo Texto da prévia. |
| Estilo de áudio | Seletores de voz, como Perfil da voz (Voice Character) e Estilo de fala (Voice Delivery) | Adiciona o texto dos seletores à descrição da voz. Esse texto é encurtado quando necessário, para que a descrição inteira fique dentro de 1.000 caracteres. |
| Saída | O que contém |
|---|---|
| Áudio | A prévia em áudio: a nova voz falando o texto da prévia. |
| ID da voz | O ID da nova voz. O painel de configurações também o mostra em ID da voz gerada. |
Configurações
| Configuração | O que faz |
|---|---|
| Descrição da voz | A voz em palavras simples: idade, gênero, sotaque, tom, ritmo e emoção. |
| Texto da prévia (100-1.000 caracteres) | O texto que a nova voz fala na prévia, de 100 a 1.000 caracteres. Com o ElevenLabs v3, digite [ para inserir uma tag de áudio. |
| Modelo | ElevenLabs v3 (recomendado), o padrão, ou ElevenLabs Multilingual v2. |
| Volume | De -1 (baixo) a 1 (alto). O padrão é 0, o nível normal do modelo. |
| Escala de orientação | De 0 (criativo) a 100 (rigoroso). O padrão é 5. Define o quão literalmente o modelo segue a descrição. |
| Seed (opcional) | Um número fixo que torna uma voz reproduzível. Deixe vazio para ter uma voz nova a cada execução. |
| Qualidade (opcional) | Um valor mais alto dá mais qualidade e menos variedade. Deixe vazio para usar o padrão do modelo. |
| Melhorar a qualidade do áudio | Limpa o áudio da prévia depois da geração. Desligado por padrão. |
| Texto antes e depois | Texto que é sempre adicionado antes e depois da descrição. Ele fica oculto para quem usa o seu workflow como app. Veja Texto antes e depois do prompt. |
Modelos
| Modelo | Desenvolvedor | Modos | Créditos | Detalhes |
|---|---|---|---|---|
| ElevenLabs Voice Design | ElevenLabs | Design de voz | 55 | Cria uma voz sintética a partir de uma descrição (não precisa de clipe de referência). |
Use o ElevenLabs v3, o padrão, para ter a melhor qualidade e o suporte mais amplo a idiomas. Mude para o ElevenLabs Multilingual v2 só quando o v3 der um resultado inesperado para uma voz específica.
Como escrever uma boa descrição
- Cite qualidades concretas. “Gravelly baritone, speaks slowly, sounds like a late-night radio host” funciona melhor que “a cool, interesting voice”.
- Cubra o básico. Faixa etária, gênero, sotaque, tom, ritmo e qualidade emocional.
- Adapte o texto da prévia ao uso final. Escreva o texto da prévia no estilo do conteúdo final, para ouvir a voz como ela será usada.
Guardar e reutilizar uma voz
- Fixe a seed. Quando uma execução gerar uma voz de que você goste, anote a Seed, a descrição e o modelo. Mudar qualquer um deles pode mudar a voz.
- Copie o ID da voz. Depois de uma execução, o ID da voz aparece no nó e em ID da voz gerada, no painel de configurações. Clique nele no nó para copiá-lo.
- Equilibre várias vozes. Use Volume para deixar as vozes que você cria no mesmo nível.
Design de voz ou Remix de voz
| Design de voz | Remix de voz | |
|---|---|---|
| Controles | Modelo, volume, orientação, seed, qualidade, melhoria do áudio | Só descrição e texto da prévia |
| Saídas | Prévia em áudio e ID da voz | Prévia em áudio |
| Ideal para | Uma voz que você vai guardar e reproduzir | Explorar ideias de voz rapidamente |
Dicas
- Comece com a Escala de orientação em 5. Aumente para perto de 20 ou 30 para uma descrição precisa. Diminua para perto de 1 ou 2 para uma voz mais livre e natural. Valores muito altos podem reduzir a qualidade.
- Deixe “Melhorar a qualidade do áudio” desligado enquanto explora. Ligue essa opção na execução final, porque ela aumenta o tempo de processamento.
- Explore primeiro com o Remix de voz. Teste ideias rapidamente no Remix de voz e depois recrie a melhor aqui, com controle total.
Pela API
POST /v1/voice-design recebe text (o texto da prévia), voiceDescription e os opcionais model, loudness, guidanceScale, seed, quality e shouldEnhance. A ferramenta MCP é voice_design. Veja Voz e mídia.
Perguntas frequentes
Páginas relacionadas
Remix de voz
Texto para fala
Perfil da voz
Estilo de fala
ElevenLabs Voice Design
Última atualização
Modificador de voz Pro
Detecte cada falante de uma gravação ou de um vídeo com fala e dê a cada um uma nova voz, mantendo a emoção e o timing originais. Preço por minuto de fala.
Remix de voz
Descreva uma voz em palavras simples e ouça-a falar seu texto de prévia. O jeito rápido de explorar ideias de voz, sem gravação de referência nem ajustes.