# Design de voz

> Crie uma nova voz a partir de uma descrição, com controle de modelo, volume, orientação e seed. Receba uma prévia em áudio e um ID de voz reutilizável.

Source: https://nodaro.ai/pt-BR/docs/nodes/audio/voice-design

O nó **Design de voz** (Voice Design) cria uma nova voz a partir de uma descrição escrita. Você descreve a voz e dá a ela um texto para falar, e o nó retorna uma prévia em áudio da nova voz e o ID dessa voz. Ao contrário do [**Remix de voz** (Voice Remix)](https://nodaro.ai/docs/nodes/audio/voice-remix), ele dá controle sobre o modelo, o volume, a orientação, a seed e a qualidade, para que você possa refinar uma voz e reproduzi-la.

- Found in: Audio › Voices
- Output: audio
- API type: `voice-design`

## Quando usar
- Você quer uma voz de marca com configurações que possa reproduzir em todo um projeto.
- Você quer vozes de personagens com qualidades específicas, como idade, sotaque, tom e forma de falar.
- Você quer refinar uma voz passo a passo, uma configuração de cada vez.
- Você quer um ID de voz para guardar, e não só uma prévia.

## Início rápido
### Adicionar o nó
Pressione Tab no canvas e escolha **Áudio › Vozes › Design de voz**.

### Descrever a voz
Abra o painel de configurações e escreva a **Descrição da voz**, por exemplo: “A warm, deep male voice with a British accent and a calm delivery.”

### Escrever o texto da prévia
Escreva de 100 a 1.000 caracteres em **Texto da prévia**. A nova voz fala esse texto na prévia. Você também pode conectar um nó de texto à entrada **Prompt** para fornecer esse texto.

### Executar
Clique em **Executar** no nó. A prévia aparece no nó com um player, e o ID da voz aparece logo abaixo. Clique no ID da voz para copiá-lo.

Workflow: Dois seletores de voz descrevem a voz, um nó Texto fornece as falas da prévia e o Design de voz cria a voz.

- Perfil da voz → Design de voz (estilo de áudio)
- Estilo de fala → Design de voz (estilo de áudio)
- Texto → Design de voz (prompt)

## Entradas e saídas
| Entrada | Aceita | O que faz |
| --- | --- | --- |
| **Prompt** | Nós de texto, como **Texto** (Text) e **Prompt** | O texto da prévia. Quando conectado, ele é usado no lugar do campo Texto da prévia. |
| **Estilo de áudio** | Seletores de voz, como **Perfil da voz** (Voice Character) e **Estilo de fala** (Voice Delivery) | Adiciona o texto dos seletores à descrição da voz. Esse texto é encurtado quando necessário, para que a descrição inteira fique dentro de 1.000 caracteres. |

| Saída | O que contém |
| --- | --- |
| **Áudio** | A prévia em áudio: a nova voz falando o texto da prévia. |
| **ID da voz** | O ID da nova voz. O painel de configurações também o mostra em **ID da voz gerada**. |

## Configurações
| Configuração | O que faz |
| --- | --- |
| **Descrição da voz** | A voz em palavras simples: idade, gênero, sotaque, tom, ritmo e emoção. |
| **Texto da prévia (100-1.000 caracteres)** | O texto que a nova voz fala na prévia, de 100 a 1.000 caracteres. Com o ElevenLabs v3, digite `[` para inserir uma tag de áudio. |
| **Modelo** | **ElevenLabs v3 (recomendado)**, o padrão, ou **ElevenLabs Multilingual v2**. |
| **Volume** | De -1 (baixo) a 1 (alto). O padrão é 0, o nível normal do modelo. |
| **Escala de orientação** | De 0 (criativo) a 100 (rigoroso). O padrão é 5. Define o quão literalmente o modelo segue a descrição. |
| **Seed (opcional)** | Um número fixo que torna uma voz reproduzível. Deixe vazio para ter uma voz nova a cada execução. |
| **Qualidade (opcional)** | Um valor mais alto dá mais qualidade e menos variedade. Deixe vazio para usar o padrão do modelo. |
| **Melhorar a qualidade do áudio** | Limpa o áudio da prévia depois da geração. Desligado por padrão. |
| **Texto antes e depois** | Texto que é sempre adicionado antes e depois da descrição. Ele fica oculto para quem usa o seu workflow como app. Veja [Texto antes e depois do prompt](https://nodaro.ai/docs/concepts/prompt-pre-post-text). |

## Modelos
| Model | Maker | Modes | Credits | Details |
| --- | --- | --- | --- | --- |
| [ElevenLabs Voice Design](https://nodaro.ai/docs/models/audio/elevenlabs-voice-design) | ElevenLabs | Voice design | 55 | Design a synthetic voice from a description (no reference clip needed). |

Use o **ElevenLabs v3**, o padrão, para ter a melhor qualidade e o suporte mais amplo a idiomas. Mude para o **ElevenLabs Multilingual v2** só quando o v3 der um resultado inesperado para uma voz específica.

## Como escrever uma boa descrição
- **Cite qualidades concretas.** “Gravelly baritone, speaks slowly, sounds like a late-night radio host” funciona melhor que “a cool, interesting voice”.
- **Cubra o básico.** Faixa etária, gênero, sotaque, tom, ritmo e qualidade emocional.
- **Adapte o texto da prévia ao uso final.** Escreva o texto da prévia no estilo do conteúdo final, para ouvir a voz como ela será usada.

## Guardar e reutilizar uma voz
- **Fixe a seed.** Quando uma execução gerar uma voz de que você goste, anote a **Seed**, a descrição e o modelo. Mudar qualquer um deles pode mudar a voz.
- **Copie o ID da voz.** Depois de uma execução, o ID da voz aparece no nó e em **ID da voz gerada**, no painel de configurações. Clique nele no nó para copiá-lo.
- **Equilibre várias vozes.** Use **Volume** para deixar as vozes que você cria no mesmo nível.

## Design de voz ou Remix de voz
| | Design de voz | [Remix de voz](https://nodaro.ai/docs/nodes/audio/voice-remix) |
| --- | --- | --- |
| **Controles** | Modelo, volume, orientação, seed, qualidade, melhoria do áudio | Só descrição e texto da prévia |
| **Saídas** | Prévia em áudio e ID da voz | Prévia em áudio |
| **Ideal para** | Uma voz que você vai guardar e reproduzir | Explorar ideias de voz rapidamente |

## Dicas
- **Comece com a Escala de orientação em 5.** Aumente para perto de 20 ou 30 para uma descrição precisa. Diminua para perto de 1 ou 2 para uma voz mais livre e natural. Valores muito altos podem reduzir a qualidade.
- **Deixe “Melhorar a qualidade do áudio” desligado enquanto explora.** Ligue essa opção na execução final, porque ela aumenta o tempo de processamento.
- **Explore primeiro com o Remix de voz.** Teste ideias rapidamente no [Remix de voz](https://nodaro.ai/docs/nodes/audio/voice-remix) e depois recrie a melhor aqui, com controle total.

## Pela API
`POST /v1/voice-design` recebe `text` (o texto da prévia), `voiceDescription` e os opcionais `model`, `loudness`, `guidanceScale`, `seed`, `quality` e `shouldEnhance`. A ferramenta MCP é `voice_design`. Veja [Voz e mídia](https://nodaro.ai/docs/developers/api/voice-and-media).

## Frequently asked questions

### Qual é a diferença entre “Design de voz” e “Remix de voz”?

Os dois criam uma voz a partir de uma descrição escrita. “Design de voz” acrescenta controles de modelo, volume, orientação, seed e qualidade, e também retorna um ID de voz. “Remix de voz” é a versão rápida, só com uma descrição e um texto de prévia.

### Qual deve ser o tamanho do texto da prévia?

Entre 100 e 1.000 caracteres. Escreva texto suficiente para ouvir a voz em sons e formatos de frase diferentes, por exemplo duas ou três frases naturais.

### Como obtenho a mesma voz de novo?

Defina um valor em “Seed” quando encontrar uma voz de que goste. A mesma seed, a mesma descrição e o mesmo modelo devem gerar a mesma voz de novo. Mudar qualquer configuração pode gerar uma voz diferente, mesmo com a mesma seed.

### O que a “Escala de orientação” faz?

Ela define o quanto o modelo segue a sua descrição à risca. O padrão é 5. Aumente para perto de 20 ou 30 para uma descrição precisa, ou diminua para perto de 1 ou 2 para um resultado mais natural.

### Posso descrever a voz com seletores em vez de palavras?

Sim. Conecte à entrada “Estilo de áudio” um seletor “Perfil da voz”, para idade, gênero, idioma, sotaque e timbre, ou um seletor “Estilo de fala”, para ritmo, emoção e arquétipo. O texto deles é adicionado à sua descrição.
