Detectar silêncio
Encontre os silêncios de uma gravação ou vídeo em intervalos de tempo, prontos para cortar na edição. 11 créditos fixos por execução, sem modelo de IA.
O nó Detectar silêncio (Silence Detect) encontra os trechos silenciosos de uma gravação ou de um vídeo e os retorna como uma lista de intervalos de tempo. Use os intervalos para cortar os silêncios de um podcast ou de uma entrevista, por exemplo com o Plano de edição (Edit Plan). O nó é executado localmente, sem modelo de IA e sem chave de provedor, então funciona em todas as edições.
Quando usar
- Encontrar silêncios e pausas longas em um podcast ou em uma entrevista antes de editar.
- Passar a uma etapa de edição os silêncios exatos que ela deve remover.
- Medir quanto de uma gravação é silêncio e quanto é fala.
Início rápido
Adicione o nó
Pressione Tab no canvas e escolha Áudio › Análise › Detectar silêncio.
Conecte a gravação
Conecte um nó de áudio ou de vídeo à entrada Áudio ou vídeo. No caso de um vídeo, o nó usa a faixa de áudio dele.
Execute
Clique em Executar no nó. Os trechos silenciosos aparecem na saída Silêncios, como dados.
Entrada e saída
| Entrada | Aceita | O que faz |
|---|---|---|
| Áudio ou vídeo | Nós de áudio e de vídeo | A gravação a analisar. Obrigatória. |
A saída, Silêncios, é de dados, não de áudio. Conecte-a a um nó que leia dados, como a entrada Silêncio do Plano de edição ou um nó Extrair campo (Extract Field).
Configurações
| Configuração | O que faz |
|---|---|
| Limite de silêncio (dB) | Um som mais baixo que este nível conta como silêncio. De -60 a -10. O padrão é -35. Um valor mais baixo é mais rigoroso: só o silêncio quase total conta. |
| Silêncio mínimo (ms) | Só são informadas as pausas com pelo menos essa duração. De 100 a 3.000. O padrão é 700. |
| Margem de fala (ms) | O espaço mantido em volta da fala. De 0 a 1.000. O padrão é 120. Cada trecho silencioso é encurtado nesse valor, para dentro, nas duas pontas, para que um corte não atinja uma respiração nem o início de uma palavra. Um trecho que ficaria sem duração é descartado. |
Leia o resultado
A saída Silêncios tem esta forma:
{
"version": 1,
"ranges": [
{ "startMs": 2120, "endMs": 3880 }
],
"durationMs": 6000
}ranges— os trechos silenciosos, na ordem em que ocorrem, em milissegundos no relógio da gravação original.endMsé exclusivo e sempre maior questartMs.durationMs— a duração da gravação inteira, em milissegundos.
Exemplo
Uma gravação de 6 segundos fica em silêncio entre as marcas de 2 e de 4 segundos. Com as configurações padrão:
- O nó encontra um trecho silencioso de cerca de 2.000 a cerca de 4.000 milissegundos. Com 2 segundos, ele é mais longo que o mínimo de 700 ms.
- A margem de fala de 120 ms encurta o trecho nas duas pontas. O início passa a ser 2.000 + 120 = 2.120 ms, e o fim passa a ser 4.000 - 120 = 3.880 ms.
O resultado é o JSON acima, e a execução custa 11 créditos.
Créditos
O nó Detectar silêncio custa 11 créditos fixos por execução. A duração da gravação, as configurações e o número de intervalos encontrados não alteram o preço.
O nó analisa uma cópia pequena, de baixa resolução, da faixa de áudio, então até uma gravação longa é analisada em segundos.
Dicas
- Ignore as respirações. Aumente o Silêncio mínimo para pular respirações curtas e as pausas entre as palavras. Diminua o valor para pegar pausas breves.
- Proteja as palavras. Se os cortes atingirem o início das palavras, aumente a Margem de fala. Se os silêncios parecerem generosos demais, diminua o valor.
- Trate o som ambiente como silêncio. Uma sala silenciosa pode ser mais alta que o limite padrão. Aumente o Limite de silêncio, por exemplo de -35 para -30.
- Mantenha o relógio da origem. Os intervalos usam a linha do tempo da gravação original, então se alinham com o mesmo áudio ou vídeo em uma edição posterior.
Pela API
POST /v1/silence-detect recebe audioUrl e, opcionalmente, thresholdDb (padrão -35), minSilenceMs (padrão 700) e padMs (padrão 120). O output_data.json da execução concluída é o resultado acima. A ferramenta MCP é silence_detect. Veja Voz e mídia.
Perguntas frequentes
Páginas relacionadas
Plano de edição
Aplicar EDL
Transcrever
Sincronizar áudio
Última atualização
Separar com Suno
Divida uma música feita no Suno em uma faixa vocal e uma instrumental, ou em até 12 stems, como bateria, baixo, guitarra e piano, direto de um nó do Suno.
Sincronizar áudio
Meça pelo som a defasagem de 2 a 6 gravações de uma conversa e alinhe uma edição multicâmera sem digitar deslocamentos. Também informa o desvio de relógio.