Docs do Nodaro
DocumentaçãoReferência de nósModelosAgentes de IA (MCP)DesenvolvedoresSelf-hostingPesquisa
Áudio

Detectar silêncio

Encontre os silêncios de uma gravação ou vídeo em intervalos de tempo, prontos para cortar na edição. 11 créditos fixos por execução, sem modelo de IA.

O nó Detectar silêncio (Silence Detect) encontra os trechos silenciosos de uma gravação ou de um vídeo e os retorna como uma lista de intervalos de tempo. Use os intervalos para cortar os silêncios de um podcast ou de uma entrevista, por exemplo com o Plano de edição (Edit Plan). O nó é executado localmente, sem modelo de IA e sem chave de provedor, então funciona em todas as edições.

Quando usar

  • Encontrar silêncios e pausas longas em um podcast ou em uma entrevista antes de editar.
  • Passar a uma etapa de edição os silêncios exatos que ela deve remover.
  • Medir quanto de uma gravação é silêncio e quanto é fala.

Início rápido

Adicione o nó

Pressione Tab no canvas e escolha Áudio › Análise › Detectar silêncio.

Conecte a gravação

Conecte um nó de áudio ou de vídeo à entrada Áudio ou vídeo. No caso de um vídeo, o nó usa a faixa de áudio dele.

Execute

Clique em Executar no nó. Os trechos silenciosos aparecem na saída Silêncios, como dados.

áudioáudio ou vídeoorigenstranscriçãosilêncioEDLEnviar vídeoEpisódio de podcastTranscreverDetectar silêncioPlano de ediçãoEnxugarAplicar EDL
Um podcast é transcrito e analisado em busca de silêncios; o Plano de edição usa os dois resultados para enxugar o episódio, e o Aplicar EDL renderiza o corte.

Entrada e saída

EntradaAceitaO que faz
Áudio ou vídeoNós de áudio e de vídeoA gravação a analisar. Obrigatória.

A saída, Silêncios, é de dados, não de áudio. Conecte-a a um nó que leia dados, como a entrada Silêncio do Plano de edição ou um nó Extrair campo (Extract Field).

Configurações

ConfiguraçãoO que faz
Limite de silêncio (dB)Um som mais baixo que este nível conta como silêncio. De -60 a -10. O padrão é -35. Um valor mais baixo é mais rigoroso: só o silêncio quase total conta.
Silêncio mínimo (ms)Só são informadas as pausas com pelo menos essa duração. De 100 a 3.000. O padrão é 700.
Margem de fala (ms)O espaço mantido em volta da fala. De 0 a 1.000. O padrão é 120. Cada trecho silencioso é encurtado nesse valor, para dentro, nas duas pontas, para que um corte não atinja uma respiração nem o início de uma palavra. Um trecho que ficaria sem duração é descartado.

Leia o resultado

A saída Silêncios tem esta forma:

{
  "version": 1,
  "ranges": [
    { "startMs": 2120, "endMs": 3880 }
  ],
  "durationMs": 6000
}
  • ranges — os trechos silenciosos, na ordem em que ocorrem, em milissegundos no relógio da gravação original. endMs é exclusivo e sempre maior que startMs.
  • durationMs — a duração da gravação inteira, em milissegundos.

Exemplo

Uma gravação de 6 segundos fica em silêncio entre as marcas de 2 e de 4 segundos. Com as configurações padrão:

  1. O nó encontra um trecho silencioso de cerca de 2.000 a cerca de 4.000 milissegundos. Com 2 segundos, ele é mais longo que o mínimo de 700 ms.
  2. A margem de fala de 120 ms encurta o trecho nas duas pontas. O início passa a ser 2.000 + 120 = 2.120 ms, e o fim passa a ser 4.000 - 120 = 3.880 ms.

O resultado é o JSON acima, e a execução custa 11 créditos.

Créditos

O nó Detectar silêncio custa 11 créditos fixos por execução. A duração da gravação, as configurações e o número de intervalos encontrados não alteram o preço.

O nó analisa uma cópia pequena, de baixa resolução, da faixa de áudio, então até uma gravação longa é analisada em segundos.

Dicas

  • Ignore as respirações. Aumente o Silêncio mínimo para pular respirações curtas e as pausas entre as palavras. Diminua o valor para pegar pausas breves.
  • Proteja as palavras. Se os cortes atingirem o início das palavras, aumente a Margem de fala. Se os silêncios parecerem generosos demais, diminua o valor.
  • Trate o som ambiente como silêncio. Uma sala silenciosa pode ser mais alta que o limite padrão. Aumente o Limite de silêncio, por exemplo de -35 para -30.
  • Mantenha o relógio da origem. Os intervalos usam a linha do tempo da gravação original, então se alinham com o mesmo áudio ou vídeo em uma edição posterior.

Pela API

POST /v1/silence-detect recebe audioUrl e, opcionalmente, thresholdDb (padrão -35), minSilenceMs (padrão 700) e padMs (padrão 120). O output_data.json da execução concluída é o resultado acima. A ferramenta MCP é silence_detect. Veja Voz e mídia.

Perguntas frequentes

Última atualização

Nesta página