Docs do Nodaro
DocumentaçãoReferência de nósModelosAgentes de IA (MCP)DesenvolvedoresSelf-hostingPesquisa
Referência das ferramentas

Análise e listas de edição

Analise um vídeo cena a cena, audite a análise, detecte silêncios, sincronize gravações e planeje e renderize listas de decisões de edição com o MCP.

As ferramentas de análise e listas de edição leem gravações existentes e as transformam em dados estruturados ou em montagens prontas. video_analysis e video_audit decompõem um vídeo cena a cena para que ele possa ser recriado, silence_detect e audio_sync medem gravações, e plan_edit e apply_edl planejam e renderizam cortes a partir de uma transcrição. Todas as ferramentas precisam da permissão workflows:execute e retornam um ID de job.

video_analysis

Analisa um vídeo e o decompõe cena a cena, num formato feito para a recriação com IA. Funciona como o nó Análise de vídeo (Video Analysis).

  • As cenas são cortadas nos limites naturais e duram no máximo 8 segundos: uma geração de imagem ou de vídeo por cena.
  • visualResolved é uma descrição autônoma de cada cena, pronta para usar como prompt. É o campo que as etapas seguintes leem.
  • Cada cena também tem um enquadramento, um movimento de câmera e uma lista de camadas de áudio. A fala é citada palavra por palavra, a música e os efeitos sonoros são descritos para que possam ser gerados, e uma lista vazia significa silêncio.
  • Os slots são as pessoas, os objetos e os lugares recorrentes, para que você possa substituí-los pelos seus próprios personagens.

Permissão: workflows:execute. Créditos: conforme o nível e a duração do vídeo, na tabela abaixo.

ParâmetroTipoObservações
video_asset_id, video_url ou youtube_urlstringObrigatório, exatamente um. Um ID de job de vídeo ou de upload do Nodaro, uma URL direta de vídeo ou um link do YouTube. Até 10 minutos; sem transmissões ao vivo. Informar zero ou duas origens retorna um erro.
llm_modelstringO nível: pro (padrão), fast (mais barato), smart (o mais preciso), mixed ou mixed-fast.
selection_modestringchoose (padrão) ou combine, um resultado aprimorado e verificado, com o máximo de detalhes. combine é um pouco mais lento e é o recomendado.
variationsbooleanTambém detecta os diferentes visuais de cada pessoa ou coisa, como uma troca de roupa, um sonho ou um disfarce, e vincula cada visual às cenas dele. Padrão: false.
music_videobooleanTrata o clipe como um videoclipe: cada verso cantado é transcrito como fala. Padrão: false; nesse caso, os vocais que ninguém em cena interpreta fazem parte da camada de música.
translate_speech_to_englishbooleanRetorna as palavras faladas e cantadas em inglês. Padrão: false, o idioma original.
translate_on_screen_text_to_englishbooleanRetorna placas, legendas e títulos em inglês. Esse texto faz parte do prompt visual, então uma cena gerada de novo mostra o texto em inglês. Os nomes mantêm a forma original. Padrão: false.
analysis_focusstringUma orientação, com até 2.000 caracteres, por exemplo “focus on the product shots and on-screen text”.

Retorna: um ID de job. A análise, com meta, slots e scenes, fica no output_data do job.

O preço depende do nível e da faixa de duração, a menor entre 60, 180, 360 ou 600 segundos que comporta o vídeo. As faixas de 60, 180 e 360 segundos têm 3 segundos de tolerância cada uma, então um vídeo de até 1:03 é cobrado na faixa de 60 segundos:

NívelAté 60 sAté 180 sAté 360 sAté 600 s
fast200204567933
pro2382567041.162
mixed, mixed-fast2973218021.295
smart4555541.3942.284

list_models retorna os preços atuais.

video_audit

Assiste a um vídeo de novo, comparando-o com a análise dele, e corrige o que estiver errado. Cada correção é aplicada com verificações e informada, e o que não pôde ser corrigido é sinalizado, não alterado. Funciona como o nó Auditoria com IA (AI Audit).

Permissão: workflows:execute. Créditos: conforme a duração, e mais barato quando você passa uma análise.

ParâmetroTipoObservações
video_urlstringObrigatório. O vídeo a auditar.
analysisobjectA análise de uma chamada anterior de video_analysis ou video_audit, passada como está. Sem ela, a ferramenta primeiro executa uma análise rápida, o que custa mais.

Retorna: um ID de job. O output_data do job contém o relatório: o que foi verificado, o que mudou e o que ficou em aberto.

ExecuçãoAté 60 sAté 180 sAté 360 sAté 600 s
Com analysis2373197301.181
Sem analysis4365231.2962.114

silence_detect

Encontra os trechos de silêncio de uma gravação só pelo áudio: sem transcrição e sem imagens. Funciona como o nó Detectar silêncio (Silence Detect).

Permissão: workflows:execute. Créditos: 11.

ParâmetroTipoObservações
audio_urlstringObrigatório. Uma URL de áudio ou de vídeo. A faixa de áudio é lida nos dois casos.
threshold_dbnumberO nível de silêncio em dBFS, de -90 a 0. Padrão: -35, um bom piso para fala.
min_silence_msintegerO menor silêncio a informar, de 1 a 600.000 ms. Padrão: 700.
pad_msintegerA margem de fala mantida em volta de cada trecho, de 0 a 60.000 ms. Padrão: 120.

Retorna: um ID de job. O resultado é output_data.json, { ranges, durationMs }. Passe esse objeto, e não o output_data inteiro, como o silence de plan_edit, ou use ranges para escrever uma lista de edição à mão.

audio_sync

Mede a defasagem entre os relógios de 2 a 6 gravações de uma mesma conversa, como os arquivos das câmeras e um microfone principal, comparando o áudio delas. Funciona como o nó Sincronizar áudio (Audio Sync).

Permissão: workflows:execute. Créditos: de 11 com 2 origens a 55 com 6, conforme o número de gravações alinhadas à referência.

ParâmetroTipoObservações
sourcesarrayObrigatório. De 2 a 6 gravações, cada uma { id, url }, com um ID único. URLs de áudio ou de vídeo.
referencestringO ID da gravação usada como base para medir cada deslocamento. Padrão: a primeira.

Retorna: um ID de job. O resultado é output_data.json: { reference, offsets, notes }, em que cada deslocamento tem sourceId, offsetMs, confidence e driftMsPerHour. Um instante no relógio da referência é o instante na origem mais offsetMs. Confiança baixa e desvio de relógio são informados em notes, nunca corrigidos.

plan_edit

Transforma uma transcrição com marcação de tempo numa lista de decisões de edição para uma gravação. Ela lê a transcrição, nunca as imagens. Funciona como o nó Plano de edição (Edit Plan).

Permissão: workflows:execute. Créditos: de 33 a 1.628, conforme a duração da gravação, o modo e o nível. Somente no Nodaro Cloud.

ParâmetroTipoObservações
modestringObrigatório. tighten remove silêncios, palavras de preenchimento e falsos começos numa única montagem. clips encontra clipes curtos para compartilhar, com uma lista de edição para cada um. chapters marca capítulos com títulos.
transcriptobjectObrigatório. A transcrição em nível de palavra, de transcribe.
sourcesarrayObrigatório. De 1 a 6 gravações, cada uma com uma url e, opcionalmente, o id, o kind (video ou audio), o role (master-audio, camera, wide ou screen), os speakers e o offset_ms no relógio mestre. O id é o ID que você deu à gravação no audio_sync, com até 200 caracteres. Ele é obrigatório com offsets.
offsetsobject or stringO output_data.json de um job do audio_sync. A ferramenta grava cada deslocamento medido na origem com o mesmo id, no relógio da origem mestre. O offset_ms da própria origem prevalece.
transcript_source_idstringO id da origem a partir da qual a transcrição foi feita, quando você souber. A ferramenta então confere se essa origem está no relógio da origem mestre.
silenceobjectO resultado de silence_detect.
plan_tierstringeconomy, standard (padrão) ou premium.
countintegerPara clips: quantos clipes, de 1 a 50.
target_duration_secintegerPara clips: a duração de cada clipe, de 5 a 180 segundos.
target_aspectstring16:9, 9:16, 1:1 ou 4:5.
platform, instructions, style_guidestringOnde os clipes serão publicados e orientações em texto livre.

A origem mestre é a que tem a função master-audio ou, se nenhuma tiver, a primeira origem. A ferramenta recusa a chamada antes de qualquer cobrança quando os deslocamentos deixariam o corte fora de sincronia:

  • Uma origem não tem offset_ms, e o audio_sync não a mediu ou teve uma correspondência fraca com ela, com confiança menor que 0,5. Defina o offset_ms dela.
  • A origem mestre tem um offset_ms diferente de 0.
  • Outras origens usam deslocamentos medidos, mas o audio_sync não mediu a origem mestre, ou a correspondência dela é fraca.
  • offsets não é um resultado do audio_sync, ou uma origem não tem id para a associação.
  • A transcrição foi feita a partir de uma origem fora do relógio da origem mestre. Transcreva a origem mestre ou dê a essa origem a função master-audio.

Retorna: um ID de job. O plano fica no output_data do job, pronto para apply_edl.

apply_edl

Renderiza uma lista de decisões de edição numa montagem pronta. Funciona como o nó Aplicar EDL (Apply EDL), cuja página também informa o preço por minuto.

Permissão: workflows:execute. Créditos: cobrados por minuto de saída renderizada.

ParâmetroTipoObservações
edlobject or stringObrigatório. O plano de plan_edit ou uma lista que você escreveu. Os segments dela ficam em milissegundos inteiros num relógio master, e cada um indica uma das sources da EDL pelo ID. Uma renderização de vídeo precisa de uma origem de vídeo em cada segmento.
sourcesarrayURLs que substituem as URLs de origem da EDL, na mesma ordem.
outputstringvideo (padrão) ou audio.
qualitystringproxy para uma prévia rápida, ou final (padrão).
crossfade_msnumberUm fade cruzado nas junções sem transição própria, de até 5.000 ms. Padrão: 0, cortes secos.
transcriptobjectUma transcrição a remapear pelo corte, para que corresponda ao resultado.

Uma renderização pode produzir no máximo 180 minutos. Uma lista malformada, ou longa demais, é recusada antes que qualquer coisa seja executada, com o segmento e a regra que ele viola.

Retorna: um ID de job. O arquivo renderizado é o resultado do job.

Editar uma gravação a partir da transcrição

Transcreva a gravação

Chame transcribe na gravação. Os tempos das palavras ficam em output_data.json.words, no job.

Encontre os silêncios

Chame silence_detect. Esta etapa é opcional, mas ajuda o tighten.

Planeje o corte

Chame plan_edit com a transcrição, os silêncios e a gravação, no modo tighten, clips ou chapters. Confira o plano e altere-o se precisar.

Renderize

Chame apply_edl com o plano. Use quality: "proxy" primeiro, para uma prévia rápida.

A receita podcast-editing conduz um assistente pelas mesmas etapas; veja Receitas de conteúdo. Com várias câmeras e um microfone separado, execute audio_sync primeiro e passe o offset_ms de cada origem para plan_edit.

Perguntas frequentes

Última atualização

Nesta página