# Sequência de tomadas

> Crie um vídeo de motion graphics narrado em que textos e formas aparecem quando a locução os diz, com um briefing, alinhamento forçado e renderização.

Source: https://nodaro.ai/pt-BR/docs/mcp/shot-sequence

Uma **sequência de tomadas** é um vídeo de motion graphics narrado em que cada texto na tela, cada forma e cada imagem aparece no momento em que a locução diz a frase correspondente. Você, ou um assistente, escreve um **briefing**: a narração, as deixas dela e as cenas, tomadas e revelações. O Nodaro alinha a locução gravada palavra por palavra e fixa cada deixa em um quadro exato; assim, o tempo é determinístico. O [Diretor de vídeo](https://nodaro.ai/docs/mcp/video-director) se apoia nesse pipeline e escreve o briefing para você.

## O pipeline
Workflow: A narração ganha voz, é alinhada palavra por palavra, vira um plano com quadros exatos e é renderizada.

- generate_speech → forced_alignment (áudio)
- forced_alignment → resolve_shot_sequence (alinhamento)
- resolve_shot_sequence → render_shot_sequence (plano)

### Dar voz à narração
Chame [`generate_speech`](https://nodaro.ai/docs/mcp/tools/audio#generate_speech) com o roteiro da narração. Leia a URL do áudio na saída do job. 33 créditos com ElevenLabs v3.

### Alinhar as palavras
Chame `forced_alignment` com o áudio e exatamente o mesmo roteiro como `transcript`. Leia `output_data.alignment`, uma lista de `{ word, start, end }` em segundos. 33 créditos.

### Resolver o briefing
Chame `resolve_shot_sequence` com o briefing, a URL do áudio e o alinhamento. A ferramenta responde na hora com o `plan` pronto para renderizar e eventuais `warnings`. Gratuito.

### Renderizar
Chame `render_shot_sequence` com o plano. O job renderiza o MP4, que o cartão reproduz e a sua biblioteca guarda. 55 créditos, em qualquer tamanho de quadro.

Chame [`start_video_director`](https://nodaro.ai/docs/mcp/tools/shot-sequence-and-video-director#start_video_director) primeiro: a ferramenta retorna o guia para escrever a narração como frases de deixa e montar um bom briefing.

## Escrever um briefing
Um briefing tem uma `narration`, com seu `script` e suas `cues`, e `scenes` que contêm `shots`, que por sua vez contêm `reveals`. Uma **deixa** é uma frase do roteiro. Uma **revelação** posiciona um elemento quando uma deixa é dita.

```json
{
"fps": 30, "width": 1920, "height": 1080, "backgroundColor": "#0b0b0f",
"narration": {
"script": "Ship faster. Nodaro turns your idea into video.",
"cues": [
{ "id": "c_ship", "text": "Ship faster" },
{ "id": "c_idea", "text": "your idea into video" }
]
},
"scenes": [
{
"id": "scene_hook",
"shots": [{
"id": "shot_1",
"reveals": [
{
"id": "rv_title",
"element": { "id": "t1", "type": "text", "text": "Ship faster", "fontFamily": "Inter", "fontSize": 120, "fontWeight": 900, "color": "#ffffff", "x": 200, "y": 450 },
"revealAt": { "kind": "cue", "cueId": "c_ship", "edge": "start" },
"enter": { "motion": "slide-up", "durationFrames": 12, "easing": "easeOut" }
}
]
}]
}
]
}
```

### Âncoras
| Âncora | Quando o elemento aparece |
| --- | --- |
| `{ "kind": "cue", "cueId": "…", "edge": "start" }` | Quando a frase da deixa começa. Use `"edge": "end"` para quando ela termina e `offsetMs` para ajustar o momento. |
| `{ "kind": "frame", "frame": 0 }` | Em um quadro fixo, para elementos sem narração, como um logo de abertura ou um encerramento |

Para um elemento que precisa estar visível na miniatura, no quadro 0, use `"enter": { "motion": "none", "durationFrames": 0 }`.

### Quanto tempo um elemento fica
Um elemento sai no fim do conteúdo da cena dele. Para controlar como ele sai, defina `hold`, os quadros em que ele permanece depois da entrada, e `exit`, um movimento após essa permanência.

### Regras que mantêm o tempo exato
- **As deixas precisam corresponder exatamente ao roteiro**, inclusive nos espaços. Escreva a forma falada: “twenty twenty-six”, e não “2026”; “five dollars”, e não “$5”.
- **As cenas não podem se sobrepor no tempo.** Cada cena ocupa um trecho contínuo da narração. Quando as revelações de duas cenas se sobrepõem, `resolve_shot_sequence` retorna `422 scene_overlap`.
- **As fontes** vêm das famílias compatíveis, como Inter, Roboto, Montserrat, Poppins, Playfair Display, Bebas Neue, Anton, Caveat, Roboto Mono e Fira Code. Rubik, Heebo, Cairo e Tajawal cobrem hebraico e árabe.
- **Os movimentos de entrada** são `fade`, `scale-up`, `wipe-in`, `slide-up`, `slide-down`, `slide-left`, `slide-right` e `none`.
- **Os movimentos de saída** são `fade`, `slide-up`, `slide-down`, `slide-left`, `slide-right` e `none`.

Uma deixa que não é encontrada na transcrição passa a usar um tempo proporcional, e `warnings` informa isso.

## Blueprints
Um blueprint é um trecho animado pronto que você posiciona com uma revelação `blueprint` e preenche com `params`. `list_shot_shapes` retorna o catálogo, e `get_shot_shape` retorna os parâmetros de um blueprint com um exemplo completo. Os blueprints não custam nada por si só; o preço da renderização cobre o vídeo inteiro.

| ID | Funções | Quadros padrão | O que faz |
| --- | --- | --- | --- |
| `comparison-split` | vitrine de recurso | 180 | Dois painéis com rótulos entram deslizando por lados opostos e ficam parados com um divisor; selos opcionais surgem perto do fim. |
| `constellation-hub` | gancho, prova social | 180 | Nós com rótulos saltam para formar um anel em volta de um centro, e depois a tomada termina no núcleo. |
| `cta-morph-press` | chamada para ação | 150 | Um botão aparece no centro, e um cursor desacelera até ele e o pressiona. |
| `cursor-ui-demo` | vitrine de recurso, apresentação do produto | 210 | Um cursor conduz suas capturas de tela por cliques, enquanto a visualização acompanha cada alvo. |
| `dataviz-countup` | ponto de dor | 240 | Um número grande sobe em contagem até um valor, com um rótulo. |
| `device-surface-showcase` | apresentação do produto, vitrine de recurso | 240 | Uma maquete de dispositivo fica parada enquanto as telas dela alternam entre suas capturas de tela, com títulos sincronizados. |
| `grid-card-assemble` | vitrine de recurso, benefício, prova social | 180 | Cartões de texto caem em cascata e formam uma grade. |
| `kinetic-type-beats` | gancho | 150 | De uma a quatro frases de efeito se alternam; a última surge com uma cor de destaque. |
| `logo-assemble-lockup` | apresentação do produto, branding | 180 | As letras da palavra da marca se juntam em uma assinatura centralizada, com um slogan opcional. |
| `overwhelm-surround` | ponto de dor | 210 | Cartões de ferramentas se juntam e etiquetas se espalham pela tela; depois, demandas se aproximam por todos os lados. |
| `spatial-pan-stations` | gancho, ponto de dor | 240 | Estações com rótulos em uma única tela grande, visitadas por panorâmicas suaves da câmera, com um destaque em cada parada. |
| `ticker-takeover` | gancho, branding | 180 | Uma introdução digitada com uma palavra de destaque que se alterna, e depois o elemento principal entra com impacto. |
| `titlecard-reveal` | benefício, prova social | 120 | Um título limpo, com subtítulo opcional, revelado com um único movimento discreto e mantido na tela. |
| `typewriter-reveal` | gancho, branding | 180 | O texto é digitado letra por letra com um cursor piscando; um rótulo secundário opcional surge suavemente de baixo. |
| `waterfall-reveal` | gancho, vitrine de recurso | 150 | As palavras de uma linha entram uma a uma, da esquerda para a direita; um rótulo secundário opcional surge suavemente de baixo. |

As durações padrão estão em quadros a 30 fps. `list_shot_shapes` sempre retorna o catálogo atual.

## Tokens de marca
Um briefing pode levar tokens de marca, com paleta, fontes e logo, para que todos os blueprints usem as suas cores e a sua tipografia. Em um briefing, os tokens precisam ser o objeto completo, não o ID de uma predefinição: copie os tokens de uma predefinição de `list_brand_presets`. Os campos são os mesmos da [marca do Diretor de vídeo](https://nodaro.ai/docs/mcp/video-director#brand).

## Frequently asked questions

### O que é uma sequência de tomadas no Nodaro?

Um vídeo de motion graphics narrado e descrito como um briefing. Cada texto, forma ou imagem fica ancorado a uma frase da locução, e o Nodaro converte os tempos das palavras em quadros exatos antes de renderizar o MP4.

### Quanto custa um vídeo de sequência de tomadas?

A locução, o alinhamento e a renderização são cobrados separadamente. São 33 créditos pela locução com ElevenLabs v3, 33 pelo alinhamento forçado e 55 pela renderização. Resolver o plano é gratuito.

### Por que resolve_shot_sequence retorna scene_overlap?

Duas cenas têm revelações no mesmo trecho de tempo. Cada cena ocupa uma janela contínua da narração; por isso, mantenha todas as deixas de uma cena antes das deixas da cena seguinte.

### Como os números devem ser escritos na narração?

Do jeito que são falados, como “twenty twenty-six” ou “five dollars”. Uma deixa precisa corresponder ao roteiro palavra por palavra, e o alinhamento compara palavras faladas.
