Todos os artigos
Guias2026/08/21

Closed captions vs. legendas: qual é a diferença?

Closed captions vs. legendas: entenda as diferenças essenciais e as regras de acessibilidade para saber qual formato utilizar em seus vídeos.

As palavras são usadas como sinônimos, mas closed captions e legendas não são a mesma coisa, e escolher o errado pode deixar você do lado errado de uma lei de acessibilidade.

A versão curta: os captions partem do princípio de que o espectador não consegue ouvir o áudio, por isso incluem o som não falado — música, uma porta batendo, quem está falando. As legendas partem do princípio de que o espectador consegue ouvir mas não entende o idioma, por isso trazem apenas o diálogo falado. Todo o resto decorre dessa única distinção.

Captions vs. legendas num relance

CaptionsLegendas
Pressupõem que o espectadorNão consegue ouvir o áudioConsegue ouvir, não entende o idioma
CobremDiálogo + som não falado (música, efeitos, identificação de quem fala)Apenas o diálogo
Público principalPessoas surdas e com deficiência auditivaEspectadores assistindo num segundo idioma
Mesmo idioma do áudio?Geralmente simGeralmente não (traduzido)
Exigidos por lei?Muitas vezes — veja abaixoRaramente; é uma escolha de localização
Formatos de arquivoSRT, VTT, SCC, TTMLSRT, VTT, ASS/SSA

Ambos são texto sincronizado sobreposto ao vídeo, e ambos são distribuídos nos mesmos formatos de legenda — um .srt ou um .vtt pode conter qualquer um deles. A diferença está no conteúdo das entradas, não no contêiner. (Para o lado do contêiner, veja os formatos de arquivo de legendas e transcrições explicados.)

O que os captions incluem e as legendas não

Como quem assiste com captions não consegue ouvir nada, os captions precisam descrever a trilha sonora, não só as palavras:

  • Sons não falados entre colchetes: [telefone tocando], [música tensa], [risos].
  • Identificação de quem fala, para deixar claro quem está falando quando o rosto está fora de quadro.
  • Tom e entonação quando mudam o significado — [sarcástico], [sussurrando].

As legendas deixam tudo isso de fora. Uma faixa de legendas de um filme presume que você consegue ouvir a explosão; ela só diz o que os personagens estão falando.

Captions abertos vs. fechados

Dentro de "captions" há uma segunda distinção:

  • Os closed captions (CC) são uma faixa separada que o espectador pode ligar ou desligar. As legendas do YouTube, o botão CC de um player de streaming e um arquivo .srt anexo são todos closed captions.
  • Os captions abertos ficam gravados permanentemente nos pixels do vídeo. Aparecem sempre, em qualquer player, sem botão — comuns no vídeo social, onde a reprodução automática vem sem som e não há interface de legendas.

O fechado é o padrão para acessibilidade porque dá controle ao espectador. Os captions abertos vencem quando você não pode confiar que a plataforma vai renderizar uma faixa de captions — um TikTok ou um Reel do Instagram, por exemplo.

SDH: o híbrido do meio

Você também verá SDH — "subtitles for the deaf and hard of hearing" (legendas para pessoas surdas e com deficiência auditiva). SDH é texto no estilo de legenda (muitas vezes no fluxo e nos formatos de legenda) que também carrega a informação não falada que os captions fornecem. Existe porque o Blu-ray e muitos pipelines de streaming aceitam faixas de legenda com mais facilidade do que captions no estilo de radiodifusão, então o SDH entrega informação de nível de caption pelo canal de legenda. Se você está legendando para acessibilidade mas sua plataforma só aceita legendas, o SDH é a resposta.

De qual eu preciso?

Trabalhe de trás para frente a partir do seu espectador:

  • Publicando vídeo para um público geral (YouTube, um curso, o site de uma empresa)? Você precisa de captions — mesmo idioma do áudio, com indicações não faladas. É também o que a lei de acessibilidade espera.
  • Quer que seu vídeo possa ser assistido em outro idioma? Você precisa de legendas — o diálogo, traduzido.
  • Ambos é comum: captions no mesmo idioma e uma ou mais faixas de legendas traduzidas. Os serviços de streaming fazem exatamente isso.
  • Postando em feeds sociais com reprodução automática sem som? Use captions abertos para que o texto sobreviva independentemente do player.

Uma nota sobre a lei

Nos Estados Unidos, a acessibilidade de vídeo não é opcional para a maioria das organizações. A Americans with Disabilities Act (ADA) já foi aplicada a sites e a seus vídeos, a Section 508 cobre agências federais e seus contratados, e a FCC exige legendagem para boa parte da programação transmitida e republicada online. O fio condutor são os captions — precisos, no mesmo idioma, incluindo o som não falado — não as legendas traduzidas. Se o seu motivo para adicionar texto sincronizado é conformidade, você quase certamente precisa de captions. Isto é informação geral, não aconselhamento jurídico; verifique as regras que se aplicam à sua organização.

Como fazer qualquer um dos dois

Ambos partem do mesmo ponto: uma transcrição precisa e com marcação de tempo do áudio.

  1. Transcreva o áudio ou o vídeo. Envie o arquivo e deixe que ele seja transcrito — o ScribeToAny detecta o idioma falado automaticamente (cerca de 98 são suportados) e devolve segmentos com marcação de tempo. Para captions com várias pessoas na tela, ative os rótulos de quem fala.
  2. Revise contra o áudio. A transcrição automática é um primeiro rascunho. Clicar num segmento reproduz aquele momento, que é a forma mais rápida de corrigir um nome ou termo mal ouvido antes que vá para a tela.
  3. Adicione indicações não faladas se estiver fazendo captions. Este é o passo manual que transforma uma faixa de legenda numa faixa de caption — coloque entre colchetes os sons que quem não consegue ouvir perderia.
  4. Exporte o arquivo certo. SRT ou VTT para uma faixa fechada que a maioria das plataformas aceita; reajuste as marcas de tempo de cada entrada no editor de SRT se uma linha demora ou corta.
  5. Para outro idioma, traduza a transcrição finalizada. A ação Traduzir permite passá-la para qualquer um de 134+ idiomas gratuitamente, em todos os planos, e mantém os tempos das legendas idênticos, para que um SRT traduzido continue alinhado à imagem.

Se quiser o texto gravado para as redes sociais, gere primeiro a faixa com o gerador de legendas e depois use-a como captions abertos.


Os captions são para o acesso; as legendas são para o idioma. Acerte a transcrição uma vez e você poderá produzir ambos a partir dela. Comece com a ferramenta de vídeo para texto e adicione à mão as indicações não faladas onde a acessibilidade exigir.