캡션 vs. 자막: 무엇이 다를까?
캡션과 자막의 차이점 완벽 비교: 비언어적 소리 포함 여부, 접근성 기준, 용도별 선택 가이드를 알기 쉽게 정리합니다.
두 용어는 종종 같은 뜻으로 쓰이지만, 캡션과 자막은 같은 것이 아니며, 잘못 고르면 접근성 법의 잘못된 편에 서게 될 수도 있습니다.
짧게 말하면, 캡션은 시청자가 소리를 들을 수 없다고 전제하므로 비언어적 소리 — 음악, 문이 쾅 닫히는 소리, 누가 말하는지 — 를 포함합니다. 자막은 시청자가 들을 수는 있지만 언어를 이해하지 못한다고 전제하므로 말해진 대사만 담습니다. 나머지 모든 것은 이 하나의 구분에서 따라옵니다.
캡션 vs. 자막 한눈에 보기
| 캡션 | 자막 | |
|---|---|---|
| 전제하는 시청자 | 소리를 들을 수 없음 | 들을 수 있으나 언어를 이해 못함 |
| 다루는 범위 | 대사 + 비언어적 소리(음악, 효과음, 화자 표시) | 대사만 |
| 주요 대상 | 청각장애인 및 난청 시청자 | 제2언어로 시청하는 사람 |
| 오디오와 같은 언어? | 대개 예 | 대개 아니오(번역됨) |
| 법으로 의무? | 자주 — 아래 참조 | 드묾; 현지화 선택 |
| 파일 형식 | SRT, VTT, SCC, TTML | SRT, VTT, ASS/SSA |
둘 다 영상 위에 얹히는 타임코드 텍스트이며, 같은 자막 파일 형식으로 제공됩니다 — .srt나 .vtt는 어느 쪽이든 담을 수 있습니다. 차이는 큐(표시 줄)의 내용에 있지, 컨테이너에 있지 않습니다. (컨테이너 쪽 이야기는 자막·전사 파일 형식 설명을 참고하세요.)
캡션에는 있고 자막에는 없는 것
캡션 시청자는 아무것도 들을 수 없으므로, 캡션은 말뿐 아니라 사운드트랙 자체를 설명해야 합니다.
- 대괄호로 표시하는 비언어적 소리:
[전화벨 소리],[긴장된 음악],[웃음]. - 얼굴이 화면 밖에 있을 때 누가 말하는지 분명히 하는 화자 식별.
- 의미를 바꾸는 어조와 말투:
[비꼬듯이],[속삭이며].
자막은 이 모든 것을 뺍니다. 영화의 자막 트랙은 당신이 폭발음을 들을 수 있다고 가정하고, 등장인물이 무엇을 말하는지만 알려 줍니다.
오픈 캡션 vs. 클로즈드 캡션
"캡션" 안에도 두 번째 구분이 있습니다.
- **클로즈드 캡션(CC)**은 시청자가 켜고 끌 수 있는 별도 트랙입니다. 유튜브 캡션, 스트리밍 플레이어의 CC 버튼, 함께 딸린
.srt파일은 모두 클로즈드 캡션입니다. - 오픈 캡션은 영상 픽셀에 영구적으로 새겨져 있습니다. 어떤 플레이어에서든 버튼 없이 항상 표시됩니다 — 자동 재생이 음소거되고 캡션 UI가 없는 소셜 영상에서 흔합니다.
시청자에게 제어권을 주기 때문에 접근성에서는 클로즈드가 기본입니다. 플랫폼이 캡션 트랙을 렌더링해 주리라 믿기 어려울 때 — 예컨대 틱톡이나 인스타그램 릴스 — 는 오픈 캡션이 유리합니다.
SDH: 중간의 하이브리드
SDH — "subtitles for the deaf and hard of hearing"(청각장애인·난청인을 위한 자막) 도 보게 될 것입니다. SDH는 자막 스타일의 텍스트(대개 자막 워크플로와 형식에서 다룸)이면서 캡션이 제공하는 비언어적 정보까지 담습니다. 블루레이와 많은 스트리밍 파이프라인이 방송식 캡션보다 자막 트랙을 더 쉽게 지원하기 때문에, SDH는 자막 채널을 통해 캡션 수준의 정보를 전달합니다. 접근성을 위해 캡션을 넣고 싶은데 플랫폼이 자막만 받는다면, 답은 SDH입니다.
나에게 필요한 것은?
시청자에서 거꾸로 짚어 보세요.
- 일반 시청자에게 영상을 게시하나요(유튜브, 강의, 회사 사이트)? 캡션이 필요합니다 — 오디오와 같은 언어에 비언어적 표시를 더한 것. 이는 접근성 법이 기대하는 바이기도 합니다.
- 영상을 다른 언어로 볼 수 있게 하고 싶나요? 자막이 필요합니다 — 번역된 대사.
- 둘 다 도 흔합니다: 같은 언어 캡션 과 번역된 한두 개의 자막 트랙. 스트리밍 서비스가 바로 이렇게 합니다.
- 음소거 자동 재생 소셜 피드에 올리나요? 플레이어와 상관없이 텍스트가 남도록 오픈 캡션을 쓰세요.
법에 관한 참고
미국에서는 대부분의 조직에 영상 접근성이 선택 사항이 아닙니다. Americans with Disabilities Act(ADA) 는 웹사이트와 그 영상에 적용되어 왔고, Section 508 은 연방 기관과 그 계약업체를 다루며, FCC 는 방송되거나 온라인에 재게시되는 많은 프로그램에 캡션을 요구합니다. 공통된 실마리는 캡션 — 정확하고, 같은 언어이며, 비언어적 소리를 포함 — 이지 번역 자막이 아닙니다. 타임코드 텍스트를 넣는 이유가 규정 준수라면, 거의 확실히 캡션이 필요합니다. 이는 일반 정보이며 법률 자문이 아닙니다. 귀하의 조직에 적용되는 규칙을 확인하세요.
둘 다 만드는 방법
둘 다 같은 지점에서 시작합니다: 정확하고 타임스탬프가 붙은 오디오 전사.
- 오디오나 영상을 전사하세요. 파일을 업로드해 전사를 맡기면 — ScribeToAny가 말해진 언어를 자동으로 감지하고(약 98개 지원) 타임스탬프가 붙은 세그먼트를 돌려줍니다. 화면에 여러 사람이 나오는 캡션이라면 화자 라벨을 켜세요.
- 오디오와 대조해 검토하세요. 자동 전사는 초안입니다. 세그먼트를 클릭하면 그 순간이 재생되어, 잘못 들은 이름이나 용어를 화면에 내보내기 전에 고치는 가장 빠른 방법이 됩니다.
- 캡션을 만든다면 비언어적 표시를 더하세요. 이것이 자막 트랙을 캡션 트랙으로 바꾸는 수작업 단계입니다 — 들을 수 없는 시청자가 놓칠 소리를 대괄호로 표시하세요.
- 알맞은 파일로 내보내세요. 대부분의 플랫폼이 받는 클로즈드 트랙에는
SRT나VTT; 한 줄이 너무 오래 남거나 잘리면 SRT 편집기에서 개별 큐 타이밍을 다시 맞추세요. - 다른 언어라면 완성된 전사를 번역하세요. '번역' 기능을 사용하면 모든 요금제에서 134+개 언어 중 하나로 무료 번역할 수 있으며, 자막 큐 타이밍이 동일하게 유지되므로 번역된
SRT도 영상과 완벽히 일치합니다.
소셜용으로 텍스트를 새겨 넣고 싶다면, 먼저 자막 생성기로 트랙을 만든 뒤 오픈 캡션으로 사용하세요.
캡션은 접근을 위한 것이고, 자막은 언어를 위한 것입니다. 전사를 한 번 제대로 해 두면 그것으로 둘 다 만들 수 있습니다. 영상에서 텍스트로 도구로 시작하고, 접근성이 요구하는 곳에는 비언어적 표시를 손으로 더하세요.