자막을 자동으로 생성하려면 어떻게 하나요?
자동 자막 생성은 직접 타이핑하지 않고 동영상의 말소리를 시간 정보가 있는 텍스트로 바꾸는 것입니다. 자막 파일이 없을 때 유일한 선택지이며, 함께 시청하기에 충분할 만큼 점점 좋아지고 있습니다. 방법은 웹 동영상과 로컬 파일에서 조금 다릅니다.
자동 자막 생성이란
음성 인식이 음성을 듣고 타임스탬프가 있는 텍스트를 만들며, 그 구간이 자막이 됩니다. 그다음 번역 단계에서 그 텍스트를 원하는 언어로 바꿀 수 있습니다.
웹 동영상의 경우(YouTube, X 등)
- WatchTranslate 브라우저 확장 프로그램을 설치합니다(데스크톱 Chrome).
- 동영상을 열고 자막 언어를 고릅니다.
- 음성 인식에서는: 원본 언어는 기본적으로 자동 감지하며 수동 지정도 가능합니다. 자막 소스와 언어를 선택한 뒤 번역 시작을 누르세요. 재생을 누르면 확장 프로그램이 음성을 읽고 자막을 생성해 플레이어에 번역해 표시합니다.
로컬 및 다운로드 파일의 경우
- 브라우저에서 WatchTranslate 로컬 플레이어를 엽니다.
- 동영상을 끌어다 놓고 번역할 언어를 고릅니다.
- 음성 인식에서는: 원본 언어는 기본적으로 자동 감지하며 수동 지정도 가능합니다. 자막 소스와 언어를 선택한 뒤 번역 시작을 누르세요. 재생을 누르면 약 30초 단위로 자막이 생성되고 번역됩니다.
정확도: 영향을 주는 것
인식 품질은 음성에 따라 달라집니다. 한 명이 또렷하게 말하면 가장 잘 되지만, 배경 음악이 크거나 억양이 강하거나 여러 목소리가 겹치면 정확도가 떨어집니다. 이는 번역이 아니라 받아쓰기의 한계입니다.
수동 자막 파일이 여전히 나은 경우
공식 자막 파일이 있고 내 릴리스와 일치한다면 그 파일을 쓰는 것이 완벽한 타이밍과 화자 라벨을 제공합니다. 자동 생성은 그런 파일이 없거나 맞지 않을 때를 위한 것입니다.
할 수 있는 것과 없는 것
- 웹 동영상(YouTube, X 등) 및 로컬 MP4/MKV 파일
- 음성에서 자막을 생성한 다음 번역
- 원문 + 번역 이중 언어 표시
- 실패한 실행은 크레딧을 소모하지 않음
- 라이브 스트리밍 미지원
자주 묻는 질문
자막 파일 없이 자막을 생성할 수 있나요?
네——그것이 바로 음성 인식이 하는 일입니다. 음성을 시간 정보가 있는 텍스트로 받아쓰고, 그것이 자막 트랙이 됩니다.
시청할 만큼 정확한가요?
또렷한 말소리라면 보통 따라가기에 충분합니다. 음성이 시끄럽거나 음악이 있거나 말이 겹치면 정확도가 떨어집니다. 원본 음성이 계속 재생되므로 무슨 말인지 들을 수 있습니다.
로컬 파일에도 되나요?
네. 로컬 플레이어는 동영상 전체를 업로드하지 않고 컴퓨터나 휴대폰의 파일에 대해 자막을 생성하고 번역합니다.
요금이 드나요?
가입 시 일회성 무료 크레딧이 제공됩니다. 이후에는 사용량 기반으로, 음성에서 생성한 자막은 분당 약 1크레딧입니다.