영상을 자막으로
영상의 오디오 트랙에서 자막(SRT 또는 VTT)을 자동으로 만들어보세요 - AI 음성 인식(Whisper)으로 브라우저에서 로컬 처리, 업로드 없음.
기기에서 로컬로 처리 중 ...
내 파일
기기에서 로컬로 처리 중 ...
0%
파일이 기기를 떠난 적이 없습니다
제 파일이 업로드되나요?
아니요. 모든 처리가 브라우저에서 이루어지며, 파일이 기기를 떠나지 않습니다. 이것을 검증하는 방법
영상의 오디오 트랙에서 자막(SRT 또는 VTT)을 자동으로 만들어보세요 - AI 음성 인식(Whisper)으로 브라우저에서 로컬 처리, 업로드 없음.
기기에서 로컬로 처리 중 ...
기기에서 로컬로 처리 중 ...
0%
파일이 기기를 떠난 적이 없습니다
아니요. 모든 처리가 브라우저에서 이루어지며, 파일이 기기를 떠나지 않습니다. 이것을 검증하는 방법
강연, 설명 영상, 자막 없는 소셜 클립 - 음소거된 피드나 청각 장애가 있는 시청자에게는 자막이 있어야 영상 내용을 제대로 이해할 수 있는 경우가 많습니다. 이 도구는 영상의 오디오 트랙을 듣고 AI(Whisper)로 발화 내용을 인식한 뒤, 시간 정보가 담긴 자막 파일로 출력합니다 - 영상 플레이어나 편집 프로그램에 바로 불러올 수 있습니다.
오디오 트랙은 영상에서 자동으로 추출됩니다 - 별도의 추출 도구를 거칠 필요 없이, 이 사이트의 오디오 추출 도구가 사용하는 것과 같은 방식으로 처리됩니다. Whisper는 인식 결과를 시작과 끝 시간이 있는 발화 구간으로 나누며, 이는 곧바로 SRT 또는 VTT 큐로 출력됩니다 - 이 사이트의 다른 자막 도구와 정확히 같은 타임스탬프 형식을 사용하므로, 예를 들어 자막 시간 이동 도구로 나중에 세밀하게 조정할 수도 있습니다.
자막은 자동으로 만든 근사치일 뿐, 검수된 번역을 대신할 수는 없습니다 - 고유명사, 전문 용어, 배경 소음은 오류의 원인이 될 수 있습니다. 게시하기 전에 짧게라도 검토해보는 것이 항상 좋습니다.
| 입력 형식 | MP4, M4V, WEBM, MOV, MKV |
|---|---|
| 자동 변환 | PNG, GIF |
| 출력 형식 | SRT, VTT |
| 일괄 처리 | 미지원 |
| 처리 방식 | 브라우저에서 로컬 처리 (WebAssembly) |
| 파일 업로드 | 없음 |
제한: 단일 스레드로 동작하며(이 사이트에는 크로스 오리진 격리 모드가 없습니다) 서버 기반 서비스보다 눈에 띄게 느립니다 - 그래서 이 사이트의 다른 영상 도구보다 기기별 길이 상한이 훨씬 엄격합니다. 가벼운 tiny 모델 단계를 사용하므로 또렷한 발화에는 좋지만, 배경 소음이 심하거나 여러 명이 동시에 말하는 경우에는 정확도가 떨어집니다. 자막은 기계로 생성된 것이므로 게시하기 전에, 특히 고유명사와 숫자를 확인하세요.
아니요, 오디오 추출과 인식 모두 브라우저에서 완전히 로컬로 처리됩니다.
SRT는 영상 편집 프로그램에서 가장 널리 쓰이는 형식이고, VTT는 HTML5 영상 플레이어를 위한 웹 표준 형식입니다.
네, 자막 시간 이동 도구를 사용하면 파일 전체를 일정한 값만큼 이동시킬 수 있습니다.
네, 다만 화자 구분 기능은 없어서 모든 목소리가 하나의 연속된 자막 트랙에 담깁니다.