화면 해설 편집기
짧은 영상을 위한 별도 화면 해설 음원을 만듭니다. 대사 시각을 직접 표시하고, 마이크 권한을 받아 장면 해설을 녹음하거나 기존 음성 파일을 올립니다. 허용된 대사 빈 구간에 cue를 놓아 겹침·길이·영상 종료 경고를 검토하고 원본 영상 음원과 합칩니다. WAV 길이는 영상 길이와 같으며 JSON·CSV에 배치 시각을 기록합니다. 음성 인식·자동 장면 설명·대사 검출은 하지 않습니다.
주요 기능
- 로컬 영상을 미리 보며 사용자가 대사 보호 구간을 직접 표시
- 대사가 없다고 표시한 구간의 빈 시간표를 확인
- 마이크 녹음 또는 브라우저가 디코딩할 수 있는 기존 음성 업로드
- 해설 길이·영상 경계·대사 겹침·해설끼리 겹침을 저장 전에 검사
- 해설 cue의 시각·음량·음소거를 조절하고 활성 구간의 원본 음량을 낮춤
- 실제 샘플을 영상과 같은 길이의 스테레오 WAV로 합성하고 cue JSON·CSV 저장
사용 방법
- 15초 이하 MP4·MOV·WebM 영상을 고르거나 예제를 불러옵니다.
- 대사 구간을 직접 표시하고 남은 빈 구간을 봅니다.
- 장면 메모와 시작 시각을 입력하고 최대 6초 해설을 녹음하거나 파일을 업로드합니다. 필요하면 cue를 더 추가합니다.
- 대사·cue끼리 겹침·영상 밖 경고가 없어질 때까지 cue를 옮기거나 음소거합니다.
- 전체 길이 WAV를 렌더링해 무음 영상과 함께 미리 듣고 WAV 및 cue JSON·CSV를 저장합니다.
활용 예시
- 두 대사 사이에서 화면의 중요한 동작을 짧게 설명
- 녹음한 해설이 직접 표시한 무대사 구간에 들어가는지 확인
- 접근성 검수를 위한 cue 시각과 음원 해시 전달
- 원본 음원 위에 별도 녹음한 해설이 어떻게 들리는지 확인
자주 묻는 질문
장면 해설 글이나 음성을 자동으로 만드나요?
아닙니다. 장면 메모를 쓰고 대사 시각을 표시하며 해설 음성을 제공하는 사람은 사용자입니다. 이 도구는 음성 인식·자동 대사 찾기·장면 인식·음성 합성을 하지 않습니다.
마이크 권한 없이 사용할 수 있나요?
예. 브라우저가 디코딩할 수 있는 기존 WAV·MP3·M4A·OGG·WebM 음성을 업로드하면 됩니다. 녹음 버튼을 눌렀을 때만 마이크 권한을 요청하며 종료·취소·비우기 때 트랙을 정리합니다.
해설이 대사나 다른 해설과 겹치면 어떻게 되나요?
음소거되지 않은 겹침과 영상 종료를 넘는 cue를 경고로 표시하고 내보내기를 막습니다. 대사 구간은 사용자가 표시한 것으로 실제 발화와 일치하는지 자동 검증하지 않습니다. cue를 옮기거나 음소거하고 구간을 수정하세요.
출력에 영상이 포함되나요?
아닙니다. 결과는 원본 영상 음원(디코딩 가능할 때)과 해설을 합친 48kHz 스테레오 PCM WAV, cue JSON·CSV입니다. 원본 영상 옆에서 WAV를 미리 듣되 새 영상으로 합치거나 자막·영상 메타데이터를 보존하지 않습니다.
원본 음원과 해설은 어떻게 합쳐지나요?
해설 밖에서는 원본 음량을 유지합니다. 활성 해설 중에는 약 20ms에 걸쳐 지정한 원본 음량까지 줄였다가 되돌리고 해설 샘플을 cue 시각에 더합니다. 피크가 범위를 넘으면 전체 WAV를 0.98 피크로 정규화하며 정규화 전 피크와 이득을 표시합니다.
길이·정밀도 제한은 무엇인가요?
영상은 32MiB·15초, cue마다 8MiB·디코딩 후 6초, 총 cue 8개·대사 구간 16개까지입니다. WAV 시각은 48kHz 샘플로 반올림합니다. 브라우저 코덱과 MP4 음원 시각이 다를 수 있고 동시 미리듣기에 드리프트가 생길 수 있으니 다운로드 WAV를 영상과 함께 검토하세요.
개인정보 안내
영상·음성 파일은 브라우저 안에서 디코딩하고 합성합니다. 이 도구는 원본이나 cue 글을 서버로 보내지 않습니다. 다운로드하는 JSON에는 원본 이름과 SHA-256이 있으므로 공유 전에 확인하세요. 비우기를 누르면 임시 URL과 마이크 트랙을 해제합니다.
댓글과 질문