주요 기능
Forced Alignment & Auto-Segmentation
오디오-스크립트 자동 정렬
오디오와 스크립트를 업로드하면 Whisper ASR이 음성을 분석하여 문장 단위로 자동 분할합니다. 타임스탬프가 정확히 매칭되어 수동 작업 시간을 대폭 줄여줍니다.
오디오와 스크립트를 업로드하면 Whisper ASR이 음성을 분석하여 문장 단위로 자동 분할합니다. 타임스탬프가 정확히 매칭되어 수동 작업 시간을 대폭 줄여줍니다.
Real-time Waveform Editing
직관적인 시각적 편집 환경
파형(Waveform)을 보면서 구간 경계를 드래그하여 미세 조정할 수 있습니다. 키보드 단축키([ ] ; ')로 50ms 단위 정밀 조절이 가능하며, 분할/병합/삭제를 즉시 수행할 수 있습니다.
파형(Waveform)을 보면서 구간 경계를 드래그하여 미세 조정할 수 있습니다. 키보드 단축키([ ] ; ')로 50ms 단위 정밀 조절이 가능하며, 분할/병합/삭제를 즉시 수행할 수 있습니다.
REF-HYP Similarity Comparison
원본 대본과 전사 결과 비교 분석
원본 스크립트(REF)와 ASR 전사 결과(HYP)를 나란히 비교하며, 정상·유사·다름·누락 4단계로 차이를 색상 하이라이트합니다. 유사도 점수로 품질을 즉시 파악할 수 있습니다.
원본 스크립트(REF)와 ASR 전사 결과(HYP)를 나란히 비교하며, 정상·유사·다름·누락 4단계로 차이를 색상 하이라이트합니다. 유사도 점수로 품질을 즉시 파악할 수 있습니다.
Multi-Format Export
WAV 분할 및 자막 파일 지원
편집 완료된 결과를 WAV 분할(개별/ZIP), SRT, VTT, CSV, JSON 등 다양한 형식으로 내보낼 수 있습니다. 후속 작업(자막 제작, 데이터셋 구축)에 바로 활용 가능합니다.
편집 완료된 결과를 WAV 분할(개별/ZIP), SRT, VTT, CSV, JSON 등 다양한 형식으로 내보낼 수 있습니다. 후속 작업(자막 제작, 데이터셋 구축)에 바로 활용 가능합니다.
Audsta Launcher
런처에서 열기