Skip to main content
영상에서 음성 인식(ASR) 또는 화면 텍스트 인식(OCR)으로 자막을 생성하고, 30개 이상의 언어로 번역합니다. VTT/SRT 자막 파일 출력과 이중 자막(원문+번역)을 지원합니다.

요청 방법

비동기 태스크입니다. 호출 즉시 TaskId가 발급되며, 결과는 DescribeTaskDetail로 조회하거나 TaskNotifyConfig로 완료 콜백을 받을 수 있습니다.

요청 파라미터

응답 파라미터

호출 예시

응답 예시

주의사항

번역 대상 언어 파라미터는 TranslateDstLanguage 하나뿐입니다. 별도의 원어/대상어 쌍 파라미터는 존재하지 않으며, 여러 대상 언어는 en/ja처럼 /로 구분합니다. 번역을 켜면 SubtitleType 기본값은 2(이중 자막)입니다.
ProcessType 선택 기준: 음성 내용을 텍스트로 변환하면 0(ASR), 화면에 박힌 자막/텍스트를 인식하면 2(OCR, 원어는 zh_en 또는 multi), 기존 자막 번역만 필요하면 1입니다. ASR에 번역을 얹으려면 ProcessType 0TranslateSwitchON으로 설정합니다.
OCR 인식 영역 좌표는 0~1 사이 비율 값이며, SelectingSubtitleAreasConfig에 여러 영역을 지정할 수 있습니다. 결과 자막 파일은 태스크 완료 후 OutputDir에 기록되며 Task Query로 진행 상태를 조회합니다.
Last modified on August 16, 2026