WAND wiki
최근 문서

검색 결과가 없습니다. 모델명이나 다른 키워드로 검색해 보세요.

AudioLast Updated 2026-09-30

Audio Enhancement

On this page

이 문서는 Tencent Cloud 공식 문서 Audio/Video Enhancement Integration을 참고해 오디오 기능만 담았습니다.

입력 오디오의 노이즈를 제거하고 음질을 개선합니다. 보이스 노이즈 제거, 오디오 품질 향상, 볼륨 평준화를 지원합니다. 오디오 분리는 별도 문서 Audio Separation에서 다룹니다.

지원 기능

기능 설명
보이스 노이즈 제거 음성의 배경 노이즈를 제거해 명료도 향상
오디오 품질 향상 입력 오디오의 전반적인 음질 개선
볼륨 평준화 구간별 음량 편차를 줄여 일정한 청취 볼륨 유지

API 정보

항목 값
서비스 MPS
API Action ProcessMedia
엔드포인트 mps.tencentcloudapi.com
API 버전 2019-06-12
처리 방식 비동기 (TaskId 발급 후 결과 조회)

인증은 모든 API가 공통으로 TC3-HMAC-SHA256(SecretId/SecretKey) 서명을 사용합니다. 서명 생성 방법은 Quick Start의 TokenHub 문서를 참고하세요.

동작 방식

오디오 개선은 트랜스코딩을 기반으로 동작합니다. 개선 템플릿을 생성할 때 EnhanceConfig.AudioEnhance로 노이즈 제거를 켜고, 태스크 제출 시 Definition에 해당 템플릿 ID를 지정합니다. 개선 템플릿 생성 예시는 다음과 같습니다.

LANGUAGE
{
  "Container": "m4a",
  "Name": "audio-denoise",
  "AudioTemplate": {
    "Codec": "aac",
    "Bitrate": 64
  },
  "EnhanceConfig": {
    "AudioEnhance": {
      "Denoise": {
        "Switch": "ON"
      }
    }
  }
}

요청 파라미터

파라미터 타입 필수 예시 설명
InputInfo Object 필수 {"Type":"URL","UrlInputInfo":{"Url":"https://example.com/audio.mp3"}} 입력 미디어. Type은 URL 또는 COS
OutputStorage Object 필수 {"Type":"COS","CosOutputStorage":{"Bucket":"mybucket-125xxx","Region":"ap-guangzhou"}} 출력 저장소
OutputDir String 선택 /output/audio/ 출력 디렉터리. /로 시작하고 /로 끝나야 함
MediaProcessTask.TranscodeTaskSet.N.Definition Integer 필수 100910 오디오 개선 템플릿 ID. 프리셋 또는 커스텀 템플릿
MediaProcessTask.TranscodeTaskSet.N.OverrideParameter.Container String 선택 m4a 출력 컨테이너. 오디오 전용 출력이면 m4a
MediaProcessTask.TranscodeTaskSet.N.OverrideParameter.AudioTemplate.Codec String 선택 aac 출력 오디오 코덱
MediaProcessTask.TranscodeTaskSet.N.OverrideParameter.AudioTemplate.Bitrate Integer 선택 64 출력 오디오 비트레이트(kbps)
MediaProcessTask.TranscodeTaskSet.N.OverrideParameter.AudioTemplate.SampleRate Integer 선택 44100 출력 샘플레이트(Hz)
MediaProcessTask.TranscodeTaskSet.N.OverrideParameter.AudioTemplate.AudioChannel Integer 선택 2 출력 채널 수
TaskNotifyConfig.NotifyUrl String 선택 https://example.com/callback 태스크 완료 콜백 URL. NotifyType은 URL

호출 예시

LANGUAGE
import json
from tencentcloud.common import credential
from tencentcloud.common.profile.client_profile import ClientProfile
from tencentcloud.common.profile.http_profile import HttpProfile
from tencentcloud.mps.v20190612 import mps_client, models

cred = credential.Credential("<SecretId>", "<SecretKey>")
http_profile = HttpProfile()
http_profile.endpoint = "mps.tencentcloudapi.com"
client = mps_client.MpsClient(cred, "ap-guangzhou", ClientProfile(httpProfile=http_profile))

params = {
    "InputInfo": {
        "Type": "URL",
        "UrlInputInfo": {"Url": "https://example.com/audio.mp3"}
    },
    "OutputStorage": {
        "Type": "COS",
        "CosOutputStorage": {"Bucket": "mybucket-125xxx", "Region": "ap-guangzhou"}
    },
    "OutputDir": "/output/audio/",
    "MediaProcessTask": {
        "TranscodeTaskSet": [{
            "Definition": 100910,
            "OverrideParameter": {
                "Container": "m4a",
                "AudioTemplate": {
                    "Codec": "aac",
                    "Bitrate": 64,
                    "SampleRate": 44100,
                    "AudioChannel": 2
                }
            }
        }]
    }
}

req = models.ProcessMediaRequest()
req.from_json_string(json.dumps(params))
resp = client.ProcessMedia(req)
print(resp.to_json_string())

응답 예시

LANGUAGE
{
  "TaskId": "24000022-ScheduleTask-774f101xxxxxxx1tt110253",
  "RequestId": "3c140219-cfe9-470e-b241-907877d6fb03"
}

사용 안내

오디오 개선은 트랜스코딩을 기반으로 하므로 개선 태스크 하나에 개선 요금과 트랜스코딩 요금이 함께 부과됩니다.

오디오 분리가 필요하면 Audio Separation 문서를 참고하세요. 개선 템플릿에서 분리 기능을 켜는 방식과 동일한 파이프라인입니다.