MiniMax
On this page
Endpoint: POST https://tokenhub-intl.tencentcloudmaas.com/v1/wand/minimax-video-v2/generation
인증: Tokenhub API Key / Bearer
MiniMax H3는 텍스트, 이미지, 영상, 오디오 참조로 영상을 생성합니다. H3 Max는 텍스트와 첫 프레임 / 끝 프레임 입력을 지원합니다.
기본 정보
| 항목 | 값 |
|---|---|
| 호출 경로 | Tokenhub API |
| 가드레일 해제 지원 | 지원 |
버전별 지원 규격
| 버전 | 해상도 | 비율 | 길이 |
|---|---|---|---|
minimax-video-h3 |
768P / 2K |
21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16 |
4 ~ 15초 |
minimax-video-h3-max |
480P / 768P |
21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16 |
5~15초 |
입력 모드
| 버전 | 입력 |
|---|---|
minimax-video-h3 |
텍스트-동영상 / 이미지-동영상(첫 프레임과 마지막 프레임) / 멀티모달 참조 기반 생성 |
minimax-video-h3-max |
텍스트-동영상 / 이미지-동영상(첫 프레임 / 마지막 프레임), 중간 프레임은 지원되지 않음. |
해상도 변환
| 버전 | 입력 해상도 | 출력 해상도 |
|---|---|---|
minimax-video-h3 |
1080P / 4K |
768P / 2K |
minimax-video-h3-max |
1080P / 2K / 4K |
768P |
H3 Max는 중간 프레임과 멀티모달 참조 입력을 지원하지 않습니다.
호출 절차
동영상 생성은 시간이 오래 걸리는 작업(일반적으로 1~3분)이므로 API는 비동기 호출 방식을 사용하며, 다음 두 단계로 구성됩니다.
작업 제출:
POST /v1/wand/minimax-video-v2/generation을 호출하며, 성공하면task_id가 반환됩니다.결과 폴링:
task.status = succeeded가 될 때까지task_id로 작업 결과 조회 API를 호출하고task.content.url에서 동영상 URL을 가져옵니다.
참고: 모든 API 응답에는 문제 해결에 사용되는 최상위 request_id가 포함됩니다. 조회 API는 사용량(tokenhub_usage.total_tokens 포함)을 나타내는 tokenhub_usage도 반환합니다. 작업 상태 열거형은 queued / running / succeeded / failed / cancelled이며 실제 응답을 기준으로 합니다.
텍스트-동영상
API 설명
텍스트 프롬프트만 사용하여 동영상을 생성하려면 프롬프트에서 카메라 움직임 등의 카메라 표현을 자연어로 직접 설명합니다.
API: POST https://tokenhub-intl.tencentcloudmaas.com/v1/wand/minimax-video-v2/generation
요청 파라미터
| 파라미터 | 필수 | 타입 | 설명 |
|---|---|---|---|
| model | 필수 | string | 모델 이름. 값: minimax-video-h3, minimax-video-h3-max |
| content | 필수 | array[object] | 멀티모달 입력 배열. 텍스트-동영상의 경우 text 요소 하나만 포함합니다. 하위 필드: type(text), text(프롬프트). |
| resolution | 필수 | string | 동영상 해상도. h3: 768P / 2K(1080P 입력은 768P로 다운그레이드되고 4K 입력은 2K로 다운그레이드됨), h3-max: 480P / 768P만 지원하며 2K는 지원되지 않음(1080P / 2K / 4K 입력은 별도 알림 없이 768P로 다운그레이드됨). |
| duration | 필수 | integer | 동영상 길이(초). h3: 4~15의 정수, h3-max: 5~15의 정수(4초는 지원되지 않음). |
| ratio | 필수 | string | 종횡비. 텍스트-동영상에는 필수이며 adaptive를 사용할 수 없습니다(adaptive는 16:9로 처리됨). 옵션: 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16. |
| aigc_watermark | 선택 | boolean | AIGC 워터마크 추가 여부. 기본값: false. |
요청 예시
curl -X POST 'https://tokenhub-intl.tencentcloudmaas.com/v1/wand/minimax-video-v2/generation' \
-H 'Authorization: Bearer YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "minimax-video-h3",
"content": [
{
"type": "text",
"text": "An orange kitten on the windowsill looks toward the camera"
}
],
"resolution": "2K",
"duration": 6,
"ratio": "16:9"
}'참고: 고속 버전을 호출하려면 예시의 model을 minimax-video-h3-max로 바꾸십시오. h3-max는 2K 또는 4초 길이를 지원하지 않습니다.
응답 파라미터
| 필드 | 타입 | 설명 |
|---|---|---|
| task_id | string | 생성된 작업의 작업 ID로, 작업 상태를 폴링하여 조회하는 데 사용됩니다. |
| request_id | string | 문제 해결에 사용되는 고유 요청 식별자입니다. |
참고: 제출 응답에는 base_resp가 포함되지 않습니다. 제출 성공 여부는 HTTP 상태 코드와 task_id 반환 여부로 판단합니다.
응답 예시
{
"task_id": "4-WandVideo-a786becfdc80433b8cff4aa344c8fd3d",
"request_id": "3aec3299-06ad-4654-8b45-c57b823a15d2"
}오류 코드
요청이 실패하면 오류 코드가 반환됩니다. 구체적인 오류 코드와 처리 권장 사항은 "부록: 통합 오류 코드"를 참조합니다. 작업이 성공적으로 제출된 후 생성 단계의 작업 상태는 "작업 결과 조회" API를 통해 확인할 수 있습니다.
이미지-동영상(첫 프레임 / 첫 프레임과 마지막 프레임)
API 설명
이미지를 첫 프레임으로 사용하고 선택적으로 마지막 프레임으로도 지정한 후 텍스트 프롬프트와 결합하여 동영상을 생성합니다. 출력 종횡비는 입력 이미지를 따릅니다.
API: POST https://tokenhub-intl.tencentcloudmaas.com/v1/wand/minimax-video-v2/generation
요청 파라미터
| 파라미터 | 필수 | 타입 | 설명 |
|---|---|---|---|
| model | 필수 | string | 모델 이름. 값: minimax-video-h3, minimax-video-h3-max |
| content | 필수 | array[object] | 멀티모달 입력 배열: text 1개 + image_url 항목 1~2개(role은 first_frame / last_frame, 첫 프레임은 role 생략 가능). 이미지 제약 조건: JPG / JPEG / PNG / WEBP / HEIC / HEIF, 30 MB 이하, 너비와 높이 [256, 5760] px, 종횡비 [0.4, 2.5]. |
| resolution | 필수 | string | 동영상 해상도. h3: 768P / 2K(1080P 입력은 768P로 다운그레이드되고 4K 입력은 2K로 다운그레이드됨), h3-max: 480P / 768P만 지원하며 2K는 지원되지 않음(1080P / 2K / 4K 입력은 별도 알림 없이 768P로 다운그레이드됨). |
| duration | 필수 | integer | 동영상 길이(초). h3: 4~15의 정수, h3-max: 5~15의 정수(4초는 지원되지 않음). |
| ratio | 선택 | string | 종횡비. 이미지-동영상의 기본값은 adaptive(입력 이미지에 따라 결정됨)이며 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16을 명시적으로 지정할 수도 있습니다. 다른 값은 오류 없이 무시됩니다. |
| aigc_watermark | 선택 | boolean | AIGC 워터마크 추가 여부. 기본값: false. |
참고: minimax-video-h3-max는 첫 프레임과 마지막 프레임을 지원하지만 중간 프레임은 지원하지 않습니다.
요청 예시
첫 프레임과 마지막 프레임 생성:
curl -X POST 'https://tokenhub-intl.tencentcloudmaas.com/v1/wand/minimax-video-v2/generation' \
-H 'Authorization: Bearer YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "minimax-video-h3",
"content": [
{
"type": "text",
"text": "Transition naturally from the first frame to the last frame"
},
{
"type": "image_url",
"image_url": {
"url": "https://example.com/start.jpg"
},
"role": "first_frame"
},
{
"type": "image_url",
"image_url": {
"url": "https://example.com/end.jpg"
},
"role": "last_frame"
}
],
"resolution": "768P",
"duration": 6
}'응답 파라미터
"텍스트-동영상"의 출력 파라미터와 동일합니다.
응답 예시
{
"task_id": "4-WandVideo-a786becfdc80433b8cff4aa344c8fd3d",
"request_id": "3aec3299-06ad-4654-8b45-c57b823a15d2"
}오류 코드
요청이 실패하면 오류 코드가 반환됩니다. 구체적인 오류 코드와 처리 권장 사항은 "부록: 통합 오류 코드"를 참조합니다. 작업 상태 설명은 "텍스트-동영상"과 동일합니다.
멀티모달 참조-동영상(H3 전용)
API 설명
텍스트와 참조 이미지, 참조 동영상 또는 참조 오디오를 조합하여 동영상을 생성합니다. 이 기능은 minimax-video-h3만 지원합니다. minimax-video-h3-max는 멀티모달 참조 입력을 지원하지 않으며 content에 reference_image, reference_video 또는 reference_audio가 있으면 파라미터 오류가 즉시 반환됩니다. 오디오만 입력할 수 없습니다. 참조 동영상 또는 이미지가 하나 이상 포함되어야 합니다.
API: POST https://tokenhub-intl.tencentcloudmaas.com/v1/wand/minimax-video-v2/generation
요청 파라미터
| 파라미터 | 필수 | 타입 | 설명 |
|---|---|---|---|
| model | 필수 | string | 모델 이름. 값: minimax-video-h3 |
| content | 필수 | array[object] | 멀티모달 입력 배열: text 1개 + 참조 자료(role은 reference_image / reference_video / reference_audio). 참조 이미지: 최대 9개, 참조 동영상: 최대 3개, 참조 오디오 클립: 최대 3개, 전체 자료: 최대 12개. 하위 필드와 자료 제약 조건은 다음 표를 참조합니다. |
| resolution | 필수 | string | 동영상 해상도. 옵션: 768P / 2K. |
| duration | 필수 | integer | 동영상 길이(초). 옵션: 4~15의 정수. |
| ratio | 선택 | string | 종횡비. 기본값은 adaptive(자동)이며 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16으로 명시적으로 설정할 수 있습니다. |
| aigc_watermark | 선택 | boolean | AIGC 워터마크 추가 여부. 기본값: false. |
content 배열 요소의 하위 필드:
| 파라미터 | 필수 | 타입 | 설명 |
|---|---|---|---|
| type | 필수 | string | 자료 유형. 열거형 값: text / image_url / video_url / audio_url. |
| text | 조건부 필수 | string | 텍스트 프롬프트. type=text일 때 필수입니다(각 요청에는 비어 있지 않은 text 항목이 포함되어야 함). |
| image_url | 조건부 필수 | object | 이미지 자료. type=image_url일 때 필수입니다. 구조: { "url": "..." } |
| video_url | 조건부 필수 | object | 동영상 자료. type=video_url일 때 필수입니다. 구조: { "url": "..." } |
| audio_url | 조건부 필수 | object | 오디오 자료. type=audio_url일 때 필수입니다. 구조: { "url": "..." } |
| role | 선택 | string | 자료 용도. 열거형 값: first_frame / last_frame / reference_image / reference_video / reference_audio. |
참고: 이미지-동영상과 멀티모달 참조 생성은 상호 배타적입니다. content에 reference_image / reference_video / reference_audio 역할 중 하나라도 있으면 first_frame / last_frame을 사용할 수 없으며 그 반대도 마찬가지입니다. 참조 동영상: MP4 / MOV(H.264 / H.265), 50 MB 이하, 최대 3개 세그먼트, 각 세그먼트 2~15초이면서 총길이 15초 이하, 너비와 높이 해상도 256~5760 px, 프레임 속도 23.976~60 fps. 참조 오디오: WAV / MP3, 15 MB 이하, 최대 3개 세그먼트, 각 세그먼트 2~15초이면서 총길이 15초 이하. 오디오만 입력할 수 없습니다. 전체 요청 본문 크기는 64 MB를 초과할 수 없습니다. 큰 파일에는 Base64 대신 공개 네트워크 URL을 사용합니다.
요청 예시
curl -X POST 'https://tokenhub-intl.tencentcloudmaas.com/v1/wand/minimax-video-v2/generation' \
-H 'Authorization: Bearer YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "minimax-video-h3",
"content": [
{
"type": "text",
"text": "The character in the reference image moves naturally within the scene of the reference video"
},
{
"type": "image_url",
"image_url": {
"url": "https://example.com/character.jpg"
},
"role": "reference_image"
},
{
"type": "video_url",
"video_url": {
"url": "https://example.com/scene.mp4"
},
"role": "reference_video"
}
],
"resolution": "768P",
"duration": 6,
"ratio": "16:9"
}'응답 파라미터
"텍스트-동영상"의 출력 파라미터와 동일합니다.
응답 예시
{
"task_id": "4-WandVideo-a786becfdc80433b8cff4aa344c8fd3d",
"request_id": "3aec3299-06ad-4654-8b45-c57b823a15d2"
}오류 코드
요청이 실패하면 오류 코드가 반환됩니다. 구체적인 오류 코드와 처리 권장 사항은 "부록: 통합 오류 코드"를 참조합니다. 작업 상태 설명은 "텍스트-동영상"과 동일합니다.
작업 결과 조회
API 설명
모든 생성 기능이 공유하는 작업 조회 방식입니다. 작업을 제출하여 task_id가 반환되면 통합 작업 조회 엔드포인트를 통해 작업 상태를 폴링합니다. 성공하면 결과에서 동영상 URL을 가져옵니다.
API: GET https://tokenhub-intl.tencentcloudmaas.com/v1/wand/minimax-video-v2/tasks/{task_id}
참고: 경로의 {task_id}는 작업 제출 시 반환된 task_id이며 예시에서는 YOUR_TASK_ID로 표시됩니다. 동영상 생성에는 약 1~3분이 걸리므로 3~5초마다 폴링하는 것이 좋습니다.
요청 파라미터
| 파라미터 | 필수 | 타입 | 설명 |
|---|---|---|---|
| task_id | 필수 | string | 작업 ID(경로 파라미터)로, 작업 제출 시 반환된 task_id입니다. |
요청 예시
curl -X GET 'https://tokenhub-intl.tencentcloudmaas.com/v1/wand/minimax-video-v2/tasks/YOUR_TASK_ID' \
-H 'Authorization: Bearer YOUR_API_KEY'응답 파라미터
| 필드 | 타입 | 설명 |
|---|---|---|
| task | object | 작업 객체입니다. |
| task.id | string | 작업 ID입니다. |
| task.model | string | 사용된 모델 이름입니다(예: MiniMax-H3, MiniMax-H3-Max). |
| task.status | string | 작업 상태: queued / running / succeeded / failed. |
| task.task_type | string | 작업 유형입니다(예: generation(동영상 생성)). |
| task.created_at | integer | 작업 생성 시간으로, 초 단위 Unix 타임스탬프입니다. |
| task.updated_at | integer | 작업 업데이트 시간으로, 초 단위 Unix 타임스탬프입니다. |
| task.content | object | 생성된 작업 결과의 콘텐츠로, 성공 시 반환됩니다. |
| task.content.url | string | 생성된 동영상의 다운로드 URL입니다. 12시간 동안 유효한 임시 URL이므로 즉시 다운로드하여 저장합니다. |
| task.duration | integer | 동영상 길이(초)입니다. |
| task.resolution | string | 동영상 해상도입니다(예: 768P). |
| task.ratio | string | 동영상 종횡비입니다(예: 16:9). |
| task.usage | object | 작업의 동영상 사용량 정보입니다. |
| task.usage.input_image_count | integer | 입력 이미지 수입니다. |
| task.usage.input_seconds | integer | 입력 동영상 길이(초)입니다. |
| task.usage.output_seconds | integer | 출력 동영상 길이(초)입니다. |
| task.usage.total_seconds | integer | 전체 동영상 길이(초)입니다. |
| tokenhub_usage | object | 이 요청의 사용량입니다. |
| tokenhub_usage.total_tokens | integer | 이 작업에서 소비한 토큰 수로, 과금 및 정산에 사용됩니다. |
| request_id | string | 문제 위치 확인 및 해결에 사용되는 고유 요청 식별자입니다. |
참고: 조회 응답은 base_resp 또는 최상위 status가 없는 task 객체입니다. 작업 식별자와 상태는 task.id / task.status에 있습니다.
응답 예시
생성 성공:
{
"task": {
"id": "4-WandVideo-a786becfdc80433b8cff4aa344c8fd3d",
"model": "MiniMax-H3-Max",
"task_type": "generation",
"status": "succeeded",
"created_at": 1772345678,
"updated_at": 1772345810,
"resolution": "768P",
"duration": 5,
"ratio": "16:9",
"content": {
"url": "https://example.com/output-video.mp4"
},
"usage": {
"total_seconds": 5,
"input_seconds": 0,
"output_seconds": 5,
"input_image_count": 0
}
},
"tokenhub_usage": {
"total_tokens": 102655
},
"request_id": "3aec3299-06ad-4654-8b45-c57b823a15d2"
}오류 코드
| status | 설명 | 처리 권장 사항 |
|---|---|---|
| succeeded | 생성 성공 | task.content.url에서 동영상 URL을 가져옵니다. |
| queued / running | 대기열 대기 / 생성 중 | 작업이 성공할 때까지 3~5초마다 한 번씩 폴링합니다. |
| failed | 생성 실패 | 실패 원인(task.error 참조)을 확인하고 수정한 후 다시 시도하십시오. 실패가 지속되면 기술 지원에 문의하고 request_id를 제공합니다. |
요청 수준 오류 코드는 "부록: 통합 오류 코드"를 참조합니다.
부록
통합 오류 코드
| HTTP 상태 코드 | 비즈니스 코드 | 오류 메시지 | 설명 |
|---|---|---|---|
200 |
0 |
성공 | 요청에 성공했습니다. |
401 |
1000 |
인증 실패 | Authorization이 없거나 apikey가 유효하지 않습니다. |
401 |
1001 |
Authorization이 비어 있음 | Authorization 헤더가 전달되지 않았습니다. |
401 |
1002 |
Authorization이 유효하지 않음 | apikey가 유효하지 않거나 만료되었습니다. |
401 |
1003 |
Authorization이 아직 유효하지 않음 | apikey가 아직 유효하지 않습니다. |
401 |
1004 |
Authorization이 만료됨 | apikey가 만료되었습니다. |
429 |
1100 |
계정 이상 | 계정 이상입니다(결제 연체, 정지 또는 차단 때문일 수 있음). |
429 |
1101 |
계정 연체(후불) | 후불 계정의 결제가 연체되었습니다. |
429 |
1102 |
리소스 팩 소진 또는 만료 | 리소스 팩이 소진되었거나 만료되었습니다. |
403 |
1103 |
요청한 리소스에 대한 액세스 거부 | 요청한 리소스에 액세스할 수 없습니다(해당 모델/기능을 구독하지 않음). |
400 |
1200 |
잘못된 요청 파라미터 | 요청 파라미터가 잘못되었습니다(필수 필드 누락, 잘못된 타입, 범위를 벗어난 열거형 값 등). |
400 |
1201 |
잘못된 파라미터 | 파라미터 값이 잘못되었습니다. 문서에서 유효한 값 범위를 확인합니다. |
404 |
1202 |
요청한 메서드가 유효하지 않음 | HTTP 메서드가 잘못되었습니다. |
404 |
1203 |
요청한 리소스가 존재하지 않음 | 엔드포인트 경로가 잘못되었거나 리소스가 존재하지 않습니다. |
400 |
1300 |
플랫폼 정책 트리거 | 플랫폼 정책(예: 콘텐츠 검토 실패 또는 규정을 준수하지 않는 입력)이 트리거되었습니다. |
400 |
1301 |
플랫폼 민감 단어 목록 트리거 | 콘텐츠에 민감한 단어 또는 규정을 준수하지 않는 프롬프트가 포함되어 있습니다. |
429 |
1302 |
API 호출 빈도가 너무 높음 | 호출 빈도가 너무 높아 속도 제한이 트리거되었습니다. |
429 |
1303 |
동시 실행 수 또는 QPS가 제한 초과 | 동시 실행 수 또는 QPS가 사전 설정된 할당량을 초과했습니다. |
400 |
1304 |
IP 정책 트리거 | IP 주소 정책에 따른 차단이 트리거되었습니다. |
500 |
5000 |
내부 서버 오류 | 내부 서버 오류입니다. |
503 |
5001 |
서버를 일시적으로 사용할 수 없음 | 서비스를 일시적으로 사용할 수 없습니다(일반적으로 높은 부하 또는 유지 관리 때문임). |
504 |
5002 |
서버 내부 시간 초과 | 서버 내부 시간 초과입니다. |
일반 자료 제약 조건
이미지: JPG / JPEG / PNG / WEBP / HEIC / HEIF, 30 MB 이하, 너비와 높이 256~5760 px, 종횡비 0.4~2.5, 첫 프레임 최대 1개, 마지막 프레임 최대 1개, 참조 이미지 최대 9개.
동영상(참조 동영상, h3 전용): MP4 / MOV(H.264 / H.265, 오디오 AAC / MP3), 50 MB 이하, 최대 3개 세그먼트, 각 세그먼트 2~15초이면서 총길이 15초 이하, 너비와 높이 256~5760 px, 종횡비 0.4~2.5, 프레임 속도 23.976~60 fps.
오디오(참조 오디오, h3 전용): WAV / MP3, 15 MB 이하, 최대 3개 세그먼트, 각 세그먼트 2~15초이면서 총길이 15초 이하.
참고: 전체 요청 본문 크기는 64 MB를 초과할 수 없습니다. 큰 파일에는 Base64 대신 공개 네트워크 URL을 사용합니다.
FAQ
1. 두 모델 중 어떤 모델을 선택해야 합니까?
2K직접 출력, 멀티모달 참조(참조 이미지/동영상/오디오), 최소 길이4초가 필요한 경우:minimax-video-h3.멀티모달 참조 없이 H3 화질과 더 빠른 생성 및 더 낮은 비용이 필요한 경우:
minimax-video-h3-max.
2. 길이와 해상도 제한은 무엇입니까?
h3: 길이
4~15초, 해상도768P/2K(1080P입력은768P로 다운그레이드되고4K는2K로 다운그레이드됨).h3-max: 길이
5~15초(4초는 지원되지 않음), 해상도는480P/768P만 지원하며1080P/2K/4K입력은 별도 알림 없이768P로 다운그레이드됩니다.
3. 카메라 움직임은 어떻게 제어합니까?
프롬프트에서 "카메라가 천천히 줌인한다" 또는 "카메라가 왼쪽으로 패닝한다"와 같이 카메라 움직임을 자연어로 설명합니다. 특별한 명령 구문은 필요하지 않습니다.
4. 생성된 동영상 링크는 만료됩니까?
링크는 만료됩니다. 생성 결과는 12시간 동안 유효한 임시 주소입니다. 작업이 성공하면 동영상 파일을 즉시 다운로드하여 자체 스토리지로 전송하십시오. 장기간 사용을 위해 이 링크에 의존하지 마십시오.
