Hy
On this page
Endpoint: POST https://tokenhub-intl.tencentcloudmaas.com/v1/wand/hunyuan-image/v3-generation
인증: Tokenhub API Key / Bearer
Hy Image는 텍스트 기반 이미지 생성과 참조 이미지 편집을 지원합니다. 3.5 Preview는 대화 이력을 이용한 연속 편집을 지원합니다.
기본 정보
| 항목 | 값 |
|---|---|
| 호출 경로 | Tokenhub API |
| 가드레일 해제 지원 | 미지원 |
Hy-Image-3.0 이미지 생성
API 설명
텍스트 프롬프트를 입력하여 이미지를 동기식으로 생성합니다. size를 전달하지 않고 프롬프트에 크기나 비율을 지정하면 모델이 사전 설정된 37개 조합 중 가장 가까운 항목을 선택합니다. 둘 다 지정하지 않으면 모델이 자동으로 예측합니다. 자세한 내용은 부록: Hy-Image-3.0 사전 설정 크기 목록을 참조합니다.
API: POST https://tokenhub-intl.tencentcloudmaas.com/v1/wand/hunyuan-image/v3-generation
요청 파라미터
| 파라미터 | 필수 | 타입 | 설명 |
|---|---|---|---|
| model | 필수 | string | 모델 ID. 값: hy-image-v3 |
| prompt | 필수 | string | 이미지 생성에 사용할 텍스트이며, 최대 길이는 8192자입니다. |
| images | 선택 | array[string] | 참조 이미지 0~3개입니다. 이미지 URL 또는 Base64를 지원합니다. 형식: png / jpeg / jpg. 이미지당 크기: ≤ 10 MB. |
| size | 선택 | string | 생성 크기이며 형식은 ${width}x${height}입니다.제약 조건: ① 너비와 높이가 모두 [512, 2048]픽셀 범위여야 합니다. ② 너비와 높이의 곱(이미지 면적)이 1024×1024픽셀을 초과하지 않아야 합니다.지정하지 않으면 모델이 사전 설정된 37개 조합에서 선택/예측합니다.자세한 내용은 부록: Hy-Image-3.0 사전 설정 크기 목록을 참조합니다. |
| seed | 선택 | integer | 생성 시드이며 범위는 [1, 4294967295]입니다. 생성 이미지 수가 1개일 때만 적용됩니다. 지정하지 않거나 0으로 설정하면 기본적으로 임의 시드를 사용합니다. |
| footnote | 선택 | string | 사용자 지정 워터마크 콘텐츠이며, 중국어나 영어와 관계없이 16자로 제한되고 이미지 오른쪽 아래에 생성됩니다. |
| revise | 선택 | boolean | 프롬프트 재작성 여부입니다. |
요청 예시
# Text-to-Image
curl -X POST 'https://tokenhub-intl.tencentcloudmaas.com/v1/wand/hunyuan-image/v3-generation' \
-H 'Authorization: Bearer YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "hy-image-v3",
"prompt": "An orange kitten on the windowsill looks toward the camera",
"size": "1024x1024"
}'응답 파라미터
| 파라미터 | 타입 | 설명 |
|---|---|---|
| id | string | 이 요청의 id입니다. |
| created | integer | Unix 타임스탬프입니다. |
| data | list | 반환된 이미지 생성 콘텐츠의 배열입니다. |
| data[n].url | string | 생성된 이미지 URL은 임시 URL이며 12시간 동안 유효합니다. 즉시 다운로드하여 저장합니다. |
| data[n].revised_prompt | string | 재작성된 프롬프트이며, revise가 활성화된 경우에만 반환됩니다. |
| request_id | string | 문제 해결에 사용하는 고유 요청 식별자입니다. |
| tokenhub_usage | object | 토큰 사용량입니다. |
| tokenhub_usage.total_tokens | integer | 이 작업에서 소비된 토큰 수이며, 청구/정산에 사용됩니다. |
응답 예시
{
"id": "4-WandImage-a786becfdc80433b8cff4aa344c8fd3d",
"created": 1785125529,
"data": [
{
"url": "https://aigc-image.cos.myqcloud.com/xxx/result.png",
"revised_prompt": "An orange kitten sits on a sun-drenched windowsill, turns to look at the camera, with detailed fur and a blurred background"
}
],
"request_id": "3aec3299-06ad-4654-8b45-c57b823a15d2",
"tokenhub_usage": {
"total_tokens": 1024
}
}반환되는 url은 12시간 동안 유효한 임시 주소입니다. 이 주소에는 인증이 필요하므로 브라우저 주소 표시줄에서 직접 접근하면 거부될 수 있습니다. 다음 방법 중 하나로 다운로드하는 것이 좋습니다.
curl -o generated_image.png 'https://aigc-image.cos.myqcloud.com/xxx/result.png'또는 코드에서 HTTP 클라이언트를 사용하여 다운로드하고 로컬 저장소에 저장합니다.
오류 코드
| HTTP 상태 코드 | 설명 | 처리 권장 사항 |
|---|---|---|
400 |
요청 형식이 잘못되었습니다. | 요청 본문의 필드 유형/값(예: size 제약 조건, prompt 길이, 모델 이름)을 확인합니다. |
401 |
인증에 실패했습니다. | API_KEY가 유효한지, Authorization이 Bearer 형식을 사용하는지 확인합니다. |
422 |
입력 또는 출력 조정에 실패했습니다(콘텐츠 안전 정책에 의해 차단됨). | 입력 또는 출력이 콘텐츠 안전 조정을 트리거합니다. 프롬프트 또는 비즈니스 정책을 조정하십시오. |
429 |
동시 요청 수가 제한을 초과했습니다. | 동시성 제한에 도달했습니다. 백오프를 적용하여 재시도하고 호출 동시성을 제어하십시오. |
500 |
내부 오류입니다. | 서버 예외가 발생했습니다. 요청을 재시도합니다. 오류가 지속되면 기술 지원에 문의하고 request_id를 제공합니다. |
Hy-Image-3.5-Preview 이미지 생성(텍스트-이미지 / 이미지-이미지 / 다중 턴 편집)
API 설명
Chat/Messages 프로토콜을 사용하여 한 개 이상의 컨텍스트 턴(텍스트 + 선택적 참조 이미지)을 입력하고 이미지를 동기식으로 생성합니다. size를 전달하지 않으면 모델이 프롬프트 의미와 generate_max_pixels 면적 등급을 기준으로 최종 너비와 높이를 결정합니다. size를 전달하면 지정된 크기로 이미지를 생성하며, 지원되는 최대 해상도는 4096×4096 (4K)입니다.
API: POST https://tokenhub-intl.tencentcloudmaas.com/v1/wand/hunyuan-image/v35-generation
요청 파라미터
2.1 최상위 파라미터
| 파라미터 | 필수 | 타입 | 설명 |
|---|---|---|---|
| model | 필수 | string | 모델 ID. 값: hy-image-v3.5-preview |
| messages | 필수 | array[object] | 여러 대화 턴의 콘텐츠이며 오래된 순서에서 최신 순서로 배열됩니다. 서버는 배열에서 마지막 role=user 메시지를 현재 이미지 생성 지침으로 사용하고, 나머지 객체를 다중 턴 편집용 과거 컨텍스트로 그대로 전달합니다. 요소 구조는 섹션 2.2 messages 요소 구조를 참조합니다. |
| size | 선택 | string | 생성 크기이며 형식은 ${width}x${height}입니다.제약 조건: 1. 너비와 높이는 모두 양의 정수이며 값 범위는 [256, 8192]입니다. 2. 너비 × 높이(면적)는 16777216을 초과하지 않아야 하므로 지원되는 최대 해상도는 4096×4096 (4K)입니다.이 파라미터를 전달하지 않거나 빈 문자열을 전달하면 모델이 프롬프트 의미와 generate_max_pixels를 기준으로 크기를 결정합니다.특정 값을 전달하면 지정된 크기로 이미지를 생성합니다. 4K 출력을 생성하려면 "size": "4096x4096"을 직접 전달합니다. |
| seed | 선택 | integer | 생성 시드이며 int64 유형이고 범위는 [0, 2^63-1]입니다. 0으로 설정하거나 지정하지 않으면 서버가 임의 값을 할당합니다. 음수 값은 거부됩니다. |
| generate_max_pixels | 선택 | integer | 생성 이미지의 대상 면적을 픽셀 단위로 지정합니다.size를 전달하지 않은 경우에만 적용됩니다.3개 열거형 등급을 지원합니다: 1048576 (1K, 1024×1024), 2359296 (1.5K, 기본값), 4194304 (2K).열거형이 아닌 중간 값을 전달하면 가장 가까운 면적 등급으로 분류됩니다. 참고: 이 파라미터의 최고 등급은 2K입니다.더 높은 해상도를 구현하려면 대신 size를 사용합니다. |
| resize_max_pixels | 선택 | integer | 입력 참조 이미지의 최대 면적(픽셀)입니다. 원본 이미지 면적이 임계값 이하이면 이미지를 그대로 전달합니다. 원본 이미지 면적이 임계값보다 크면 모델에 입력하기 전에 임계값에 근접하도록 비례 축소하여 대형 이미지(4K/6K)로 인한 컨텍스트 토큰 소비를 제어합니다. 지정하지 않으면 기본값은 1048576 (1024×1024)입니다. |
| session | 선택 | string | 추론 서비스의 일관된 해시 스케줄링에 사용하는 세션 ID입니다. 동일 세션의 여러 요청은 동일한 추론 인스턴스로 라우팅되어 KV-cache 적중률을 높입니다. 다중 턴 대화에서는 전체 세션에서 동일한 session 값을 유지하십시오. |
| footnote | 선택 | string | 사용자 지정 워터마크 콘텐츠이며 최대 16자(중국어나 영어와 관계없이 utf8.RuneCount로 계산)이고 이미지 오른쪽 아래에 생성됩니다. |
| use_search_tool | 선택 | object | 외부 검색 강화 스위치입니다. 구조는 {"value": true} 또는 {"value": false}로 고정됩니다. 기본적으로 비활성화됩니다. |
2.2 messages 요소 구조
messages[n]의 각 요소 구조는 다음과 같습니다.
| 파라미터 | 필수 | 타입 | 설명 |
|---|---|---|---|
| role | 필수 | string | 역할입니다. 지원되는 값: user / assistant / tool. tool 역할은 이전 이미지 생성 결과를 다음 턴의 컨텍스트로 다시 입력할 때만 나타납니다. |
| content | 선택 | array[object] | 이 턴의 구체적인 콘텐츠입니다. 요소 구조는 섹션 2.3 "content 요소 구조"를 참조합니다. assistant가 텍스트를 전송하지 않고 도구 호출만 트리거하는 경우 생략할 수 있습니다. |
| reasoning | 선택 | string | role=assistant인 경우 다중 턴 역입력에만 사용됩니다. 이전 응답의 원본 사고 과정 텍스트를 그대로 전달합니다. |
| tool_calls | 선택 | array | role=assistant인 경우 다중 턴 역입력에만 사용됩니다. 요소 구조는 표준 OpenAI tool_call인 {id, type:"function", function:{name, arguments}}를 따르며, 여기서 arguments는 JSON 문자열입니다. |
| tool_call_id | 선택 | string | role=tool인 경우 다중 턴 역입력에만 사용됩니다. 이전 assistant.tool_calls[i].id와 문자 단위로 정확히 일치해야 합니다. |
2.3 content 요소 구조
messages[n].content[m]의 각 요소 구조는 다음과 같습니다.
| 파라미터 | 필수 | 타입 | 설명 |
|---|---|---|---|
| type | 필수 | string | 콘텐츠 유형이며 text 또는 image_url입니다. |
| text | 선택 | string | type=text일 때 사용하며 구체적인 텍스트를 나타냅니다. |
| image_url | 선택 | object | type=image_url일 때 사용하며 구조는 {"url": "..."}입니다. http(s) 공용 네트워크 URL 또는 data:image/...;base64,... 형식을 지원합니다. 이미지당 크기: ≤ 20 MB. 총 이미지 수: ≤ 20. 제한을 초과하면 서버가 가장 먼 턴부터 가장 가까운 턴 순으로 자동 잘라냅니다. |
| is_generate | 선택 | bool | 생성된 이미지 콘텐츠를 role=tool로 다시 입력할 때만 true를 입력하여 이전 턴의 generate 도구에서 생성한 이미지임을 표시합니다. 다른 시나리오에서는 이 파라미터를 전달하지 마십시오. |
요청 예시
단일 턴 텍스트-이미지(4K 출력)
# Text-to-Image
curl -X POST 'https://tokenhub-intl.tencentcloudmaas.com/v1/wand/hunyuan-image/v35-generation' \
-H 'Authorization: Bearer YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "hy-image-v3.5-preview",
"size": "4096x4096",
"messages": [
{
"role": "user",
"content": [
{
"type": "text",
"text": "Draw a golden retriever running on the beach in warm evening light"
}
]
}
]
}'단일 턴 참조 이미지 기반 생성(텍스트 + 참조 이미지)
# Reference-Based Image Generation
curl -X POST 'https://tokenhub-intl.tencentcloudmaas.com/v1/wand/hunyuan-image/v35-generation' \
-H 'Authorization: Bearer YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "hy-image-v3.5-preview",
"session": "demo-session-001",
"messages": [
{
"role": "user",
"content": [
{
"type": "text",
"text": "Draw a cat in the style of this image"
},
{
"type": "image_url",
"image_url": {
"url": "https://mpstestmodel-1315536146.cos.ap-singapore.myqcloud.com/justin/wiki-examples/reference-cup.png"
}
}
]
}
]
}'다중 턴 편집(이전 응답의 assembled_history에 있는 세 메시지를 그대로 추가합니다).
{
"model": "hy-image-v3.5-preview",
"session": "demo-session-001",
"messages": [
{
"role": "user",
"content": [
{
"type": "text",
"text": "Draw a cat in the style of this image"
},
{
"type": "image_url",
"image_url": {
"url": "https://mpstestmodel-1315536146.cos.ap-singapore.myqcloud.com/justin/wiki-examples/reference-cup.png"
}
}
]
},
{
"role": "assistant",
"content": [
{
"type": "text",
"text": "I will use the generation tool to create the image as required."
}
],
"reasoning": "The user wants to draw a cat in the style of the dog...",
"tool_calls": [
{
"id": "generate@call_0",
"type": "function",
"function": {
"name": "generate",
"arguments": "{\"recaption\":\"a cat in similar style...\"}"
}
}
]
},
{
"role": "tool",
"tool_call_id": "generate@call_0",
"content": [
{
"type": "image_url",
"image_url": {
"url": "https://result.example.com/generated-image.png"
}
}
]
},
{
"role": "assistant",
"content": [
{
"type": "text",
"text": "The image you requested has been completed."
}
]
},
{
"role": "user",
"content": [
{
"type": "text",
"text": "Change the cat to a Ragdoll and the background to a fireplace"
}
]
}
]
}응답 파라미터
| 파라미터 | 타입 | 설명 |
|---|---|---|
| id | string | 이 요청의 추적 ID이며 전체 스트림에서 고유합니다. |
| object | string | 고정값 image.chat.completion.chunk입니다. |
| created | integer | 초 단위 Unix 타임스탬프입니다. |
| model | string | 실제 업스트림 서비스에서 반환하는 내부 버전 식별자입니다(예: HY-Image-3.5-Preview-4090-Tob-vX.Y). 업스트림 릴리스에 따라 변경되며 요청 본문에 전달한 hy-image-v3.5-preview와 동일하지 않습니다. 참조용일 뿐이며 클라이언트가 이 필드를 비즈니스 분기 결정에 사용하는 것은 사용하지 않습니다. |
| round | integer | 이 프레임이 속하는 LLM 턴이며 0부터 계산합니다. |
| choices | list | 고정 길이는 1입니다. |
| choices[0].delta | object | 기본 이미지 전달 객체이며 구조는 {"type":"image", "image":{"url":"...", "width":..., "height":..., "source":"generate", "tool_call_id":"generate@call_0"}}입니다.choices[0].delta.image.url은 이 이미지 생성의 최종 전달 URL이며, 클라이언트는 이 필드를 우선 읽어야 합니다. |
| choices[0].finish_reason | string | null | 성공한 최종 프레임에서는 일반적으로 null입니다(업스트림 서비스가 이미지를 마지막 delta 프레임으로 보낸 후 추가 완료 프레임 없이 스트림을 직접 종료함).콘텐츠 보안 차단/비즈니스 오류가 발생한 경우에만 error와 같은 null이 아닌 값입니다.요청 성공 여부를 판단할 때는 finish_reason 대신 choices[0].delta.image.url이 존재하는지 확인하는 것이 좋습니다. |
| usage.total_tokens | integer | 이 작업에서 소비된 총 토큰 수입니다(업스트림 서비스 기준이며, v3.5는 현재 prompt/completion을 구분하지 않음). |
| tokenhub_usage.total_tokens | integer | TokenHub 게이트웨이 측 청구/정산에 사용하는 토큰 소비량이며 일반적으로 usage.total_tokens와 일치합니다. |
| request_id | string | 문제 해결에 사용하는 고유 요청 식별자입니다. |
| assembled_history | list | 다음 턴의 컨텍스트 삽입을 위해 서버가 조합한 메시지 시퀀스이며, 구조는 요청 본문의 messages 요소와 동일합니다.일반적으로 다음 3개 객체로 구성됩니다. 1.role=assistant(reasoning + tool_calls를 포함하며 이 턴의 추론 및 도구 호출을 설명) 2.role=tool(도구에서 생성한 이미지의 중간 URL을 포함하며 tool_call_id가 ①과 일치) 3.role=assistant("요청한 이미지가 완성되었습니다."와 같은 마무리 텍스트만 포함) 다중 턴 편집에서는 배열을 그대로 다음 턴의 messages에 추가합니다. |
| error | object | 실패한 최종 프레임에만 포함되며 OpenAI 형식인 {type, code, message, request_id}를 사용합니다. |
choices[0].delta.image.url은 최종 이미지 URL입니다. assembled_history[].content[].image_url.url은 후속 편집에 사용하는 중간 이미지 URL입니다. 후속 요청에는 assembled_history를 보존하고 최종 결과는 별도로 저장합니다.
응답 예시
성공 응답:
{
"id": "1374200352-WandImage-085edfe2367d4a688f68e813af3665a5",
"object": "image.chat.completion.chunk",
"created": 1789720599,
"model": "HY-Image-3.5-Preview-4090-Tob-v1.2",
"round": 0,
"choices": [
{
"index": 0,
"delta": {
"type": "image",
"image": {
"url": "https://result.example.com/generated-image.png",
"width": 4096,
"height": 4096,
"source": "generate",
"tool_call_id": "generate@call_0"
}
},
"finish_reason": null
}
],
"usage": {
"total_tokens": 20000
},
"tokenhub_usage": {
"total_tokens": 20000
},
"request_id": "a1c00d07-041b-4daa-bae0-b7eabf2bc33a",
"assembled_history": [
{
"role": "assistant",
"content": [
{
"type": "text",
"text": "I will use the generation tool to create the image as required."
}
],
"reasoning": "The user instruction is \"dance\", which needs to be concretized into a specific visual representation...",
"tool_calls": [
{
"id": "generate@call_0",
"type": "function",
"function": {
"name": "generate",
"arguments": "{\"recaption\":\"...\",\"image_width\":\"855\",\"image_height\":\"1226\",\"source_image_indices_list\":\"[\\\"rdnd\\\"]\"}"
}
}
]
},
{
"role": "tool",
"tool_call_id": "generate@call_0",
"content": [
{
"type": "image_url",
"image_url": {
"url": "https://result.example.com/generated-image.png"
}
}
]
},
{
"role": "assistant",
"content": [
{
"type": "text",
"text": "The image you requested has been completed."
}
]
}
]
}실패 응답(예: 콘텐츠 조정 차단):
{
"id": "abc123",
"object": "image.chat.completion.chunk",
"created": 1785125530,
"model": "HY-Image-3.5-Preview-4090-Tob-v1.2",
"round": 0,
"choices": [
{
"index": 0,
"delta": {},
"finish_reason": "error"
}
],
"error": {
"type": "invalid_request_error",
"code": "content_filter",
"message": "input moderation rejected",
"request_id": "xxxxxxxx"
}
}반환되는 url은 12시간 동안 유효한 임시 주소입니다. 이 주소에는 인증이 필요하므로 브라우저 주소 표시줄에서 직접 접근하면 거부될 수 있습니다. 다음 방법 중 하나로 다운로드하는 것이 좋습니다.
curl -o generated_image.png 'https://result.example.com/generated-image.png'또는 코드에서 HTTP 클라이언트를 사용하여 다운로드하고 로컬 저장소에 저장합니다.
오류 코드
| HTTP 상태 코드 | 설명 | 처리 권장 사항 |
|---|---|---|
400 |
요청 형식이 잘못되었습니다. | 요청 본문의 필드 유형/값(예: size 제약 조건, 메시지 구조, 모델 이름)을 확인합니다. |
401 |
인증에 실패했습니다. | API_KEY가 유효한지, Authorization이 Bearer 형식을 사용하는지 확인합니다. |
422 |
입력 또는 출력 조정에 실패했습니다(콘텐츠 안전 정책에 의해 차단됨). | 입력 또는 출력이 콘텐츠 안전 조정을 트리거합니다. 프롬프트 또는 비즈니스 정책을 조정하십시오. |
429 |
동시 요청 수가 제한을 초과했습니다. | 동시성 제한에 도달했습니다. 백오프를 적용하여 재시도하고 호출 동시성을 제어하십시오. |
500 |
내부 오류입니다. | 서버 예외가 발생했습니다. 요청을 재시도합니다. 오류가 지속되면 기술 지원에 문의하고 request_id를 제공합니다. |
부록
Hy-Image-3.0 사전 설정 크기 목록
size를 전달하지 않으면 모델이 다음 37개 조합에서 선택/예측합니다. size를 전달하는 경우 제약 조건(너비와 높이가 512~2048 범위이고 곱이 1024×1024 이하여야 함)을 충족해야 합니다. 형식은 "너비 x 높이"입니다.
2048 x 512 |
1984 x 512 |
1920 x 512 |
1856 x 512 |
|---|---|---|---|
1792 x 512 |
1728 x 512 |
1664 x 512 |
1600 x 512 |
1536 x 512 |
1472 x 576 |
1408 x 640 |
1344 x 704 |
1280 x 768 |
1216 x 832 |
1152 x 896 |
1088 x 960 |
1024 x 1024 |
960 x 1088 |
896 x 1152 |
832 x 1216 |
768 x 1280 |
704 x 1344 |
640 x 1408 |
576 x 1472 |
512 x 1536 |
512 x 1600 |
512 x 1664 |
512 x 1728 |
512 x 1792 |
512 x 1856 |
512 x 1920 |
512 x 1984 |
512 x 2048 |
768 x 1024 |
720 x 1280 |
1024 x 768 |
1280 x 720 |
- | - | - |
참조 이미지 입력 제약 조건
| 모델 | 지원 형식 | 단일 이미지 크기 | 수량 |
|---|---|---|---|
| Hy-Image-3.0 | png / jpeg / jpg, 이미지 URL 또는 Base64 지원 | ≤ 10MB |
이미지 0~3개 |
| Hy-Image-3.5-Preview | png / jpeg / jpg, 이미지 URL 또는 Base64 지원 | ≤ 20MB |
≤ 최대 이미지 20개 |
인증이 필요 없는 직접 CDN 링크를 사용하는 것이 좋습니다. 도메인이 사설 네트워크에 있거나 인증이 필요한 경우 TokenHub 팀에 문의하여 허용 목록에 추가합니다.
자주 묻는 질문
1. 두 모델 중 어떻게 선택합니까?
Hy-Image-3.0은 요청 본문(prompt + size)이 간단한 전통적인 텍스트-이미지 API로, 단일 턴 일괄 이미지 생성과 비용에 민감한 통합 시나리오에 적합합니다. Hy-Image-3.5-Preview는 Chat/Messages 프로토콜을 사용하고 다중 이미지 입력, 다중 턴 편집 컨텍스트, 사고 과정 재작성을 지원하여 텍스트 표현, 사실감, 편집 일관성이 더 뛰어납니다. 최대 4K 출력을 지원하므로 포스터, UI 디자인, 제품 이미지 편집과 같은 전문 시각 콘텐츠 제작 시나리오에 적합합니다.
2. 4K 이미지는 어떻게 생성합니까?
Hy-Image-3.5-Preview만 지원합니다. "size": "4096x4096"을 전달하면 됩니다. 너비와 높이는 256~8192 범위여야 하며 면적은 16777216을 초과하지 않아야 합니다. 면적 제약 조건을 충족하면 "5461x3072"와 같은 다른 4K급 비율도 지원됩니다. generate_max_pixels의 최고 등급은 2K (4194304)이므로 4K 출력을 생성하려면 size 파라미터를 사용해야 합니다.
3. size / generate_max_pixels를 함께 사용하는 방법은 무엇입니까? (Hy-Image-3.5-Preview)
size만 전달: 정확한 너비와 높이로 강제 생성하며 모델의 자율 결정을 재정의합니다.4K시나리오에는 이 방법을 사용합니다.size+generate_max_pixels: 내부 로직에서 최종 너비와 높이를 계산합니다.size의 비율와generate_max_pixels의 면적 등급에 최대한 근접하면서 모델 성능에 최적인 크기를 선택합니다.generate_max_pixels만 전달: 기본 비율은1:1이며 면적은1K,1.5K,2K등급 중 하나로 할당됩니다.둘 다 전달하지 않음: 모델이 프롬프트 의미를 기준으로 자율 결정합니다(기본값은
1.5K등급).
4. Hy-Image-3.0에서 size 파라미터를 어떻게 전달합니까?
형식은 ${width}x${height}입니다(예: 1024x1024). 너비와 높이는 모두 512~2048 범위여야 하며 면적은 1024×1024를 초과하지 않아야 합니다. 부록의 Hy-Image-3.0 사전 설정 크기 목록에 있는 조합을 사용하는 것이 좋습니다. 전달하지 않으면 프롬프트에 비율(예: "가로형 16:9")를 설명할 수 있으며 모델이 가장 가까운 사전 설정 크기를 자동 선택합니다.
5. seed는 언제 적용됩니까? 결과를 어떻게 재현합니까?
Hy-Image-3.0: 값 범위는 [1, 4294967295]입니다. 생성 이미지 수가 1개일 때만 적용됩니다. 전달하지 않거나 0으로 설정하면 임의 시드를 사용합니다.
Hy-Image-3.5-Preview: 값 범위는 [0, 2^63-1]입니다. 0으로 설정하거나 전달하지 않으면 서버가 시드를 임의 할당합니다. 음수 값은 거부됩니다. 동일한 결과를 재현하려면 seed + prompt + size를 고정하십시오.
6. revise(프롬프트 재작성)를 비활성화해야 합니까? (Hy-Image-3.0)
재작성을 활성화하면 모델이 프롬프트를 자동으로 재작성하고 최적화하여 이미지 생성 품질을 높이며 약 11초가 소요됩니다. 자체 프롬프트 재작성 로직을 이미 구현한 경우에만 이 기능을 비활성화하는 것이 좋습니다. 그렇지 않으면 이미지 생성 품질이 크게 저하될 수 있습니다.
7. 다중 턴 편집용 컨텍스트는 어떻게 조합합니까? (Hy-Image-3.5-Preview)
(N+1)번째 요청의 messages = N번째 턴의 messages(첫 번째 user 메시지 포함) + N번째 턴 응답의 assembled_history(일반적으로 assistant + tool + assistant의 세 메시지) + 현재 턴의 새 user 메시지입니다. 서버가 assembled_history에 바로 사용할 수 있는 객체를 준비하므로 SSE delta를 직접 집계하거나 여러 단계로 중첩된 JSON을 조합할 필요가 없습니다. 참조하려면 위 "다중 턴 편집" 요청 예시에서 assistant / tool / assistant 메시지의 연결 형식을 확인합니다.
8. 생성된 이미지 링크는 만료됩니까?
만료됩니다. 두 모델의 생성 결과는 유효 기간이 12시간인 임시 URL입니다. 생성에 성공하면 즉시 다운로드하여 저장합니다. Hy-Image-3.0은 data[n].url을 사용합니다. Hy-Image-3.5-Preview는 choices[0].delta.image.url(비즈니스용 최종 전달 이미지)을 사용합니다. 다음 편집 턴에 사용할 과거 컨텍스트를 유지하려면 assembled_history[].content[].image_url.url(중간 산출물)도 저장할 수 있습니다. 모든 URL은 임시 서명 URL이므로 장기간 의존하지 마십시오.
버전별 지원 규격
| 버전 | 해상도 | 비율 | 참조 이미지 |
|---|---|---|---|
hy-image-v3 |
512–2048 px |
width / height 지정 | 최대 3장 |
hy-image-v3.5-preview |
256–8192 px |
width / height 지정 | 최대 6장 |
픽셀 면적 제한
| 버전 | 최대 픽셀 면적 | 프롬프트 한도 |
|---|---|---|
hy-image-v3 |
1024×1024 |
8192자 |
hy-image-v3.5-preview |
16,777,216 px / 4096×4096 |
100k 토큰 |
