WAND wiki
최근 문서

검색 결과가 없습니다. 모델명이나 다른 키워드로 검색해 보세요.

Tokenhub APILast Updated 2026-09-30

Hy

On this page

Endpoint: POST https://tokenhub-intl.tencentcloudmaas.com/v1/wand/hunyuan-image/v3-generation
인증: Tokenhub API Key / Bearer

Hy Image는 텍스트 기반 이미지 생성과 참조 이미지 편집을 지원합니다. 3.5 Preview는 대화 이력을 이용한 연속 편집을 지원합니다.

기본 정보

항목 값
호출 경로 Tokenhub API
가드레일 해제 지원 미지원

Hy-Image-3.0 이미지 생성

API 설명

텍스트 프롬프트를 입력하여 이미지를 동기식으로 생성합니다. size를 전달하지 않고 프롬프트에 크기나 비율을 지정하면 모델이 사전 설정된 37개 조합 중 가장 가까운 항목을 선택합니다. 둘 다 지정하지 않으면 모델이 자동으로 예측합니다. 자세한 내용은 부록: Hy-Image-3.0 사전 설정 크기 목록을 참조합니다.

API: POST https://tokenhub-intl.tencentcloudmaas.com/v1/wand/hunyuan-image/v3-generation

요청 파라미터

파라미터 필수 타입 설명
model 필수 string 모델 ID. 값: hy-image-v3
prompt 필수 string 이미지 생성에 사용할 텍스트이며, 최대 길이는 8192자입니다.
images 선택 array[string] 참조 이미지 0~3개입니다. 이미지 URL 또는 Base64를 지원합니다. 형식: png / jpeg / jpg. 이미지당 크기: ≤ 10 MB.
size 선택 string 생성 크기이며 형식은 ${width}x${height}입니다.
제약 조건: ① 너비와 높이가 모두 [512, 2048]픽셀 범위여야 합니다. ② 너비와 높이의 곱(이미지 면적)이 1024×1024픽셀을 초과하지 않아야 합니다.
지정하지 않으면 모델이 사전 설정된 37개 조합에서 선택/예측합니다.
자세한 내용은 부록: Hy-Image-3.0 사전 설정 크기 목록을 참조합니다.
seed 선택 integer 생성 시드이며 범위는 [1, 4294967295]입니다. 생성 이미지 수가 1개일 때만 적용됩니다. 지정하지 않거나 0으로 설정하면 기본적으로 임의 시드를 사용합니다.
footnote 선택 string 사용자 지정 워터마크 콘텐츠이며, 중국어나 영어와 관계없이 16자로 제한되고 이미지 오른쪽 아래에 생성됩니다.
revise 선택 boolean 프롬프트 재작성 여부입니다.

요청 예시

LANGUAGE
# Text-to-Image
curl -X POST 'https://tokenhub-intl.tencentcloudmaas.com/v1/wand/hunyuan-image/v3-generation' \
  -H 'Authorization: Bearer YOUR_API_KEY' \
  -H 'Content-Type: application/json' \
  -d '{
  "model": "hy-image-v3",
  "prompt": "An orange kitten on the windowsill looks toward the camera",
  "size": "1024x1024"
}'

응답 파라미터

파라미터 타입 설명
id string 이 요청의 id입니다.
created integer Unix 타임스탬프입니다.
data list 반환된 이미지 생성 콘텐츠의 배열입니다.
data[n].url string 생성된 이미지 URL은 임시 URL이며 12시간 동안 유효합니다. 즉시 다운로드하여 저장합니다.
data[n].revised_prompt string 재작성된 프롬프트이며, revise가 활성화된 경우에만 반환됩니다.
request_id string 문제 해결에 사용하는 고유 요청 식별자입니다.
tokenhub_usage object 토큰 사용량입니다.
tokenhub_usage.total_tokens integer 이 작업에서 소비된 토큰 수이며, 청구/정산에 사용됩니다.

응답 예시

LANGUAGE
{
  "id": "4-WandImage-a786becfdc80433b8cff4aa344c8fd3d",
  "created": 1785125529,
  "data": [
    {
      "url": "https://aigc-image.cos.myqcloud.com/xxx/result.png",
      "revised_prompt": "An orange kitten sits on a sun-drenched windowsill, turns to look at the camera, with detailed fur and a blurred background"
    }
  ],
  "request_id": "3aec3299-06ad-4654-8b45-c57b823a15d2",
  "tokenhub_usage": {
    "total_tokens": 1024
  }
}

반환되는 url은 12시간 동안 유효한 임시 주소입니다. 이 주소에는 인증이 필요하므로 브라우저 주소 표시줄에서 직접 접근하면 거부될 수 있습니다. 다음 방법 중 하나로 다운로드하는 것이 좋습니다.

LANGUAGE
curl -o generated_image.png 'https://aigc-image.cos.myqcloud.com/xxx/result.png'

또는 코드에서 HTTP 클라이언트를 사용하여 다운로드하고 로컬 저장소에 저장합니다.

오류 코드

HTTP 상태 코드 설명 처리 권장 사항
400 요청 형식이 잘못되었습니다. 요청 본문의 필드 유형/값(예: size 제약 조건, prompt 길이, 모델 이름)을 확인합니다.
401 인증에 실패했습니다. API_KEY가 유효한지, Authorization이 Bearer 형식을 사용하는지 확인합니다.
422 입력 또는 출력 조정에 실패했습니다(콘텐츠 안전 정책에 의해 차단됨). 입력 또는 출력이 콘텐츠 안전 조정을 트리거합니다. 프롬프트 또는 비즈니스 정책을 조정하십시오.
429 동시 요청 수가 제한을 초과했습니다. 동시성 제한에 도달했습니다. 백오프를 적용하여 재시도하고 호출 동시성을 제어하십시오.
500 내부 오류입니다. 서버 예외가 발생했습니다. 요청을 재시도합니다. 오류가 지속되면 기술 지원에 문의하고 request_id를 제공합니다.

Hy-Image-3.5-Preview 이미지 생성(텍스트-이미지 / 이미지-이미지 / 다중 턴 편집)

API 설명

Chat/Messages 프로토콜을 사용하여 한 개 이상의 컨텍스트 턴(텍스트 + 선택적 참조 이미지)을 입력하고 이미지를 동기식으로 생성합니다. size를 전달하지 않으면 모델이 프롬프트 의미와 generate_max_pixels 면적 등급을 기준으로 최종 너비와 높이를 결정합니다. size를 전달하면 지정된 크기로 이미지를 생성하며, 지원되는 최대 해상도는 4096×4096 (4K)입니다.

API: POST https://tokenhub-intl.tencentcloudmaas.com/v1/wand/hunyuan-image/v35-generation

요청 파라미터

2.1 최상위 파라미터

파라미터 필수 타입 설명
model 필수 string 모델 ID. 값: hy-image-v3.5-preview
messages 필수 array[object] 여러 대화 턴의 콘텐츠이며 오래된 순서에서 최신 순서로 배열됩니다. 서버는 배열에서 마지막 role=user 메시지를 현재 이미지 생성 지침으로 사용하고, 나머지 객체를 다중 턴 편집용 과거 컨텍스트로 그대로 전달합니다. 요소 구조는 섹션 2.2 messages 요소 구조를 참조합니다.
size 선택 string 생성 크기이며 형식은 ${width}x${height}입니다.
제약 조건: 1.
너비와 높이는 모두 양의 정수이며 값 범위는 [256, 8192]입니다. 2.
너비 × 높이(면적)는 16777216을 초과하지 않아야 하므로 지원되는 최대 해상도는 4096×4096 (4K)입니다.
이 파라미터를 전달하지 않거나 빈 문자열을 전달하면 모델이 프롬프트 의미와 generate_max_pixels를 기준으로 크기를 결정합니다.
특정 값을 전달하면 지정된 크기로 이미지를 생성합니다.
4K 출력을 생성하려면 "size": "4096x4096"을 직접 전달합니다.
seed 선택 integer 생성 시드이며 int64 유형이고 범위는 [0, 2^63-1]입니다. 0으로 설정하거나 지정하지 않으면 서버가 임의 값을 할당합니다. 음수 값은 거부됩니다.
generate_max_pixels 선택 integer 생성 이미지의 대상 면적을 픽셀 단위로 지정합니다.
size를 전달하지 않은 경우에만 적용됩니다.
3개 열거형 등급을 지원합니다: 1048576 (1K, 1024×1024), 2359296 (1.5K, 기본값), 4194304 (2K).
열거형이 아닌 중간 값을 전달하면 가장 가까운 면적 등급으로 분류됩니다.
참고: 이 파라미터의 최고 등급은 2K입니다.
더 높은 해상도를 구현하려면 대신 size를 사용합니다.
resize_max_pixels 선택 integer 입력 참조 이미지의 최대 면적(픽셀)입니다. 원본 이미지 면적이 임계값 이하이면 이미지를 그대로 전달합니다. 원본 이미지 면적이 임계값보다 크면 모델에 입력하기 전에 임계값에 근접하도록 비례 축소하여 대형 이미지(4K/6K)로 인한 컨텍스트 토큰 소비를 제어합니다. 지정하지 않으면 기본값은 1048576 (1024×1024)입니다.
session 선택 string 추론 서비스의 일관된 해시 스케줄링에 사용하는 세션 ID입니다. 동일 세션의 여러 요청은 동일한 추론 인스턴스로 라우팅되어 KV-cache 적중률을 높입니다. 다중 턴 대화에서는 전체 세션에서 동일한 session 값을 유지하십시오.
footnote 선택 string 사용자 지정 워터마크 콘텐츠이며 최대 16자(중국어나 영어와 관계없이 utf8.RuneCount로 계산)이고 이미지 오른쪽 아래에 생성됩니다.
use_search_tool 선택 object 외부 검색 강화 스위치입니다. 구조는 {"value": true} 또는 {"value": false}로 고정됩니다. 기본적으로 비활성화됩니다.

2.2 messages 요소 구조

messages[n]의 각 요소 구조는 다음과 같습니다.

파라미터 필수 타입 설명
role 필수 string 역할입니다. 지원되는 값: user / assistant / tool. tool 역할은 이전 이미지 생성 결과를 다음 턴의 컨텍스트로 다시 입력할 때만 나타납니다.
content 선택 array[object] 이 턴의 구체적인 콘텐츠입니다. 요소 구조는 섹션 2.3 "content 요소 구조"를 참조합니다. assistant가 텍스트를 전송하지 않고 도구 호출만 트리거하는 경우 생략할 수 있습니다.
reasoning 선택 string role=assistant인 경우 다중 턴 역입력에만 사용됩니다. 이전 응답의 원본 사고 과정 텍스트를 그대로 전달합니다.
tool_calls 선택 array role=assistant인 경우 다중 턴 역입력에만 사용됩니다. 요소 구조는 표준 OpenAI tool_call인 {id, type:"function", function:{name, arguments}}를 따르며, 여기서 arguments는 JSON 문자열입니다.
tool_call_id 선택 string role=tool인 경우 다중 턴 역입력에만 사용됩니다. 이전 assistant.tool_calls[i].id와 문자 단위로 정확히 일치해야 합니다.

2.3 content 요소 구조

messages[n].content[m]의 각 요소 구조는 다음과 같습니다.

파라미터 필수 타입 설명
type 필수 string 콘텐츠 유형이며 text 또는 image_url입니다.
text 선택 string type=text일 때 사용하며 구체적인 텍스트를 나타냅니다.
image_url 선택 object type=image_url일 때 사용하며 구조는 {"url": "..."}입니다. http(s) 공용 네트워크 URL 또는 data:image/...;base64,... 형식을 지원합니다. 이미지당 크기: ≤ 20 MB. 총 이미지 수: ≤ 20. 제한을 초과하면 서버가 가장 먼 턴부터 가장 가까운 턴 순으로 자동 잘라냅니다.
is_generate 선택 bool 생성된 이미지 콘텐츠를 role=tool로 다시 입력할 때만 true를 입력하여 이전 턴의 generate 도구에서 생성한 이미지임을 표시합니다. 다른 시나리오에서는 이 파라미터를 전달하지 마십시오.

요청 예시

단일 턴 텍스트-이미지(4K 출력)

LANGUAGE
# Text-to-Image
curl -X POST 'https://tokenhub-intl.tencentcloudmaas.com/v1/wand/hunyuan-image/v35-generation' \
  -H 'Authorization: Bearer YOUR_API_KEY' \
  -H 'Content-Type: application/json' \
  -d '{
  "model": "hy-image-v3.5-preview",
  "size": "4096x4096",
  "messages": [
    {
      "role": "user",
      "content": [
        {
          "type": "text",
          "text": "Draw a golden retriever running on the beach in warm evening light"
        }
      ]
    }
  ]
}'

단일 턴 참조 이미지 기반 생성(텍스트 + 참조 이미지)

LANGUAGE
# Reference-Based Image Generation
curl -X POST 'https://tokenhub-intl.tencentcloudmaas.com/v1/wand/hunyuan-image/v35-generation' \
  -H 'Authorization: Bearer YOUR_API_KEY' \
  -H 'Content-Type: application/json' \
  -d '{
  "model": "hy-image-v3.5-preview",
  "session": "demo-session-001",
  "messages": [
    {
      "role": "user",
      "content": [
        {
          "type": "text",
          "text": "Draw a cat in the style of this image"
        },
        {
          "type": "image_url",
          "image_url": {
            "url": "https://mpstestmodel-1315536146.cos.ap-singapore.myqcloud.com/justin/wiki-examples/reference-cup.png"
          }
        }
      ]
    }
  ]
}'

다중 턴 편집(이전 응답의 assembled_history에 있는 세 메시지를 그대로 추가합니다).

LANGUAGE
{
  "model": "hy-image-v3.5-preview",
  "session": "demo-session-001",
  "messages": [
    {
      "role": "user",
      "content": [
        {
          "type": "text",
          "text": "Draw a cat in the style of this image"
        },
        {
          "type": "image_url",
          "image_url": {
            "url": "https://mpstestmodel-1315536146.cos.ap-singapore.myqcloud.com/justin/wiki-examples/reference-cup.png"
          }
        }
      ]
    },
    {
      "role": "assistant",
      "content": [
        {
          "type": "text",
          "text": "I will use the generation tool to create the image as required."
        }
      ],
      "reasoning": "The user wants to draw a cat in the style of the dog...",
      "tool_calls": [
        {
          "id": "generate@call_0",
          "type": "function",
          "function": {
            "name": "generate",
            "arguments": "{\"recaption\":\"a cat in similar style...\"}"
          }
        }
      ]
    },
    {
      "role": "tool",
      "tool_call_id": "generate@call_0",
      "content": [
        {
          "type": "image_url",
          "image_url": {
            "url": "https://result.example.com/generated-image.png"
          }
        }
      ]
    },
    {
      "role": "assistant",
      "content": [
        {
          "type": "text",
          "text": "The image you requested has been completed."
        }
      ]
    },
    {
      "role": "user",
      "content": [
        {
          "type": "text",
          "text": "Change the cat to a Ragdoll and the background to a fireplace"
        }
      ]
    }
  ]
}

응답 파라미터

파라미터 타입 설명
id string 이 요청의 추적 ID이며 전체 스트림에서 고유합니다.
object string 고정값 image.chat.completion.chunk입니다.
created integer 초 단위 Unix 타임스탬프입니다.
model string 실제 업스트림 서비스에서 반환하는 내부 버전 식별자입니다(예: HY-Image-3.5-Preview-4090-Tob-vX.Y). 업스트림 릴리스에 따라 변경되며 요청 본문에 전달한 hy-image-v3.5-preview와 동일하지 않습니다. 참조용일 뿐이며 클라이언트가 이 필드를 비즈니스 분기 결정에 사용하는 것은 사용하지 않습니다.
round integer 이 프레임이 속하는 LLM 턴이며 0부터 계산합니다.
choices list 고정 길이는 1입니다.
choices[0].delta object 기본 이미지 전달 객체이며 구조는 {"type":"image", "image":{"url":"...", "width":..., "height":..., "source":"generate", "tool_call_id":"generate@call_0"}}입니다.
choices[0].delta.image.url은 이 이미지 생성의 최종 전달 URL이며, 클라이언트는 이 필드를 우선 읽어야 합니다.
choices[0].finish_reason string | null 성공한 최종 프레임에서는 일반적으로 null입니다(업스트림 서비스가 이미지를 마지막 delta 프레임으로 보낸 후 추가 완료 프레임 없이 스트림을 직접 종료함).
콘텐츠 보안 차단/비즈니스 오류가 발생한 경우에만 error와 같은 null이 아닌 값입니다.
요청 성공 여부를 판단할 때는 finish_reason 대신 choices[0].delta.image.url이 존재하는지 확인하는 것이 좋습니다.
usage.total_tokens integer 이 작업에서 소비된 총 토큰 수입니다(업스트림 서비스 기준이며, v3.5는 현재 prompt/completion을 구분하지 않음).
tokenhub_usage.total_tokens integer TokenHub 게이트웨이 측 청구/정산에 사용하는 토큰 소비량이며 일반적으로 usage.total_tokens와 일치합니다.
request_id string 문제 해결에 사용하는 고유 요청 식별자입니다.
assembled_history list 다음 턴의 컨텍스트 삽입을 위해 서버가 조합한 메시지 시퀀스이며, 구조는 요청 본문의 messages 요소와 동일합니다.
일반적으로 다음 3개 객체로 구성됩니다. 1.
role=assistant(reasoning + tool_calls를 포함하며 이 턴의 추론 및 도구 호출을 설명) 2.
role=tool(도구에서 생성한 이미지의 중간 URL을 포함하며 tool_call_id가 ①과 일치) 3.
role=assistant("요청한 이미지가 완성되었습니다."와 같은 마무리 텍스트만 포함) 다중 턴 편집에서는 배열을 그대로 다음 턴의 messages에 추가합니다.
error object 실패한 최종 프레임에만 포함되며 OpenAI 형식인 {type, code, message, request_id}를 사용합니다.

choices[0].delta.image.url은 최종 이미지 URL입니다. assembled_history[].content[].image_url.url은 후속 편집에 사용하는 중간 이미지 URL입니다. 후속 요청에는 assembled_history를 보존하고 최종 결과는 별도로 저장합니다.

응답 예시

성공 응답:

LANGUAGE
{
  "id": "1374200352-WandImage-085edfe2367d4a688f68e813af3665a5",
  "object": "image.chat.completion.chunk",
  "created": 1789720599,
  "model": "HY-Image-3.5-Preview-4090-Tob-v1.2",
  "round": 0,
  "choices": [
    {
      "index": 0,
      "delta": {
        "type": "image",
        "image": {
          "url": "https://result.example.com/generated-image.png",
          "width": 4096,
          "height": 4096,
          "source": "generate",
          "tool_call_id": "generate@call_0"
        }
      },
      "finish_reason": null
    }
  ],
  "usage": {
    "total_tokens": 20000
  },
  "tokenhub_usage": {
    "total_tokens": 20000
  },
  "request_id": "a1c00d07-041b-4daa-bae0-b7eabf2bc33a",
  "assembled_history": [
    {
      "role": "assistant",
      "content": [
        {
          "type": "text",
          "text": "I will use the generation tool to create the image as required."
        }
      ],
      "reasoning": "The user instruction is \"dance\", which needs to be concretized into a specific visual representation...",
      "tool_calls": [
        {
          "id": "generate@call_0",
          "type": "function",
          "function": {
            "name": "generate",
            "arguments": "{\"recaption\":\"...\",\"image_width\":\"855\",\"image_height\":\"1226\",\"source_image_indices_list\":\"[\\\"rdnd\\\"]\"}"
          }
        }
      ]
    },
    {
      "role": "tool",
      "tool_call_id": "generate@call_0",
      "content": [
        {
          "type": "image_url",
          "image_url": {
            "url": "https://result.example.com/generated-image.png"
          }
        }
      ]
    },
    {
      "role": "assistant",
      "content": [
        {
          "type": "text",
          "text": "The image you requested has been completed."
        }
      ]
    }
  ]
}

실패 응답(예: 콘텐츠 조정 차단):

LANGUAGE
{
  "id": "abc123",
  "object": "image.chat.completion.chunk",
  "created": 1785125530,
  "model": "HY-Image-3.5-Preview-4090-Tob-v1.2",
  "round": 0,
  "choices": [
    {
      "index": 0,
      "delta": {},
      "finish_reason": "error"
    }
  ],
  "error": {
    "type": "invalid_request_error",
    "code": "content_filter",
    "message": "input moderation rejected",
    "request_id": "xxxxxxxx"
  }
}

반환되는 url은 12시간 동안 유효한 임시 주소입니다. 이 주소에는 인증이 필요하므로 브라우저 주소 표시줄에서 직접 접근하면 거부될 수 있습니다. 다음 방법 중 하나로 다운로드하는 것이 좋습니다.

LANGUAGE
curl -o generated_image.png 'https://result.example.com/generated-image.png'

또는 코드에서 HTTP 클라이언트를 사용하여 다운로드하고 로컬 저장소에 저장합니다.

오류 코드

HTTP 상태 코드 설명 처리 권장 사항
400 요청 형식이 잘못되었습니다. 요청 본문의 필드 유형/값(예: size 제약 조건, 메시지 구조, 모델 이름)을 확인합니다.
401 인증에 실패했습니다. API_KEY가 유효한지, Authorization이 Bearer 형식을 사용하는지 확인합니다.
422 입력 또는 출력 조정에 실패했습니다(콘텐츠 안전 정책에 의해 차단됨). 입력 또는 출력이 콘텐츠 안전 조정을 트리거합니다. 프롬프트 또는 비즈니스 정책을 조정하십시오.
429 동시 요청 수가 제한을 초과했습니다. 동시성 제한에 도달했습니다. 백오프를 적용하여 재시도하고 호출 동시성을 제어하십시오.
500 내부 오류입니다. 서버 예외가 발생했습니다. 요청을 재시도합니다. 오류가 지속되면 기술 지원에 문의하고 request_id를 제공합니다.

부록

Hy-Image-3.0 사전 설정 크기 목록

size를 전달하지 않으면 모델이 다음 37개 조합에서 선택/예측합니다. size를 전달하는 경우 제약 조건(너비와 높이가 512~2048 범위이고 곱이 1024×1024 이하여야 함)을 충족해야 합니다. 형식은 "너비 x 높이"입니다.

2048 x 512 1984 x 512 1920 x 512 1856 x 512
1792 x 512 1728 x 512 1664 x 512 1600 x 512
1536 x 512 1472 x 576 1408 x 640 1344 x 704
1280 x 768 1216 x 832 1152 x 896 1088 x 960
1024 x 1024 960 x 1088 896 x 1152 832 x 1216
768 x 1280 704 x 1344 640 x 1408 576 x 1472
512 x 1536 512 x 1600 512 x 1664 512 x 1728
512 x 1792 512 x 1856 512 x 1920 512 x 1984
512 x 2048 768 x 1024 720 x 1280 1024 x 768
1280 x 720 - - -

참조 이미지 입력 제약 조건

모델 지원 형식 단일 이미지 크기 수량
Hy-Image-3.0 png / jpeg / jpg, 이미지 URL 또는 Base64 지원 ≤ 10MB 이미지 0~3개
Hy-Image-3.5-Preview png / jpeg / jpg, 이미지 URL 또는 Base64 지원 ≤ 20MB ≤ 최대 이미지 20개

인증이 필요 없는 직접 CDN 링크를 사용하는 것이 좋습니다. 도메인이 사설 네트워크에 있거나 인증이 필요한 경우 TokenHub 팀에 문의하여 허용 목록에 추가합니다.

자주 묻는 질문

1. 두 모델 중 어떻게 선택합니까?

Hy-Image-3.0은 요청 본문(prompt + size)이 간단한 전통적인 텍스트-이미지 API로, 단일 턴 일괄 이미지 생성과 비용에 민감한 통합 시나리오에 적합합니다. Hy-Image-3.5-Preview는 Chat/Messages 프로토콜을 사용하고 다중 이미지 입력, 다중 턴 편집 컨텍스트, 사고 과정 재작성을 지원하여 텍스트 표현, 사실감, 편집 일관성이 더 뛰어납니다. 최대 4K 출력을 지원하므로 포스터, UI 디자인, 제품 이미지 편집과 같은 전문 시각 콘텐츠 제작 시나리오에 적합합니다.

2. 4K 이미지는 어떻게 생성합니까?

Hy-Image-3.5-Preview만 지원합니다. "size": "4096x4096"을 전달하면 됩니다. 너비와 높이는 256~8192 범위여야 하며 면적은 16777216을 초과하지 않아야 합니다. 면적 제약 조건을 충족하면 "5461x3072"와 같은 다른 4K급 비율도 지원됩니다. generate_max_pixels의 최고 등급은 2K (4194304)이므로 4K 출력을 생성하려면 size 파라미터를 사용해야 합니다.

3. size / generate_max_pixels를 함께 사용하는 방법은 무엇입니까? (Hy-Image-3.5-Preview)

  • size만 전달: 정확한 너비와 높이로 강제 생성하며 모델의 자율 결정을 재정의합니다. 4K 시나리오에는 이 방법을 사용합니다.

  • size + generate_max_pixels: 내부 로직에서 최종 너비와 높이를 계산합니다. size의 비율와 generate_max_pixels의 면적 등급에 최대한 근접하면서 모델 성능에 최적인 크기를 선택합니다.

  • generate_max_pixels만 전달: 기본 비율은 1:1이며 면적은 1K, 1.5K, 2K 등급 중 하나로 할당됩니다.

  • 둘 다 전달하지 않음: 모델이 프롬프트 의미를 기준으로 자율 결정합니다(기본값은 1.5K 등급).

4. Hy-Image-3.0에서 size 파라미터를 어떻게 전달합니까?

형식은 ${width}x${height}입니다(예: 1024x1024). 너비와 높이는 모두 512~2048 범위여야 하며 면적은 1024×1024를 초과하지 않아야 합니다. 부록의 Hy-Image-3.0 사전 설정 크기 목록에 있는 조합을 사용하는 것이 좋습니다. 전달하지 않으면 프롬프트에 비율(예: "가로형 16:9")를 설명할 수 있으며 모델이 가장 가까운 사전 설정 크기를 자동 선택합니다.

5. seed는 언제 적용됩니까? 결과를 어떻게 재현합니까?

Hy-Image-3.0: 값 범위는 [1, 4294967295]입니다. 생성 이미지 수가 1개일 때만 적용됩니다. 전달하지 않거나 0으로 설정하면 임의 시드를 사용합니다.

Hy-Image-3.5-Preview: 값 범위는 [0, 2^63-1]입니다. 0으로 설정하거나 전달하지 않으면 서버가 시드를 임의 할당합니다. 음수 값은 거부됩니다. 동일한 결과를 재현하려면 seed + prompt + size를 고정하십시오.

6. revise(프롬프트 재작성)를 비활성화해야 합니까? (Hy-Image-3.0)

재작성을 활성화하면 모델이 프롬프트를 자동으로 재작성하고 최적화하여 이미지 생성 품질을 높이며 약 11초가 소요됩니다. 자체 프롬프트 재작성 로직을 이미 구현한 경우에만 이 기능을 비활성화하는 것이 좋습니다. 그렇지 않으면 이미지 생성 품질이 크게 저하될 수 있습니다.

7. 다중 턴 편집용 컨텍스트는 어떻게 조합합니까? (Hy-Image-3.5-Preview)

(N+1)번째 요청의 messages = N번째 턴의 messages(첫 번째 user 메시지 포함) + N번째 턴 응답의 assembled_history(일반적으로 assistant + tool + assistant의 세 메시지) + 현재 턴의 새 user 메시지입니다. 서버가 assembled_history에 바로 사용할 수 있는 객체를 준비하므로 SSE delta를 직접 집계하거나 여러 단계로 중첩된 JSON을 조합할 필요가 없습니다. 참조하려면 위 "다중 턴 편집" 요청 예시에서 assistant / tool / assistant 메시지의 연결 형식을 확인합니다.

8. 생성된 이미지 링크는 만료됩니까?

만료됩니다. 두 모델의 생성 결과는 유효 기간이 12시간인 임시 URL입니다. 생성에 성공하면 즉시 다운로드하여 저장합니다. Hy-Image-3.0은 data[n].url을 사용합니다. Hy-Image-3.5-Preview는 choices[0].delta.image.url(비즈니스용 최종 전달 이미지)을 사용합니다. 다음 편집 턴에 사용할 과거 컨텍스트를 유지하려면 assembled_history[].content[].image_url.url(중간 산출물)도 저장할 수 있습니다. 모든 URL은 임시 서명 URL이므로 장기간 의존하지 마십시오.


버전별 지원 규격

버전 해상도 비율 참조 이미지
hy-image-v3 512–2048 px width / height 지정 최대 3장
hy-image-v3.5-preview 256–8192 px width / height 지정 최대 6장

픽셀 면적 제한

버전 최대 픽셀 면적 프롬프트 한도
hy-image-v3 1024×1024 8192자
hy-image-v3.5-preview 16,777,216 px / 4096×4096 100k 토큰