Skip to main content
POST
CometAPI에서 OpenAI 호환 요청 형식으로 텍스트로부터 이미지를 생성하려면 이 경로를 사용하세요.

공식 레퍼런스

먼저 모델 선택하기

  • output_format, quality, background 같은 제어 옵션이 있는 텍스트-투-이미지 요청에는 gpt-image-2와 같은 GPT 이미지 모델을 사용하세요
  • 해당 provider가 특별히 필요하다면 qwen-image를 사용하되, n은 1로 유지하세요
  • Models page에서 현재 이미지 model ID를 선택하세요

안전한 첫 요청

  • gpt-image-2로 시작하세요
  • size1024x1024로 유지하세요
  • GPT 이미지 모델은 b64_json에 base64로 인코딩된 이미지 데이터를 반환하므로, 이미지 파일로 저장하려면 이를 디코딩해야 합니다
  • jpeg와 같은 특정 인코딩 이미지 형식이 필요할 때만 output_format을 추가하세요
  • background, output_compression, 또는 스트리밍(Streaming)을 추가하기 전에 OpenAI 이미지 생성 가이드를 확인하세요
  • 배치 생성이나 스타일 조정을 추가하기 전에 프롬프트(Prompt) 1개와 출력 이미지 1개로 먼저 사용해 보세요

비동기 이미지 작업 실행

클라이언트가 하나의 HTTP 연결을 계속 열어두는 대신 제출 후 폴링하는 흐름을 선호한다면, 오래 걸리는 이미지 작업에 async: true를 사용하세요. 생성 요청은 data.task_id를 반환합니다. data.statussuccess 또는 failure가 될 때까지 Retrieve an image generation task를 폴링하세요. async 필드는 이 경로에 대한 CometAPI 확장이며, OpenAI 파라미터가 아닙니다. OpenAI는 GPT 이미지 모델에 대해 streampartial_images를 문서화합니다. CometAPI 비동기 작업 모드는 JSON 작업 메타데이터를 반환하고 폴링을 사용합니다. 문서화된 다음 model ID에서 async 작업 모드를 사용하세요: gpt-image-2doubao-seedream-4-0-250828. 다른 이미지 모델의 경우, 해당 모델에 async 작업 지원이 문서화되어 있지 않다면 동기 생성 또는 스트리밍(Streaming)을 사용하세요. 요청에 async: truestream: true가 모두 포함되면 async 작업 모드가 우선 적용됩니다. 생성 요청은 SSE 스트림 대신 JSON 작업 메타데이터를 반환합니다.

모델별 요청 동작

  • response_format은 DALL·E 모델에만 적용되며, GPT 이미지 모델은 base64 데이터를 반환하고 이를 무시합니다
  • GPT 이미지 모델은 output_format, quality, background, output_compression 같은 GPT 전용 제어 옵션을 사용합니다
  • 최신 모델별 옵션은 OpenAI 이미지 생성 가이드를 따르세요
  • qwen-imagen > 1을 지원하지 않습니다
생성된 이미지는 provider 사용 정책을 준수해야 합니다. 불법적이거나 폭력적이거나 음란하거나 저작권을 침해하는 프롬프트(Prompt)를 보내지 마세요.

인증

Authorization
string
header
필수

Bearer token authentication. Use your CometAPI key.

본문

application/json
model
string
기본값:gpt-image-2
필수

The image generation model to use. Choose a current model from the Models page.

prompt
string
필수

Text description of the image you want to generate.

예시:

"A paper boat floating on calm water at sunrise."

n
integer
기본값:1

Number of images to generate. Keep this at 1 for the broadest compatibility.

quality
string

Quality setting for models that support it. See the OpenAI image generation guide for the latest model-specific values.

size
string

Requested output size. Supported values depend on the selected model. See the OpenAI image generation guide for the latest model-specific ranges.

예시:

"1024x1024"

response_format
enum<string>

The response container for dall-e-2 and dall-e-3. This parameter is not supported for GPT image models, which return base64-encoded image data.

사용 가능한 옵션:
url,
b64_json
output_format
string

The encoded image type for GPT image model results, such as png, jpeg, or webp. See the OpenAI image generation guide for current GPT image output controls.

예시:

"jpeg"

stream
boolean
기본값:false

Set this to true to receive server-sent image generation events instead of waiting for the completed JSON response. Streaming responses use text/event-stream and can include final events such as image_generation.completed. When stream and async are both true, async task mode takes precedence and the create request returns JSON instead of a streaming image response.

async
boolean
기본값:false

CometAPI asynchronous task mode. Set this to true to return immediately with data.task_id, then poll GET /v1/images/generations/{task_id} for the final image data. Documented model IDs for this mode: gpt-image-2 and doubao-seedream-4-0-250828. This is a CometAPI extension, not an OpenAI parameter. When async and stream are both true, async takes precedence and returns JSON task metadata instead of an SSE stream.

응답

Image generation result. Synchronous requests return completed image data. Async requests return a task response with data.task_id.

created
integer
필수

Unix timestamp for the completed generation.

data
object[]
필수
background
string

Background mode returned by models that expose it.

output_format
string

Encoded image type returned by GPT image models.

quality
string

Quality level returned by models that expose it.

size
string

Output size returned by models that expose it.

usage
object

Token usage details when returned by the selected model.