Skip to main content
POST
Use esta rota para criar imagens a partir de texto com formatos de solicitação compatíveis com OpenAI no CometAPI.

Referência oficial

Escolha um modelo primeiro

  • Use um modelo de imagem GPT como gpt-image-2 para solicitações de texto para imagem com controles como output_format, quality ou background
  • Use qwen-image quando precisar especificamente desse provedor, mas mantenha n em 1
  • Escolha um model ID de imagem atual na página Models

Primeira solicitação segura

  • Comece com gpt-image-2
  • Mantenha size em 1024x1024
  • Modelos de imagem GPT retornam dados de imagem codificados em base64 em b64_json; decodifique-os para salvar o arquivo de imagem
  • Adicione output_format apenas quando precisar de um tipo de imagem codificada específico, como jpeg
  • Consulte o guia de geração de imagens da OpenAI antes de adicionar background, output_compression ou streaming
  • Use um prompt e uma imagem de saída antes de adicionar geração em lote ou ajuste de estilo

Executar uma tarefa de imagem assíncrona

Use async: true para trabalhos de imagem de longa duração quando seu cliente preferir um fluxo de envio e polling em vez de manter uma conexão HTTP aberta. A solicitação de criação retorna data.task_id. Faça polling em Recuperar uma tarefa de geração de imagem até que data.status seja success ou failure. O campo async é uma extensão do CometAPI para esta rota, não um parâmetro da OpenAI. A OpenAI documenta stream e partial_images para modelos de imagem GPT. O modo de tarefa assíncrona do CometAPI retorna metadados da tarefa em JSON e usa polling. Use o modo de tarefa assíncrona com estes model IDs documentados: gpt-image-2 e doubao-seedream-4-0-250828. Para outros modelos de imagem, use geração síncrona ou streaming, a menos que o suporte a tarefas assíncronas esteja documentado para esse modelo. Quando uma solicitação inclui async: true e stream: true, o modo de tarefa assíncrona tem precedência. A solicitação de criação retorna metadados da tarefa em JSON em vez de um stream SSE.

Comportamento de solicitação específico do modelo

  • response_format se aplica apenas a modelos DALL·E; modelos de imagem GPT retornam dados em base64 e o ignoram
  • Modelos de imagem GPT usam controles exclusivos do GPT, como output_format, quality, background e output_compression
  • Siga o guia de geração de imagens da OpenAI para as opções específicas de modelo mais recentes
  • qwen-image não oferece suporte a n > 1
As imagens geradas devem estar em conformidade com as políticas de uso do provedor. Não envie prompts ilegais, violentos, pornográficos ou que infrinjam direitos autorais.

Autorizações

Authorization
string
header
obrigatório

Bearer token authentication. Use your CometAPI key.

Corpo

application/json
model
string
padrão:gpt-image-2
obrigatório

The image generation model to use. Choose a current model from the Models page.

prompt
string
obrigatório

Text description of the image you want to generate.

Exemplo:

"A paper boat floating on calm water at sunrise."

n
integer
padrão:1

Number of images to generate. Keep this at 1 for the broadest compatibility.

quality
string

Quality setting for models that support it. See the OpenAI image generation guide for the latest model-specific values.

size
string

Requested output size. Supported values depend on the selected model. See the OpenAI image generation guide for the latest model-specific ranges.

Exemplo:

"1024x1024"

response_format
enum<string>

The response container for dall-e-2 and dall-e-3. This parameter is not supported for GPT image models, which return base64-encoded image data.

Opções disponíveis:
url,
b64_json
output_format
string

The encoded image type for GPT image model results, such as png, jpeg, or webp. See the OpenAI image generation guide for current GPT image output controls.

Exemplo:

"jpeg"

stream
boolean
padrão:false

Set this to true to receive server-sent image generation events instead of waiting for the completed JSON response. Streaming responses use text/event-stream and can include final events such as image_generation.completed. When stream and async are both true, async task mode takes precedence and the create request returns JSON instead of a streaming image response.

async
boolean
padrão:false

CometAPI asynchronous task mode. Set this to true to return immediately with data.task_id, then poll GET /v1/images/generations/{task_id} for the final image data. Documented model IDs for this mode: gpt-image-2 and doubao-seedream-4-0-250828. This is a CometAPI extension, not an OpenAI parameter. When async and stream are both true, async takes precedence and returns JSON task metadata instead of an SSE stream.

Resposta

Image generation result. Synchronous requests return completed image data. Async requests return a task response with data.task_id.

created
integer
obrigatório

Unix timestamp for the completed generation.

data
object[]
obrigatório
background
string

Background mode returned by models that expose it.

output_format
string

Encoded image type returned by GPT image models.

quality
string

Quality level returned by models that expose it.

size
string

Output size returned by models that expose it.

usage
object

Token usage details when returned by the selected model.