Criar uma imagem
Use o CometAPI POST /v1/images/generations para criar imagens com modelos de imagem compatíveis com OpenAI e controles específicos do modelo.
Referência oficial
- Leia o guia de geração de imagens da OpenAI antes de usar controles específicos do modelo, como
background,output_compression, streaming ou futuras opções de imagem do GPT. - Use a referência Create image da OpenAI para a lista atual de parâmetros.
Escolha um modelo primeiro
- Use um modelo de imagem GPT como
gpt-image-2para solicitações de texto para imagem com controles comooutput_format,qualityoubackground - Use
qwen-imagequando precisar especificamente desse provedor, mas mantenhanem 1 - Escolha um model ID de imagem atual na página Models
Primeira solicitação segura
- Comece com
gpt-image-2 - Mantenha
sizeem1024x1024 - Modelos de imagem GPT retornam dados de imagem codificados em base64 em
b64_json; decodifique-os para salvar o arquivo de imagem - Adicione
output_formatapenas quando precisar de um tipo de imagem codificada específico, comojpeg - Consulte o guia de geração de imagens da OpenAI antes de adicionar
background,output_compressionou streaming - Use um prompt e uma imagem de saída antes de adicionar geração em lote ou ajuste de estilo
Executar uma tarefa de imagem assíncrona
Useasync: true para trabalhos de imagem de longa duração quando seu cliente preferir um fluxo de envio e polling em vez de manter uma conexão HTTP aberta. A solicitação de criação retorna data.task_id.
Faça polling em Recuperar uma tarefa de geração de imagem até que data.status seja success ou failure.
O campo async é uma extensão do CometAPI para esta rota, não um parâmetro da OpenAI. A OpenAI documenta stream e partial_images para modelos de imagem GPT. O modo de tarefa assíncrona do CometAPI retorna metadados da tarefa em JSON e usa polling.
Use o modo de tarefa assíncrona com estes model IDs documentados: gpt-image-2 e doubao-seedream-4-0-250828. Para outros modelos de imagem, use geração síncrona ou streaming, a menos que o suporte a tarefas assíncronas esteja documentado para esse modelo.
Quando uma solicitação inclui async: true e stream: true, o modo de tarefa assíncrona tem precedência. A solicitação de criação retorna metadados da tarefa em JSON em vez de um stream SSE.
Comportamento de solicitação específico do modelo
response_formatse aplica apenas a modelos DALL·E; modelos de imagem GPT retornam dados em base64 e o ignoram- Modelos de imagem GPT usam controles exclusivos do GPT, como
output_format,quality,backgroundeoutput_compression - Siga o guia de geração de imagens da OpenAI para as opções específicas de modelo mais recentes
qwen-imagenão oferece suporte an > 1
Autorizações
Bearer token authentication. Use your CometAPI key.
Corpo
The image generation model to use. Choose a current model from the Models page.
Text description of the image you want to generate.
"A paper boat floating on calm water at sunrise."
Number of images to generate. Keep this at 1 for the broadest compatibility.
Quality setting for models that support it. See the OpenAI image generation guide for the latest model-specific values.
Requested output size. Supported values depend on the selected model. See the OpenAI image generation guide for the latest model-specific ranges.
"1024x1024"
The response container for dall-e-2 and dall-e-3. This parameter is not supported for GPT image models, which return base64-encoded image data.
url, b64_json The encoded image type for GPT image model results, such as png, jpeg, or webp. See the OpenAI image generation guide for current GPT image output controls.
"jpeg"
Set this to true to receive server-sent image generation events instead of waiting for the completed JSON response. Streaming responses use text/event-stream and can include final events such as image_generation.completed. When stream and async are both true, async task mode takes precedence and the create request returns JSON instead of a streaming image response.
CometAPI asynchronous task mode. Set this to true to return immediately with data.task_id, then poll GET /v1/images/generations/{task_id} for the final image data. Documented model IDs for this mode: gpt-image-2 and doubao-seedream-4-0-250828. This is a CometAPI extension, not an OpenAI parameter. When async and stream are both true, async takes precedence and returns JSON task metadata instead of an SSE stream.
Resposta
Image generation result. Synchronous requests return completed image data. Async requests return a task response with data.task_id.
- Completed image response
- Async task response
Unix timestamp for the completed generation.
Background mode returned by models that expose it.
Encoded image type returned by GPT image models.
Quality level returned by models that expose it.
Output size returned by models that expose it.
Token usage details when returned by the selected model.