Crear una imagen
Usa CometAPI POST /v1/images/generations para crear imágenes con modelos de imagen compatibles con OpenAI y controles específicos del modelo.
Referencia oficial
- Lee la guía de generación de imágenes de OpenAI antes de depender de controles específicos del modelo como
background,output_compression, streaming o futuras opciones de imagen de GPT. - Usa la referencia Create image de OpenAI para la lista actual de parámetros.
Elige primero un modelo
- Usa un modelo de imagen GPT como
gpt-image-2para solicitudes de texto a imagen con controles comooutput_format,qualityobackground - Usa
qwen-imagecuando necesites específicamente ese proveedor, pero manténnen 1 - Elige un model ID de imagen actual desde la página Models
Primera solicitud segura
- Empieza con
gpt-image-2 - Mantén
sizeen1024x1024 - Los modelos de imagen GPT devuelven datos de imagen codificados en base64 en
b64_json; decodifícalos para guardar el archivo de imagen - Agrega
output_formatsolo cuando necesites un tipo de imagen codificada específico comojpeg - Revisa la guía de generación de imágenes de OpenAI antes de agregar
background,output_compressiono streaming - Usa un prompt y una imagen de salida antes de agregar generación por lotes o ajuste de estilo
Ejecutar una tarea de imagen asíncrona
Usaasync: true para trabajos de imagen de larga duración cuando tu cliente prefiera un flujo de envío y consulta en lugar de mantener abierta una conexión HTTP. La solicitud de creación devuelve data.task_id.
Consulta Retrieve an image generation task hasta que data.status sea success o failure.
El campo async es una extensión de CometAPI para esta ruta, no un parámetro de OpenAI. OpenAI documenta stream y partial_images para los modelos de imagen GPT. El modo de tarea asíncrona de CometAPI devuelve metadatos de tarea en JSON y usa sondeo.
Usa el modo de tarea asíncrona con estos model IDs documentados: gpt-image-2 y doubao-seedream-4-0-250828. Para otros modelos de imagen, usa generación síncrona o streaming, a menos que la compatibilidad con tareas asíncronas esté documentada para ese modelo.
Cuando una solicitud incluye tanto async: true como stream: true, el modo de tarea asíncrona tiene prioridad. La solicitud de creación devuelve metadatos de tarea en JSON en lugar de un flujo SSE.
Comportamiento de solicitud específico del modelo
response_formatse aplica solo a los modelos DALL·E; los modelos de imagen GPT devuelven datos base64 y lo ignoran- Los modelos de imagen GPT usan controles exclusivos de GPT como
output_format,quality,backgroundyoutput_compression - Sigue la guía de generación de imágenes de OpenAI para conocer las opciones específicas del modelo más recientes
qwen-imageno admiten > 1
Autorizaciones
Bearer token authentication. Use your CometAPI key.
Cuerpo
The image generation model to use. Choose a current model from the Models page.
Text description of the image you want to generate.
"A paper boat floating on calm water at sunrise."
Number of images to generate. Keep this at 1 for the broadest compatibility.
Quality setting for models that support it. See the OpenAI image generation guide for the latest model-specific values.
Requested output size. Supported values depend on the selected model. See the OpenAI image generation guide for the latest model-specific ranges.
"1024x1024"
The response container for dall-e-2 and dall-e-3. This parameter is not supported for GPT image models, which return base64-encoded image data.
url, b64_json The encoded image type for GPT image model results, such as png, jpeg, or webp. See the OpenAI image generation guide for current GPT image output controls.
"jpeg"
Set this to true to receive server-sent image generation events instead of waiting for the completed JSON response. Streaming responses use text/event-stream and can include final events such as image_generation.completed. When stream and async are both true, async task mode takes precedence and the create request returns JSON instead of a streaming image response.
CometAPI asynchronous task mode. Set this to true to return immediately with data.task_id, then poll GET /v1/images/generations/{task_id} for the final image data. Documented model IDs for this mode: gpt-image-2 and doubao-seedream-4-0-250828. This is a CometAPI extension, not an OpenAI parameter. When async and stream are both true, async takes precedence and returns JSON task metadata instead of an SSE stream.
Respuesta
Image generation result. Synchronous requests return completed image data. Async requests return a task response with data.task_id.
- Completed image response
- Async task response
Unix timestamp for the completed generation.
Background mode returned by models that expose it.
Encoded image type returned by GPT image models.
Quality level returned by models that expose it.
Output size returned by models that expose it.
Token usage details when returned by the selected model.