Створення зображення
Використовуйте CometAPI POST /v1/images/generations для створення зображень за допомогою сумісних з OpenAI моделей зображень і специфічних для моделей елементів керування.
Офіційна довідка
- Прочитайте посібник OpenAI зі створення зображень перш ніж використовувати елементи керування, специфічні для моделі, як-от
background,output_compression, Streaming або майбутні параметри зображень GPT. - Використовуйте довідку OpenAI Create image для актуального списку параметрів.
Спочатку виберіть модель
- Використовуйте модель зображень GPT, наприклад
gpt-image-2, для запитів перетворення тексту на зображення з такими елементами керування, якoutput_format,qualityабоbackground - Використовуйте
gpt-image-2.5-sunburstабоgpt-image-2.5-flare, коли потрібні прозорі фони або рівні якостіxhighіmax - Використовуйте
qwen-image, коли вам потрібен саме цей постачальник, але залишайтеnзі значенням 1 - Виберіть актуальний ідентифікатор моделі зображень на сторінці моделей
Безпечний перший запит
- Почніть із
gpt-image-2 - Залиште для
sizeзначення1024x1024 - Моделі зображень GPT повертають дані зображення в кодуванні base64 у
b64_json; декодуйте їх, щоб зберегти файл зображення - Додавайте
output_formatлише тоді, коли потрібен певний закодований тип зображення, наприкладjpeg - Використовуйте один Prompt і одне вихідне зображення, перш ніж додавати пакетне генерування або налаштування стилю
Запуск асинхронного завдання зі створення зображення
Використовуйтеasync: true для тривалих завдань зі створення зображень, коли ваш клієнт віддає перевагу процесу надсилання й опитування замість утримання одного HTTP-з’єднання відкритим. Запит на створення повертає data.task_id.
Опитуйте завдання зі створення зображення доки data.status не стане success або failure.
Поле async є розширенням CometAPI для цього маршруту, а не параметром OpenAI. OpenAI документує stream і partial_images для моделей зображень GPT. Асинхронний режим завдань CometAPI повертає метадані завдання JSON і використовує опитування.
Використовуйте асинхронний режим завдань із такими документованими ідентифікаторами моделей: gpt-image-2 і doubao-seedream-4-0-250828. Для інших моделей зображень використовуйте синхронне генерування або Streaming, якщо для цієї моделі не задокументовано підтримку асинхронних завдань.
Якщо запит містить і async: true, і stream: true, пріоритет має асинхронний режим завдань. Запит на створення повертає метадані завдання JSON замість потоку SSE.
Поведінка запитів, специфічна для моделі
response_formatзастосовується лише до моделей DALL·E; моделі зображень GPT повертають дані base64 та ігнорують його- Моделі зображень GPT використовують елементи керування GPT-only, як-от
output_format,quality,backgroundіoutput_compression qualityприймаєlow,medium,highіautoу моделях зображень GPT;gpt-image-2.5-sunburstіgpt-image-2.5-flareтакож приймаютьxhighіmaxoutput_compressionзастосовується, колиoutput_formatмає значенняwebpабоjpeg; не впливає наpngpartial_imagesзастосовується лише колиstreamмає значенняtrue- Дотримуйтеся посібника OpenAI зі створення зображень, щоб дізнаватися про найновіші параметри для конкретних моделей
qwen-imageне підтримуєn > 1
Створення прозорого фону
Установітьbackground на transparent, щоб створити ізольований об’єкт без заливки фону. Це підтримується в gpt-image-2.5-sunburst і gpt-image-2.5-flare.
Для прозорості потрібен вихідний формат з альфа-каналом. Установіть output_format на png або webp. JPEG не має альфа-каналу, тому запит на прозорість із output_format: "jpeg" буде відхилено.
Відповідь повертає дані зображення base64 в b64_json з альфа-каналом. Декодуйте їх, щоб зберегти файл:
background на opaque, щоб примусово встановити суцільний фон, або на auto, щоб дозволити моделі вирішити. Відповідь повторює застосоване значення в полі верхнього рівня background.
Авторизації
Bearer token authentication. Use your CometAPI key.
Тіло
The image generation model to use. Choose a current model from the Models page.
Text description of the image you want to generate.
"A paper boat floating on calm water at sunrise."
Number of images to generate. Keep this at 1 for the broadest compatibility.
Quality setting for models that support it. GPT image models accept low, medium, high, and auto. gpt-image-2.5-sunburst and gpt-image-2.5-flare also accept xhigh and max. dall-e-3 accepts standard and hd. See the OpenAI image generation guide for the latest model-specific values.
"low"
Background mode for the generated image. Set transparent to generate an isolated subject with no background fill; this requires output_format set to png or webp, and returns an error with jpeg. Set opaque for a solid background, or auto to let the model decide. Supported on gpt-image-2.5-sunburst and gpt-image-2.5-flare.
transparent, opaque, auto Compression level for the output image, from 0 to 100. Applies when output_format is webp or jpeg. Lower values produce smaller files with more compression artifacts.
0 <= x <= 100Content moderation level for GPT image models. low is less restrictive; auto is the default.
low, auto Number of partial images to emit while a streaming response is in progress, from 0 to 3. Each partial image arrives as an image_generation.partial_image event before the final image_generation.completed event. Applies when stream is true.
0 <= x <= 3Requested output size. Supported values depend on the selected model. See the OpenAI image generation guide for the latest model-specific ranges.
"1024x1024"
The response container for dall-e-2 and dall-e-3. This parameter is not supported for GPT image models, which return base64-encoded image data.
url, b64_json The encoded image type for GPT image model results, such as png, jpeg, or webp. See the OpenAI image generation guide for current GPT image output controls.
"jpeg"
Set this to true to receive server-sent image generation events instead of waiting for the completed JSON response. Streaming responses use text/event-stream and can include final events such as image_generation.completed. When stream and async are both true, async task mode takes precedence and the create request returns JSON instead of a streaming image response.
CometAPI asynchronous task mode. Set this to true to return immediately with data.task_id, then poll GET /v1/images/generations/{task_id} for the final image data. Documented model IDs for this mode: gpt-image-2 and doubao-seedream-4-0-250828. This is a CometAPI extension, not an OpenAI parameter. When async and stream are both true, async takes precedence and returns JSON task metadata instead of an SSE stream.
Відповідь
Image generation result. Synchronous requests return completed image data. Async requests return a task response with data.task_id.
- Completed image response
- Async task response
Unix timestamp for the completed generation.
Background mode returned by models that expose it.
Encoded image type returned by GPT image models.
Quality level returned by models that expose it.
Output size returned by models that expose it.
Token usage details when returned by the selected model.