Utwórz obraz
Użyj CometAPI POST /v1/images/generations, aby tworzyć obrazy za pomocą modeli obrazów zgodnych z OpenAI i kontrolek specyficznych dla modelu.
Oficjalna dokumentacja
- Przeczytaj przewodnik OpenAI dotyczący generowania obrazów, zanim zaczniesz polegać na kontrolkach specyficznych dla modelu, takich jak
background,output_compression, streaming lub przyszłe opcje obrazów GPT. - Użyj dokumentacji referencyjnej OpenAI Create image, aby sprawdzić aktualną listę parametrów.
Najpierw wybierz model
- Użyj modelu obrazów GPT, takiego jak
gpt-image-2, do żądań text-to-image z kontrolkami takimi jakoutput_format,qualitylubbackground - Użyj
qwen-image, gdy potrzebujesz konkretnie tego dostawcy, ale ustawnna 1 - Wybierz aktualny model ID obrazu na stronie Models
Bezpieczne pierwsze żądanie
- Zacznij od
gpt-image-2 - Ustaw
sizena1024x1024 - Modele obrazów GPT zwracają dane obrazu zakodowane w base64 w polu
b64_json; zdekoduj je, aby zapisać plik obrazu - Dodaj
output_formattylko wtedy, gdy potrzebujesz określonego zakodowanego typu obrazu, takiego jakjpeg - Sprawdź przewodnik OpenAI dotyczący generowania obrazów, zanim dodasz
background,output_compressionlub streaming - Użyj jednego promptu i jednego obrazu wyjściowego, zanim dodasz generowanie wsadowe lub dostrajanie stylu
Uruchom asynchroniczne zadanie obrazu
Użyjasync: true w przypadku długotrwałych zadań generowania obrazów, gdy klient preferuje przepływ wyślij-i-odpytywaj zamiast utrzymywania jednego połączenia HTTP otwartego. Żądanie utworzenia zwraca data.task_id.
Odpytuj Retrieve an image generation task, aż data.status będzie równe success lub failure.
Pole async jest rozszerzeniem CometAPI dla tego endpointu, a nie parametrem OpenAI. OpenAI dokumentuje stream i partial_images dla modeli obrazów GPT. Tryb zadań asynchronicznych CometAPI zwraca metadane zadania w formacie JSON i korzysta z odpytywania.
Używaj trybu zadań asynchronicznych z tymi udokumentowanymi model IDs: gpt-image-2 i doubao-seedream-4-0-250828. W przypadku innych modeli obrazów używaj generowania synchronicznego lub streaming, chyba że dla danego modelu udokumentowano obsługę zadań asynchronicznych.
Gdy żądanie zawiera jednocześnie async: true i stream: true, tryb zadań asynchronicznych ma pierwszeństwo. Żądanie utworzenia zwraca metadane zadania w formacie JSON zamiast strumienia SSE.
Zachowanie żądań specyficzne dla modelu
response_formatdotyczy wyłącznie modeli DALL·E; modele obrazów GPT zwracają dane base64 i ignorują ten parametr- Modele obrazów GPT używają kontrolek tylko dla GPT, takich jak
output_format,quality,backgroundioutput_compression - Postępuj zgodnie z przewodnikiem OpenAI dotyczącym generowania obrazów, aby poznać najnowsze opcje specyficzne dla modelu
qwen-imagenie obsługujen > 1
Autoryzacje
Bearer token authentication. Use your CometAPI key.
Treść
The image generation model to use. Choose a current model from the Models page.
Text description of the image you want to generate.
"A paper boat floating on calm water at sunrise."
Number of images to generate. Keep this at 1 for the broadest compatibility.
Quality setting for models that support it. See the OpenAI image generation guide for the latest model-specific values.
Requested output size. Supported values depend on the selected model. See the OpenAI image generation guide for the latest model-specific ranges.
"1024x1024"
The response container for dall-e-2 and dall-e-3. This parameter is not supported for GPT image models, which return base64-encoded image data.
url, b64_json The encoded image type for GPT image model results, such as png, jpeg, or webp. See the OpenAI image generation guide for current GPT image output controls.
"jpeg"
Set this to true to receive server-sent image generation events instead of waiting for the completed JSON response. Streaming responses use text/event-stream and can include final events such as image_generation.completed. When stream and async are both true, async task mode takes precedence and the create request returns JSON instead of a streaming image response.
CometAPI asynchronous task mode. Set this to true to return immediately with data.task_id, then poll GET /v1/images/generations/{task_id} for the final image data. Documented model IDs for this mode: gpt-image-2 and doubao-seedream-4-0-250828. This is a CometAPI extension, not an OpenAI parameter. When async and stream are both true, async takes precedence and returns JSON task metadata instead of an SSE stream.
Odpowiedź
Image generation result. Synchronous requests return completed image data. Async requests return a task response with data.task_id.
- Completed image response
- Async task response
Unix timestamp for the completed generation.
Background mode returned by models that expose it.
Encoded image type returned by GPT image models.
Quality level returned by models that expose it.
Output size returned by models that expose it.
Token usage details when returned by the selected model.