إنشاء صورة
استخدم CometAPI POST /v1/images/generations لإنشاء صور باستخدام نماذج صور متوافقة مع OpenAI وعناصر تحكم خاصة بكل نموذج.
المرجع الرسمي
- اقرأ دليل OpenAI لإنشاء الصور قبل أن تعتمد على عناصر تحكم خاصة بالنموذج مثل
backgroundأوoutput_compressionأو streaming أو خيارات صور GPT المستقبلية. - استخدم مرجع OpenAI Create image للحصول على قائمة المعلمات الحالية.
اختر نموذجًا أولًا
- استخدم نموذج صور GPT مثل
gpt-image-2لطلبات text-to-image مع عناصر تحكم مثلoutput_formatأوqualityأوbackground - استخدم
qwen-imageعندما تحتاج إلى هذا المزوّد تحديدًا، ولكن أبقِnعند 1 - اختر model ID حاليًا للصور من صفحة النماذج
أول طلب آمن
- ابدأ بـ
gpt-image-2 - أبقِ
sizeعند1024x1024 - تعيد نماذج صور GPT بيانات صور بترميز base64 في
b64_json؛ قم بفك ترميزها لحفظ ملف الصورة - أضف
output_formatفقط عندما تحتاج إلى نوع صورة مُرمّز محدد مثلjpeg - راجع دليل OpenAI لإنشاء الصور قبل أن تضيف
backgroundأوoutput_compressionأو streaming - استخدم Prompt واحدًا وصورة ناتجة واحدة قبل أن تضيف التوليد الدفعي أو ضبط النمط
تشغيل مهمة صورة غير متزامنة
استخدمasync: true للمهام الطويلة لإنشاء الصور عندما يفضّل العميل لديك تدفق الإرسال ثم الاستعلام بدلًا من إبقاء اتصال HTTP واحد مفتوحًا.
استعلم عن استرجاع مهمة إنشاء صورة حتى تصبح data.status هي success أو failure.
الحقل async هو امتداد من CometAPI لهذا المسار، وليس معلمة من OpenAI. توثّق OpenAI كلًا من stream و partial_images لنماذج صور GPT. يعيد وضع المهام غير المتزامنة في CometAPI بيانات وصفية للمهمة بصيغة JSON ويستخدم الاستعلام الدوري.
استخدم وضع المهام غير المتزامنة مع model IDs الموثقة التالية: gpt-image-2 و doubao-seedream-4-0-250828. بالنسبة إلى نماذج الصور الأخرى، استخدم التوليد المتزامن أو Streaming ما لم يكن دعم المهام غير المتزامنة موثقًا لذلك النموذج.
عندما يتضمن الطلب كلًا من async: true و stream: true، تكون الأولوية لوضع المهام غير المتزامنة. يعيد طلب الإنشاء بيانات وصفية للمهمة بصيغة JSON بدلًا من تدفق SSE.
سلوك الطلب الخاص بكل نموذج
response_formatينطبق على نماذج DALL·E فقط؛ أما نماذج صور GPT فتعيد بيانات base64 وتتجاهله- تستخدم نماذج صور GPT عناصر تحكم خاصة بـ GPT مثل
output_formatوqualityوbackgroundوoutput_compression - اتبع دليل OpenAI لإنشاء الصور لمعرفة أحدث الخيارات الخاصة بكل نموذج
- لا يدعم
qwen-imageالقيمةn > 1
التفويضات
Bearer token authentication. Use your CometAPI key.
الجسم
The image generation model to use. Choose a current model from the Models page.
Text description of the image you want to generate.
"A paper boat floating on calm water at sunrise."
Number of images to generate. Keep this at 1 for the broadest compatibility.
Quality setting for models that support it. See the OpenAI image generation guide for the latest model-specific values.
Requested output size. Supported values depend on the selected model. See the OpenAI image generation guide for the latest model-specific ranges.
"1024x1024"
The response container for dall-e-2 and dall-e-3. This parameter is not supported for GPT image models, which return base64-encoded image data.
url, b64_json The encoded image type for GPT image model results, such as png, jpeg, or webp. See the OpenAI image generation guide for current GPT image output controls.
"jpeg"
Set this to true to receive server-sent image generation events instead of waiting for the completed JSON response. Streaming responses use text/event-stream and can include final events such as image_generation.completed. When stream and async are both true, async task mode takes precedence and the create request returns JSON instead of a streaming image response.
CometAPI asynchronous task mode. Set this to true to return immediately with data.task_id, then poll GET /v1/images/generations/{task_id} for the final image data. Documented model IDs for this mode: gpt-image-2 and doubao-seedream-4-0-250828. This is a CometAPI extension, not an OpenAI parameter. When async and stream are both true, async takes precedence and returns JSON task metadata instead of an SSE stream.
الاستجابة
Image generation result. Synchronous requests return completed image data. Async requests return a task response with data.task_id.
- Completed image response
- Async task response
Unix timestamp for the completed generation.
Background mode returned by models that expose it.
Encoded image type returned by GPT image models.
Quality level returned by models that expose it.
Output size returned by models that expose it.
Token usage details when returned by the selected model.