الانتقال إلى المحتوى الرئيسي
POST
Python
استخدم نقطة النهاية هذه لتحويل النص إلى ملف صوتي عبر واجهة OpenAI-compatible audio API. وهي مناسبة للسرد، والمطالبات الصوتية القصيرة، وميزات القراءة بصوت عالٍ، وسير العمل الأخرى التي يكون لدى تطبيقك فيها نص بالفعل ويحتاج إلى إخراج صوتي.

أول طلب

ابدأ بثلاثة حقول: model وinput وvoice. اجعل الطلب الأول قصيرًا حتى تتمكن من التحقق من المصادقة، وتنسيق الصوت، ومعالجة الملفات قبل ضبط السرعة أو تنسيق الإخراج.

اقرأ الاستجابة

الاستجابة عبارة عن صوت ثنائي، وليست JSON. في أمثلة SDK، اكتب الاستجابة إلى ملف مثل output.mp3. في عملاء HTTP المباشرين، احفظ جسم الاستجابة واضبط امتداد الملف ليتوافق مع response_format المطلوب.

الخطوات التالية

  • استخدم Create Transcription عندما تحتاج إلى تحويل الكلام مرة أخرى إلى نص.
  • استخدم Create Translation عندما تحتاج إلى نص إنجليزي من صوت غير إنجليزي.

التفويضات

Authorization
string
header
مطلوب

Bearer token authentication. Use your CometAPI key.

الجسم

application/json
model
string
افتراضي:tts-1
مطلوب

The TTS model to use. Choose a current speech model from the Models page.

input
string
مطلوب

The text to generate audio for. Maximum length is 4096 characters.

Maximum string length: 4096
voice
enum<string>
افتراضي:alloy
مطلوب

The voice to use for speech synthesis.

الخيارات المتاحة:
alloy,
ash,
ballad,
coral,
echo,
fable,
onyx,
nova,
sage,
shimmer
response_format
enum<string>
افتراضي:mp3

The audio output format.

الخيارات المتاحة:
mp3,
opus,
aac,
flac,
wav,
pcm
speed
number
افتراضي:1

The speed of the generated audio. Select a value between 0.25 and 4.0.

النطاق المطلوب: 0.25 <= x <= 4

الاستجابة

200 - audio/mpeg

The audio file content.

The response is of type file.