نماذج الصوت
Create Speech
استخدم CometAPI POST /v1/audio/speech لتحويل النص إلى صوت باستخدام نموذج text-to-speech وتنسيق إخراج محدد.
POST
Python
استخدم نقطة النهاية هذه لتحويل النص إلى ملف صوتي عبر واجهة OpenAI-compatible audio API. وهي مناسبة للسرد، والمطالبات الصوتية القصيرة، وميزات القراءة بصوت عالٍ، وسير العمل الأخرى التي يكون لدى تطبيقك فيها نص بالفعل ويحتاج إلى إخراج صوتي.
أول طلب
ابدأ بثلاثة حقول:model وinput وvoice. اجعل الطلب الأول قصيرًا حتى تتمكن من التحقق من المصادقة، وتنسيق الصوت، ومعالجة الملفات قبل ضبط السرعة أو تنسيق الإخراج.
اقرأ الاستجابة
الاستجابة عبارة عن صوت ثنائي، وليست JSON. في أمثلة SDK، اكتب الاستجابة إلى ملف مثلoutput.mp3. في عملاء HTTP المباشرين، احفظ جسم الاستجابة واضبط امتداد الملف ليتوافق مع response_format المطلوب.
الخطوات التالية
- استخدم Create Transcription عندما تحتاج إلى تحويل الكلام مرة أخرى إلى نص.
- استخدم Create Translation عندما تحتاج إلى نص إنجليزي من صوت غير إنجليزي.
التفويضات
Bearer token authentication. Use your CometAPI key.
الجسم
application/json
The TTS model to use. Choose a current speech model from the Models page.
The text to generate audio for. Maximum length is 4096 characters.
Maximum string length:
4096The voice to use for speech synthesis.
الخيارات المتاحة:
alloy, ash, ballad, coral, echo, fable, onyx, nova, sage, shimmer The audio output format.
الخيارات المتاحة:
mp3, opus, aac, flac, wav, pcm The speed of the generated audio. Select a value between 0.25 and 4.0.
النطاق المطلوب:
0.25 <= x <= 4الاستجابة
200 - audio/mpeg
The audio file content.
The response is of type file.