Ses Modelleri
Create Speech
Metni, seçilen bir text-to-speech modeli ve çıktı formatıyla sese dönüştürmek için CometAPI POST /v1/audio/speech uç noktasını kullanın.
POST
Python
Metni, OpenAI uyumlu audio API aracılığıyla bir ses dosyasına dönüştürmek için bu uç noktayı kullanın. Uygulamanızda zaten metin olduğunda ve ses çıktısı gerektiğinde; anlatım, kısa sesli istemler, sesli okuma özellikleri ve diğer iş akışları için uygundur.
İlk istek
Üç alanla başlayın:model, input ve voice. İlk isteği kısa tutun; böylece hız veya çıktı formatını ayarlamadan önce kimlik doğrulamayı, audio formatını ve dosya işlemeyi doğrulayabilirsiniz.
Yanıtı okuma
Yanıt JSON değil, ikili audio verisidir. SDK örneklerinde yanıtıoutput.mp3 gibi bir dosyaya yazın. Doğrudan HTTP istemcilerinde yanıt gövdesini kaydedin ve dosya uzantısını istenen response_format ile eşleşecek şekilde ayarlayın.
Sonraki adımlar
- Konuşmayı yeniden metne dönüştürmeniz gerektiğinde Create Transcription kullanın.
- İngilizce olmayan audio verisinden İngilizce metin gerektiğinde Create Translation kullanın.
Yetkilendirmeler
Bearer token authentication. Use your CometAPI key.
Gövde
application/json
The TTS model to use. Choose a current speech model from the Models page.
The text to generate audio for. Maximum length is 4096 characters.
Maximum string length:
4096The voice to use for speech synthesis.
Mevcut seçenekler:
alloy, ash, ballad, coral, echo, fable, onyx, nova, sage, shimmer The audio output format.
Mevcut seçenekler:
mp3, opus, aac, flac, wav, pcm The speed of the generated audio. Select a value between 0.25 and 4.0.
Gerekli aralık:
0.25 <= x <= 4Yanıt
200 - audio/mpeg
The audio file content.
The response is of type file.