Mô hình âm thanh
Create speech
Sử dụng CometAPI POST /v1/audio/speech để chuyển đổi văn bản thành âm thanh với model chuyển văn bản thành giọng nói và định dạng đầu ra được chọn.
POST
Python
Sử dụng endpoint này để chuyển văn bản thành tệp âm thanh thông qua audio API tương thích OpenAI. Endpoint này phù hợp cho thuyết minh, lời nhắc thoại ngắn, tính năng đọc thành tiếng và các quy trình khác nơi ứng dụng của bạn đã có văn bản và cần đầu ra giọng nói.
Yêu cầu đầu tiên
Bắt đầu với ba trường:model, input, và voice. Hãy giữ yêu cầu đầu tiên ngắn gọn để bạn có thể xác minh xác thực, định dạng âm thanh và cách xử lý tệp trước khi tinh chỉnh tốc độ hoặc định dạng đầu ra.
Đọc phản hồi
Phản hồi là âm thanh nhị phân, không phải JSON. Trong các ví dụ SDK, hãy ghi phản hồi vào một tệp nhưoutput.mp3. Trong các HTTP client trực tiếp, hãy lưu phần thân phản hồi và đặt phần mở rộng tệp khớp với response_format đã yêu cầu.
Các bước tiếp theo
- Sử dụng Create Transcription khi bạn cần chuyển giọng nói trở lại thành văn bản.
- Sử dụng Create Translation khi bạn cần văn bản tiếng Anh từ âm thanh không phải tiếng Anh.
Ủy quyền
Bearer token authentication. Use your CometAPI key.
Nội dung
application/json
The TTS model to use. Choose a current speech model from the Models page.
The text to generate audio for. Maximum length is 4096 characters.
Maximum string length:
4096The voice to use for speech synthesis.
Tùy chọn có sẵn:
alloy, ash, ballad, coral, echo, fable, onyx, nova, sage, shimmer The audio output format.
Tùy chọn có sẵn:
mp3, opus, aac, flac, wav, pcm The speed of the generated audio. Select a value between 0.25 and 4.0.
Phạm vi bắt buộc:
0.25 <= x <= 4Phản hồi
200 - audio/mpeg
The audio file content.
The response is of type file.