Skip to main content
POST
Python
Sử dụng endpoint này để chuyển văn bản thành tệp âm thanh thông qua audio API tương thích OpenAI. Endpoint này phù hợp cho thuyết minh, lời nhắc thoại ngắn, tính năng đọc thành tiếng và các quy trình khác nơi ứng dụng của bạn đã có văn bản và cần đầu ra giọng nói.

Yêu cầu đầu tiên

Bắt đầu với ba trường: model, input, và voice. Hãy giữ yêu cầu đầu tiên ngắn gọn để bạn có thể xác minh xác thực, định dạng âm thanh và cách xử lý tệp trước khi tinh chỉnh tốc độ hoặc định dạng đầu ra.

Đọc phản hồi

Phản hồi là âm thanh nhị phân, không phải JSON. Trong các ví dụ SDK, hãy ghi phản hồi vào một tệp như output.mp3. Trong các HTTP client trực tiếp, hãy lưu phần thân phản hồi và đặt phần mở rộng tệp khớp với response_format đã yêu cầu.

Các bước tiếp theo

  • Sử dụng Create Transcription khi bạn cần chuyển giọng nói trở lại thành văn bản.
  • Sử dụng Create Translation khi bạn cần văn bản tiếng Anh từ âm thanh không phải tiếng Anh.

Ủy quyền

Authorization
string
header
bắt buộc

Bearer token authentication. Use your CometAPI key.

Nội dung

application/json
model
string
mặc định:tts-1
bắt buộc

The TTS model to use. Choose a current speech model from the Models page.

input
string
bắt buộc

The text to generate audio for. Maximum length is 4096 characters.

Maximum string length: 4096
voice
enum<string>
mặc định:alloy
bắt buộc

The voice to use for speech synthesis.

Tùy chọn có sẵn:
alloy,
ash,
ballad,
coral,
echo,
fable,
onyx,
nova,
sage,
shimmer
response_format
enum<string>
mặc định:mp3

The audio output format.

Tùy chọn có sẵn:
mp3,
opus,
aac,
flac,
wav,
pcm
speed
number
mặc định:1

The speed of the generated audio. Select a value between 0.25 and 4.0.

Phạm vi bắt buộc: 0.25 <= x <= 4

Phản hồi

200 - audio/mpeg

The audio file content.

The response is of type file.