POST

Authorizations

Authorization
string
header
required

在请求头中传入:Authorization: Bearer sk-...

Body

application/json

文字转语音请求。提交文本、模型和音色后,接口返回音频二进制内容。

model
string
required

语音合成模型 ID,例如 tts-1、tts-1-hd 或兼容模型。

input
string
required

要合成的文本。较长内容按段落拆分,停顿、重试和结果保存都会更可控。

voice
string
required

音色 ID,例如 alloy、nova、shimmer 等。可用音色以模型页或控制台展示为准。

response_format
enum<string>

输出音频格式。mp3 面向通用播放;wav/pcm 面向后续音频编辑;opus/aac/flac 面向特定播放或压缩需求。

Available options:
mp3,
opus,
aac,
flac,
wav,
pcm
speed
number

语速设置。常见范围为 0.25 到 4.0,默认 1。

Response

音频文件