# 文字转语音

`POST /v1/audio/speech`

OpenAI Audio Speech 兼容接口，将文本合成为音频。接口直接返回音频二进制内容。

## 请求格式
使用 `application/json`。必须包含 `model`、`input` 和 `voice`。

## 参数要点
- `input`：要朗读的文本。长文本按段落拆分，停顿更自然，失败后也更容易重试。
- `voice`：音色 ID，不同模型的音色列表不同。
- `response_format`：常见值为 mp3、wav、opus、aac、flac、pcm。
- `speed`：语速设置，默认 1。

## 读取结果
响应体是音频文件本体，不是 JSON。服务端写入文件或对象存储；浏览器端转成 Blob 后播放或下载。

Tags: 语音与音频
