[ SKILL_DOCUMENTATION ]
# 音频语音 API 快速参考
## 端点
- 创建语音:`POST /v1/audio/speech`
## 默认模型
- `gpt-4o-mini-tts-2025-12-15`
## 其他语音模型(如果请求)
- `gpt-4o-mini-tts`
- `tts-1`
- `tts-1-hd`
## 核心参数
- `model`:语音模型
- `input`:要合成的文本(最大 4096 字符)
- `voice`:内置语音名称
- `instructions`:可选的风格方向(`tts-1` 或 `tts-1-hd` 不支持)
- `response_format`:`mp3`, `opus`, `aac`, `flac`, `wav`, 或 `pcm`
- `speed`:0.25 到 4.0
## 内置语音
- `alloy`, `ash`, `ballad`, `cedar`, `coral`, `echo`, `fable`, `marin`, `nova`, `onyx`, `sage`, `shimmer`, `verse`
## 输出说明
- 默认格式为 `mp3`。
- `pcm` 是原始 24 kHz 16 位小端采样(无标头)。
- `wav` 包含标头(更适合快速播放)。
## 合规性说明
- 提供明确的披露,说明该语音是 AI 生成的。