音频模型
宁享Token 接入了语音合成(TTS)、音色克隆、音乐生成、文本转音效等音频模型。
模型清单(官方标准价)
音频模型
| 模型 | 价格 |
|---|---|
| doubao-tts | ¥3 / 万字符 |
| doubao-tts-2.0 | ¥3 / 万字符 |
| doubao-tts-2.0-standard | ¥3 / 万字符 |
| doubao-tts-2.0-pro | ¥3 / 万字符 |
| doubao-tts-2.0-emotional | ¥3 / 万字符 |
| doubao-tts-2.0-expressive | ¥3 / 万字符 |
| doubao-tts-icl-2.0 | ¥3 / 万字符 |
| doubao-tts-lite | ¥3 / 万字符 |
| seed-tts-2.0 | ¥3 / 万字符 |
| MiniMax/speech-02-hd(已下架/暂未开放) | ¥0.21 / 次 |
| MiniMax/speech-02-turbo(已下架/暂未开放) | ¥0.14 / 次 |
| MiniMax/speech-2.8-turbo(已下架/暂未开放) | ¥0.14 / 次 |
| doubao-music | ¥0.35 / 次 |
| doubao-music-bgm | ¥0.35 / 次 |
| doubao-music-lyrics | ¥0.35 / 次 |
| text-to-audio(已下架/暂未开放) | ¥2 / 次 |
TTS 系按「元/万字符」计费(1 个汉字算 1 个字符;英文字母、标点、空格等各算 1 个字符),与厂商官方计费口径一致;音乐生成与音效按次计费。长音频 / 实时音频按时长计费;ASR(语音识别)为规划中能力,暂未开放。
调用方式
TTS 端点(OpenAI 兼容):POST /v1/audio/speech,详见 TTS API。
