通过统一 API 调用语音合成与音频生成能力。当前支持火山引擎和阿里云百炼多个模型系列。
端点与鉴权
| 项 | 值 |
|---|---|
| 生成端点 | POST https://routerbrain.ai/audio/v1/generations |
| 任务查询 | GET https://routerbrain.ai/audio/v1/tasks/:task_id |
| 鉴权 | Authorization: Bearer <API-Key> |
| Content-Type | application/json |
生成接口支持三种模式:
- 同步生成:
stream: false, task: false - SSE 流式生成:
stream: true, task: false - 异步任务:
stream: false, task: true
stream 和 task 不能同时为 true。具体模型是否支持流式或异步任务,以模型目录为准。
快速示例
curl -X POST https://routerbrain.ai/audio/v1/generations \
-H 'Authorization: Bearer sk-xxxxxxxx' \
-H 'Content-Type: application/json' \
-d '{"model": "<audio-model>", "prompt": "欢迎使用音频生成服务。", "voice": "<voice>", "stream": false, "task": false}'
{
"created": 1719000000000,
"data": [{ "url": "https://example.com/audio.mp3" }],
"usage": { "billing_method": "characters", "characters": 12 },
"task_id": null,
"task_status": null
}
驱动能力
| 驱动 | 能力 | 计费方式 | 流式 | 异步任务 |
|---|---|---|---|---|
| 火山引擎音频生成 HTTP V3 | 音频生成 | 按音频时长 | 否 | 否 |
| 火山引擎单向流式语音合成 | 语音合成 | 按字符数 | 是 | 否 |
| 火山引擎异步长文本语音合成 | 长文本语音 | 按字符数 | 否 | 是 |
| 阿里云百炼 CosyVoice/Qwen-Audio-TTS | 语音合成 | 按字符数 | 是 | 否 |
| 阿里云百炼 Qwen-TTS | 语音合成 | 按字符数 | 是 | 否 |
| 阿里云百炼 MiniMax TTS | 语音合成 | 按字符数 | 是 | 否 |
计费方式:
- duration:按输出音频秒数计费,单位
credits/second。 - characters:按输入字符数计费,单位
credits/character。
查询模型与定价
# 查询音频模型列表
curl "https://routerbrain.ai/audio/v1/models?q=tts" \
-H 'Authorization: Bearer sk-xxxxxxxx'
# 查询单个模型的 endpoint 定价详情
curl "https://routerbrain.ai/audio/v1/models/<audio-model>/endpoints" \
-H 'Authorization: Bearer sk-xxxxxxxx'
任务状态流转
pending -> running -> success
-> failed
-> cancelled