语音模型接口
约 485 字大约 2 分钟
2026-04-07
文本转语音 接口
接口地址:https://c4ai.ccccltd.cn/api/compatible/v1/audio/speech
请求方式:POST
请求数据类型:application/json
响应数据类型:*/*
接口描述:
请求示例:
{
"model": "jiaorong-moss-ttsd-v0.5",
"input": "你站在桥上看风景,看风景的人在楼上看你。明月装饰了你的窗子,你装饰了别人的梦",
"voice": "alex",
"response_format": "mp3",
"stream": false
}请求参数:
| 参数名称 | 参数说明 | 请求类型 | 是否必须 | 数据类型 | schema |
|---|---|---|---|---|---|
| audioSpeechRequest | AudioSpeechRequest | body | true | AudioSpeechRequest | AudioSpeechRequest |
| model | 对应的模型名称 | true | string | ||
| input | 待转换为音频的文本内容。 | true | string | ||
| voice | 参考音色,推荐系统音色:[沉稳男声: alex; 低沉男声: benjamin; 磁性男声: charles; 欢快男声: david];[沉稳女声: anna; 激情女声: bella; 温柔女声: claire; 欢快女声: diana] | true | string | ||
| speed | 音频速度,默认值是1.0,可选范围是[0.25,4.0] | false | float | ||
| gain | 音频增益,可以控制音频声音大小,默认值是0.0,可选范围是[-10,10] | false | float | ||
| response_format | 输出格式,支持 mp3、opus、wav 和 pcm 格式 | false | string | ||
| sample_rate | 控制输出采样率,[opus: 目前只支持48000hz; wav, pcm: 支持 (8000, 16000, 24000, 32000, 44100), 默认44100; mp3: 支持(32000, 44100), 默认44100] | false | integer |
响应状态:
| 状态码 | 说明 | schema |
|---|---|---|
| 200 | OK |
响应示例:
"音频的二进制数据"
语音转文本 接口
接口地址:https://c4ai.ccccltd.cn/api/compatible/v1/audio/transcriptions
请求方式:POST
请求数据类型:multipart/form-data
响应数据类型:application/json
接口描述:
请求示例:
POST https://c4ai.ccccltd.cn/api/compatible/v1/audio/transcriptions
请求参数:
| 参数名称 | 参数说明 | 请求类型 | 是否必须 | 数据类型 | schema |
|---|---|---|---|---|---|
| file | 需转换的音频文件 (支持格式:mp3、wav、webm、ogg) | body | true | file | |
| model | 对应的模型名称(例如:jiaorong-sensevoicesmall) | parameter | true | string |
响应状态:
| 状态码 | 说明 | schema |
|---|---|---|
| 200 | OK |
响应示例:
{
"text": "是的"
}