Skip to content

语音模型接口

约 485 字大约 2 分钟

2026-04-07

文本转语音 接口

接口地址:https://c4ai.ccccltd.cn/api/compatible/v1/audio/speech

请求方式:POST

请求数据类型:application/json

响应数据类型:*/*

接口描述:

请求示例:

{
    "model": "jiaorong-moss-ttsd-v0.5", 
    "input": "你站在桥上看风景,看风景的人在楼上看你。明月装饰了你的窗子,你装饰了别人的梦",
    "voice": "alex",
    "response_format": "mp3",
    "stream": false
}

请求参数:

参数名称参数说明请求类型是否必须数据类型schema
audioSpeechRequestAudioSpeechRequestbodytrueAudioSpeechRequestAudioSpeechRequest
  model对应的模型名称truestring
  input待转换为音频的文本内容。truestring
  voice参考音色,推荐系统音色:[沉稳男声: alex; 低沉男声: benjamin; 磁性男声: charles; 欢快男声: david];[沉稳女声: anna; 激情女声: bella; 温柔女声: claire; 欢快女声: diana]truestring
  speed音频速度,默认值是1.0,可选范围是[0.25,4.0]falsefloat
  gain音频增益,可以控制音频声音大小,默认值是0.0,可选范围是[-10,10]falsefloat
  response_format输出格式,支持 mp3、opus、wav 和 pcm 格式falsestring
  sample_rate控制输出采样率,[opus: 目前只支持48000hz; wav, pcm: 支持 (8000, 16000, 24000, 32000, 44100), 默认44100; mp3: 支持(32000, 44100), 默认44100]falseinteger

响应状态:

状态码说明schema
200OK

响应示例:

"音频的二进制数据"

语音转文本 接口

接口地址:https://c4ai.ccccltd.cn/api/compatible/v1/audio/transcriptions

请求方式:POST

请求数据类型:multipart/form-data

响应数据类型:application/json

接口描述:

请求示例:

POST https://c4ai.ccccltd.cn/api/compatible/v1/audio/transcriptions

请求参数:

参数名称参数说明请求类型是否必须数据类型schema
  file需转换的音频文件 (支持格式:mp3、wav、webm、ogg)bodytruefile
  model对应的模型名称(例如:jiaorong-sensevoicesmall)parametertruestring

响应状态:

状态码说明schema
200OK

响应示例:

{
    "text": "是的"
}