API Path
/aipaas/voice/v1/soundCopyTimbreRegister/register
请求协议
HTTPS
请求方法
POST
请求头部 :
| 头部标签 | 必填 | 说明 | 类型 | 数据字典 | 限制 | 头部内容 | 示例 |
|---|---|---|---|---|---|---|---|
| Content-Type | 是 | 必须为application/json,表明 HTTP Body 的内容为 JSON 格式字符串 |
必须为application/json,表明 HTTP Body 的内容为 JSON 格式字符串 |
必须为application/json,表明 HTTP Body 的内容为 JSON 格式字符串 |
|||
| Content-Length | 是 | HTTP Body 中内容的⻓度 | HTTP Body 中内容的⻓度 | HTTP Body 中内容的⻓度 | |||
| Content-Type | 是 | 内容类型 | application/json | application/json | |||
| X-APP-ID | 是 | 买家中心-已购能力-【X-APP-ID】 | |||||
| Device-Uuid | 是 | 设备管理-设备uuid | |||||
| Authorization | 是 | 鉴权信息 |
请求参数 Json
Object
| 参数名 | 说明 | 必填 | 类型 | 数据字典 | 限制 | 示例 |
|---|---|---|---|---|---|---|
| speaker_id | 请求全局唯⼀ ID,全局唯一音色ID,记录该值便于排查问题 | 是 | [string] | 0 | 请求全局唯⼀ ID,记录该值便于排查问题 | |
| audio_data | 语音数据,经过base64 编码,音频时长不超过 10 秒。 |
是 | [string] | 0 | 语音数据,经过base64 编码,要求 base64 编码后大小不超过 2M,音频时长不超过 10 秒。 |
|
| audio_format | 语音数据格式,支持 pcm,wav,mp3,默认 pcm,后缀名仅支持小写。 | 是 | [string] | 0 | 语音数据格式,支持 pcm,wav,mp3,默认 pcm,后缀名仅支持小写。 | |
| text | audio_data 所对应的文本,文本应与音频内容对应,并正确使用标点符号。文本长度不低于5个字符,不高于80个字符。 |
否 | [string] | 0 | audio_data 所对应的文本,文本应与音频内容对应,并正确使用标点符号。 |
|
| sampling_rate | audio_data 音频采样率,默认值:16000 Hz。注:音频采样率推荐24000 Hz,建议不低于16000 Hz |
否 | [int] | 0 | audio_data 音频采样率,默认值:16000 Hz。注:音频采样率推荐24000 Hz,建议不低于16000 Hz。 |
|
| num_channels | audio_data 音频通道数,默认值:1,仅支持单通道 |
否 | [int] | 0 | audio_data 音频通道数,默认值:1,仅支持单通道 |
详细说明 :
# 1、能力简介
音色注册算法,矫正上传音色是否合法,并注册合法的音色和对应ID。
* 支持输出格式:PCM 编码;
* 支持设置采样率:8000 Hz,16000 Hz,22050 Hz;
* 支持一次性合成 500 字符以内的文字,其中 1 个汉字、1 个英文字母、1 个标点或 1 个句子中间空格均算作 1 个字符,超过 500 个字符的内容将会截断;
* 仅支持采用 UTF-8 编码的文本输入;
# 2、修订历史
| 修订日期 | 算法版本号 | 修订内容 |
| ---- | ----- | ---- |
| 2025-12-18 | V1.2.0 | 兼容星河运行版本的返回码|
| 2025-12-12 | V1.1.0 | 日志接天眼,支持utf8请求头拓展,支持环境变量配置ip+port |
# 3、服务鉴权
* 无
# 4、请求参数说明
* 无
# 5、响应结果说明
* 无
# 6、请求示例
## 6.1 请求
```json
{
"speaker_id": "e0639793-4119-8482-d0ab-01471575c327",
"audio_data": "YAAIAA0ADQAtAFAAcABDAJcAvQB2AC0AQwA9AAQAGABLAGMANwABANH/tP+h/5X/qv+m/4f/vP/V/9P/xP/0/8f/oP/M/8v/x//v//P/GQAiAEYANwA3APn/AQAlADwA/f/4/+//5v/V/8D/5/8gACwAIwAXAMX/vv/T/+H/sP+w/5v/wv8LAEEARgA+ABcA+P/M/wgA2f/9/+z/3v8iABIAFQDz/+7/JABVACAA8",
"text": "今天是周一,天气挺好的。",
"num_channels": 1
}
```
## 6.2 响应结果
```json
{
"code": 10000,
"message": "success",
"speaker_id": "8897392"
}
```
# 7、状态码说明
| 状态码 | 解释 | 说明 | 解决方法 |
| --- | --- | --- | ---- |
| 10301 | Required parameter error | 参数错误 | 检查请求体是否符合接口协议 |
| 10302 | Too many requests | 并发请求过多 | 联系商务,增加并发 |
| 10304 | Parse request body fail | 请求格式错误 | 查看请求的 URL body 格式是否正确,参考接口文档 |
| 10503 | Server connection time out | 服务连接超时 | 联系技术人员 |
| 10601 | Speaker feature illegal | 说话人特征不合法 | 联系技术人员 |
| 10903 | Register failed | 注册失败 | 联系技术人员 |
| 10904 | Audio error | 音频解码失败 | 重新注册 |
| 10905 | WER error | 上传音频与对应文本对比字错率过高 | 重新注册 |
| 10906 | SNR error | 上传音频的信噪比过低 | 重新注册 |
| 10907 | Text error | 上传文本错误 | 重新注册 |
| 10908 | Sampling rate error | 采样率错误 | 输入正确的采样率 |
| 10909 | Speaker feature error | 特征提取失败 | 联系技术人员 |
| 10910 | Audio too long | 音频时间过长 | 换短音频,重新注册 |
| 10911 | Database error | 数据库错误 | 联系技术人员 |
| 10912 | Abnormal volume | 音量不合适 | 请把音量调到正常范围 |
| 10000 | Success | 成功 | 执行下一步操作 |
音色注册算法,矫正上传音色是否合法,并注册合法的音色和对应ID。
| 修订日期 | 算法版本号 | 修订内容 |
| ---- | ----- | ---- |
| 2025-12-18 | V1.2.0 | 兼容星河运行版本的返回码|
| 2025-12-12 | V1.1.0 | 日志接天眼,支持utf8请求头拓展,支持环境变量配置ip+port |
{
"speaker_id": "e0639793-4119-8482-d0ab-01471575c327",
"audio_data": "YAAIAA0ADQAtAFAAcABDAJcAvQB2AC0AQwA9AAQAGABLAGMANwABANH/tP+h/5X/qv+m/4f/vP/V/9P/xP/0/8f/oP/M/8v/x//v//P/GQAiAEYANwA3APn/AQAlADwA/f/4/+//5v/V/8D/5/8gACwAIwAXAMX/vv/T/+H/sP+w/5v/wv8LAEEARgA+ABcA+P/M/wgA2f/9/+z/3v8iABIAFQDz/+7/JABVACAA8",
"text": "今天是周一,天气挺好的。",
"num_channels": 1
}
{
"code": 10000,
"message": "success",
"speaker_id": "8897392"
}
| 状态码 | 解释 | 说明 | 解决方法 |
| --- | --- | --- | ---- |
| 10301 | Required parameter error | 参数错误 | 检查请求体是否符合接口协议 |
| 10302 | Too many requests | 并发请求过多 | 联系商务,增加并发 |
| 10304 | Parse request body fail | 请求格式错误 | 查看请求的 URL body 格式是否正确,参考接口文档 |
| 10503 | Server connection time out | 服务连接超时 | 联系技术人员 |
| 10601 | Speaker feature illegal | 说话人特征不合法 | 联系技术人员 |
| 10903 | Register failed | 注册失败 | 联系技术人员 |
| 10904 | Audio error | 音频解码失败 | 重新注册 |
| 10905 | WER error | 上传音频与对应文本对比字错率过高 | 重新注册 |
| 10906 | SNR error | 上传音频的信噪比过低 | 重新注册 |
| 10907 | Text error | 上传文本错误 | 重新注册 |
| 10908 | Sampling rate error | 采样率错误 | 输入正确的采样率 |
| 10909 | Speaker feature error | 特征提取失败 | 联系技术人员 |
| 10910 | Audio too long | 音频时间过长 | 换短音频,重新注册 |
| 10911 | Database error | 数据库错误 | 联系技术人员 |
| 10912 | Abnormal volume | 音量不合适 | 请把音量调到正常范围 |
| 10000 | Success | 成功 | 执行下一步操作 |