注册声纹

上传音频并注册声纹,返回唯一 feature_id。注册成功后返回的 feature_id 可用于实时语音转写、异步语音转写等场景的 speaker_ids 参数,实现指定说话人识别。

POST/v1/vpr/register

授权

Authorizationstringheader必填
HTTP: Bearer Auth

请求头

Content-Typestring默认值: application/json必填

请求体application/json

audio_data string 必填

音频文件的 Base64 字符串。Base64 编码后不超过 5 MB;仅支持 16 kHz、16 bit、单声道。

audio_type string 必填

音频格式:wav / mp3。

feature_info string

与声纹绑定的备注信息,最长 256 字符。

响应体结构

feature_id string

注册声纹ID,可用于转写 speaker_ids。

feature_info string

备注信息。

created_at string

创建时间,格式 yyyy-MM-dd HH:mm:ss。

base_respobject

base_resp.status_codeinteger

状态码如下:
  • 100001, 请求参数缺失/非法(如 audio_data、audio_type、feature_id、JSON 格式错误、音频格式/时长不符等)
  • 100002, 更新时声纹不存在
  • 100601, audio_data Base64 超过 5 MB
  • 100999, 服务内部异常(含声纹引擎超时/提取失败、数据库异常等)
更多内容可查看错误码了解详情

base_resp.status_msgstring

状态描述