本文介绍声音复刻的Java SDK使用方法。
接口地址
SDK的接口地址需在初始化前设置为下方地址(包含WorkspaceId)。如需切换到其他地域,请修改 Constants.baseHttpApiUrl为对应地域的URL。
- 华北2(北京)
- 新加坡
https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1调用时请将{WorkspaceId}替换为真实的Workspace ID。- 不同地域的 API Key 不同,请确保使用对应地域的 API Key
- 地域配置为全局设置,影响所有 DashScope SDK 的 API 调用
VoiceEnrollmentService 类
包路径:com.alibaba.dashscope.audio.ttsv2.enrollment.VoiceEnrollmentService
功能:管理Qwen-Audio-TTS/CosyVoice复刻音色的生命周期(创建、查询、更新、删除)
构造方法
参数 | 类型 | 说明 |
|---|---|---|
apiKey | String | API Key |
createVoice() - 创建音色
方法签名:
参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
targetModel | String | 是 | 驱动音色的语音合成模型。必须与后续调用语音合成接口时使用的模型一致,否则合成会失败。 |
prefix | String | 是 | 音色名称前缀,仅允许数字和英文字母,不超过10个字符。生成的音色名格式: |
url | String | 是 | 用于复刻音色的音频文件URL,要求公网可访问。 |
customParam | 否 | 自定义参数,可通过 parameter() 方法指定 language_hints、max_prompt_audio_length 等参数。 |
Voice 对象,通过 getVoiceId() 方法获取音色ID。
listVoice() - 查询音色列表
方法签名:
参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
prefix | String | 否 | 按音色名称前缀筛选。 |
pageIndex | int | 否 | 页码索引,从0开始。 |
pageSize | int | 否 | 每页数据条数。 |
Voice[] 音色数组。
queryVoice() - 查询音色详情
方法签名:
参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
voiceId | String | 是 | 要查询的音色ID。 |
Voice 对象。
updateVoice() - 更新音色
方法签名:
参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
voiceId | String | 是 | 要更新的音色ID。 |
url | String | 是 | 新的音频文件URL。 |
customParam | VoiceEnrollmentParam | 否 | 自定义参数。 |
deleteVoice() - 删除音色
方法签名:
参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
voiceId | String | 是 | 要删除的音色ID。 |
VoiceEnrollmentParam 类
包路径:com.alibaba.dashscope.audio.ttsv2.enrollment.VoiceEnrollmentParam
通过Builder模式构建参数对象。
方法 | 类型 | 说明 |
|---|---|---|
model(String) | String | 声音复刻模型,固定为"voice-enrollment"。 |
parameter(String, Object) | Object | 设置自定义参数,如 parameter("language_hints", Arrays.asList("zh"))、parameter("max_prompt_audio_length", 10.0f)、parameter("enable_preprocess", false)、parameter("enable_volume_normalization", "false")。 |
扩展参数
参数名 | 类型 | 必填 | 说明 |
|---|---|---|---|
enable_preprocess | boolean | 否 | 仅适用于Qwen-Audio-TTS/CosyVoice声音复刻(model为 是否开启音频预处理(降噪、音频增强、音量规整)。有背景噪音时建议开启;安静环境建议关闭以最大程度还原音色。 默认值:false。 |
enable_volume_normalization | String | 否 | 是否对用于声音复刻的样本音频进行音量归一化。取值为 |
示例代码
创建音色
查询音色列表
需要引入第三方库com.google.gson.Gson。
查询特定音色
需要引入第三方库com.google.gson.Gson。