用户指南:关于模型介绍和选型建议请参见语音合成。
说明:启动语音合成任务,设置模型、采样率等参数,并一次性发送待合成文本。
发送时机:建立 WebSocket 连接后立即发送。
响应事件:服务端返回 task-started 事件。
run-task
说明:启动语音合成任务,设置模型、采样率等参数,并一次性发送待合成文本。
发送时机:建立 WebSocket 连接后立即发送。
响应事件:服务端返回 task-started 事件。
headerobject(必选)
属性 action string(必选)指令类型,固定为 run-task。task_idstring(必选)客户端生成的任务 ID(UUID 格式),用于关联后续事件。streamingstring(必选)固定为 outobject(必选)
属性 task_group string(必选)任务组,固定为 audio。taskstring(必选)任务类型,固定为 tts。functionstring(必选)功能类型,固定为 SpeechSynthesizer。modelstring(必选)模型名称,如 sambert-zhichu-v1。inputobject(必选)输入数据,包含 text 字段,直接传入待合成文本。textstring(必选)待合成文本。parametersobject(必选)语音合成参数。
属性 text_type string(必选)固定为 PlainText。formatstring(可选)音频编码格式。取值范围:
integer(可选)音频采样率(Hz)。取值范围:8000, 16000(默认), 22050, 24000。volumeinteger(可选)音量。默认值:50。取值范围:[0, 100]。ratefloat(可选)语速。默认值:1.0。取值范围:[0.5, 2.0]。pitchfloat(可选)音调。默认值:1.0。取值范围:[0.5, 2.0]。word_timestamp_enabledboolean(可选)是否开启字级别时间戳。默认值:false。适用范围:所有 Sambert 模型。phoneme_timestamp_enabledboolean(可选)是否开启音素级别时间戳。默认值:false。需要先开启 word_timestamp_enabled。 |