通过HTTP API管理定制热词列表,包括创建、查询、更新和删除热词列表。
用户指南:提升识别准确率。热词列表数量上限等使用限制详见热词限制与计费。
接口地址
- 华北2(北京)
- 新加坡
POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/audio/asr/customization调用时请将{WorkspaceId}替换为真实的Workspace ID。请求头
参数 | 类型 | 是否必选 | 说明 |
|---|---|---|---|
Authorization | string | 是 | 鉴权令牌,格式为 |
Content-Type | string | 是 | 请求体的媒体类型,固定为 |
创建热词列表
请求体modelstring(必选)定制热词模型,固定为speech-biasing。inputobject(必选)输入参数对象。
属性 action string(必选)操作类型,固定为create_vocabulary。target_model string(必选)使用热词列表的语音识别模型,必须与后续调用语音识别接口时使用的模型一致。prefix string(必选)热词列表自定义前缀,仅允许数字和小写字母,长度不超过10个字符。vocabulary array[object](必选)热词列表数组。
属性 text string(必选)热词文本。热词文本的语言必须在所选模型的支持范围内,不同模型支持的语言各不相同。热词用于提升识别的准确率,请使用实际词语而非任意字符组合。长度限制:含非 ASCII 字符时不超过 15 个字符;纯 ASCII 时空格分隔片段不超过 7 个。weight integer(必选)热词权重。常用值:4。取值范围:[1, 5]。如果效果不明显,可以适当增加权重,但权重过大可能产生负面效果,导致其他词语识别不准确。lang string(可选)待识别音频的语言代码。设置后,系统将对指定语种进行热词识别增强。如果无法提前确定语种,可不设置,模型会自动识别语种。取值范围(因模型而异):
| 以下为华北2(北京)地域的配置,调用时请将"{WorkspaceId}"替换为真实的业务空间ID,各地域的配置不同。新加坡地域和北京地域的API Key不同,详情请参见获取与配置 API Key。 |
返回体request_idstring本次调用的唯一标识符。outputobject模型返回的数据。
属性 vocabulary_id string创建的热词列表ID。object本次请求用量信息。
属性 count integer创建的热词列表数量,固定为1。 |
批量查询热词列表
请求体modelstring(必选)定制热词模型,固定为speech-biasing。inputobject(必选)输入参数对象。
属性 action string(必选)操作类型,固定为list_vocabulary。prefix string(可选)热词列表自定义前缀,如果设定则只返回指定前缀的热词列表。page_index integer页码索引,从0开始计数。默认值:0。page_size integer每页包含数据条数。默认值:10。 | 以下为华北2(北京)地域的配置,调用时请将"{WorkspaceId}"替换为真实的业务空间ID,各地域的配置不同。新加坡地域和北京地域的API Key不同,详情请参见获取与配置 API Key。 |
返回体request_idstring本次调用的唯一标识符。outputobject模型返回的数据。
属性 vocabulary_list array[object]查询到的热词列表。
属性 vocabulary_id string热词列表ID。gmt_createstring创建时间。gmt_modifiedstring修改时间。statusstring状态:
object本次请求用量信息。
属性 count integer固定为1。 |
查询热词列表
请求体modelstring(必选)定制热词模型,固定为speech-biasing。inputobject(必选)输入参数对象。
属性 action string(必选)操作类型,固定为query_vocabulary。vocabulary_id string(必选)需要查询的热词列表ID。 | 以下为华北2(北京)地域的配置,调用时请将"{WorkspaceId}"替换为真实的业务空间ID,各地域的配置不同。新加坡地域和北京地域的API Key不同,详情请参见获取与配置 API Key。 |
返回体request_idstring本次调用的唯一标识符。outputobject模型返回的数据。
属性 gmt_create string创建时间。gmt_modifiedstring修改时间。statusstring状态:
string使用热词列表的语音识别模型,必须与后续调用语音识别接口时使用的模型一致。vocabularyarray[object]查询到的热词列表。
属性 text string热词文本。weight integer热词权重。lang string待识别音频语种。object本次请求用量信息。
属性 count integer固定为1。 |
更新热词列表
请求体modelstring(必选)定制热词模型,固定为speech-biasing。inputobject(必选)输入参数对象。
属性 action string(必选)操作类型,固定为update_vocabulary。vocabulary_id string(必选)需要更新的热词列表ID。vocabulary array[object](必选)新的热词列表,将完全替换原有内容。
属性 text string(必选)热词文本。热词文本的语言必须在所选模型的支持范围内,不同模型支持的语言各不相同。热词用于提升识别的准确率,请使用实际词语而非任意字符组合。长度限制:含非 ASCII 字符时不超过 15 个字符;纯 ASCII 时空格分隔片段不超过 7 个。weight integer(必选)热词权重。常用值:4。取值范围:[1, 5]。如果效果不明显,可以适当增加权重,但权重过大可能产生负面效果,导致其他词语识别不准确。lang string(可选)待识别音频的语言代码。设置后,系统将对指定语种进行热词识别增强。如果无法提前确定语种,可不设置,模型会自动识别语种。取值范围(因模型而异):
| 以下为华北2(北京)地域的配置,调用时请将"{WorkspaceId}"替换为真实的业务空间ID,各地域的配置不同。新加坡地域和北京地域的API Key不同,详情请参见获取与配置 API Key。 |
返回体request_idstring本次调用的唯一标识符。outputobject模型返回的数据,固定为空。usageobject本次请求用量信息。
属性 count integer更新的热词列表数量,固定为1。 |
删除热词列表
请求体modelstring(必选)定制热词模型,固定为speech-biasing。inputobject(必选)输入参数对象。
属性 action string(必选)操作类型,固定为delete_vocabulary。vocabulary_id string(必选)需要删除的热词列表ID。 | 以下为华北2(北京)地域的配置,调用时请将"{WorkspaceId}"替换为真实的业务空间ID,各地域的配置不同。新加坡地域和北京地域的API Key不同,详情请参见获取与配置 API Key。 |
返回体request_idstring本次调用的唯一标识符。outputobject模型返回的数据,固定为空。usageobject本次请求用量信息。
属性 count integer删除的热词列表数量,固定为1。 |