调用 GET /api/v1/models/limits 接口查询当前 API Key 下各模型的限流配额,包括请求频率限制和用量限制,用于了解和规划 API 调用量。
前提条件
已创建 API Key 并配置为环境变量 DASHSCOPE_API_KEY。配置方法请参见配置API Key到环境变量。
请求说明
- HTTP 方法:GET
-
请求地址
调用时请将
{WorkspaceId}替换为您的业务空间 ID。地域
Endpoint
华北2(北京)
https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/models/limits -
认证方式
在请求 Header 中设置
Authorization: Bearer {API_KEY}。
请求参数
所有参数均通过 Query String 传递。
参数 | 类型 | 必选 | 描述 |
|---|---|---|---|
name | String | 否 | 按模型名称进行模糊搜索。示例: |
model | String | 否 | 按模型 ID 进行精确查询。示例: |
page_no | Integer | 否 | 页码,从 1 开始。默认值: |
page_size | Integer | 否 | 每页返回的模型数量。默认值: |
返回参数
参数 | 类型 | 描述 |
|---|---|---|
request_id | String | 请求 ID,用于问题排查。 |
output.total | Number | 符合条件的模型总数。 |
output.page_no | Number | 当前页码。 |
output.page_size | Number | 每页条数。 |
output.quotas[].model | String | 模型 ID。 |
output.quotas[].workspace_id | String | 业务空间 ID。 |
output.quotas[].model_limit | Object | 账号级别限流,即该模型在当前账号下的总限流上限。包含以下字段:
|
output.quotas[].workspace_limit | Object | 业务空间级别限流。您可以为每个业务空间单独设置限流,但所有业务空间的总限流不能超过 |
请求示例
示例一:查询所有模型的限额
返回示例
qwen3-max:每秒最多 500 次请求,每 6 秒最多使用 500,000 Token,未设置业务空间级别限制。wan2.6-i2v-flash:每秒最多 5 次请求,无用量限制,异步任务最大排队数 500、最大并发数 5。qwen-image-max:每分钟最多 2 次请求,每分钟最多使用 1,000,000 Token,未设置业务空间级别限制。