Assistant API 旨在简化 Assistant(一种大模型应用)的构建流程。本文详细介绍了 Assistant API 提供的各项 Assistant 管理方法,包括 Assistant 的创建、列举、检索、更新和删除操作。
功能介绍:如果您想了解 Assistant API 的功能和基本用法,请参考Assistant API功能概览。
有效期限:所有 Assistant 实例均保存在阿里云百炼服务器上,目前没有失效日期,您可通过 assistant.id 检索智能体。
- 智能体应用:仅可使用控制台进行创建、查看、更新和删除,以及通过应用调用 API进行调用。
- Assistant:仅可使用 Assistant API 创建、查看、更新、删除和调用 Assistant 。
创建智能体
创建一个新的智能体。
- HTTP
- SDK
| 参数名 | 描述 | 参数类型 | 是否必须 |
|---|---|---|---|
| model | 智能体所使用的模型 | str | 是 |
| name | 智能体使用的名字 | str | 否 |
| description | 用于描述智能体的文字 | str | 否 |
| instructions | System prompt 用于智能体里的大模型 | str | 否 |
| tools | 一个可以被智能体调用tools list.自定义插件的鉴权信息传递 | Optional[List[Dict]] | 否(default=[]) |
| metadata | 其他相关参数用于智能体,用于存储其他相关参数 | Dict | 否 |
| temperature | 用于控制随机性和多样性的程度。 | float | 否 |
| top_p | 生成时,核采样方法的概率阈值。 | float | 否 |
| top_k | 生成时,采样候选集的大小。 | integer | 否 |
列出智能体
用于返回智能体列表。
- HTTP
- SDK
检索智能体
- HTTP
- SDK
更新智能体
- HTTP
- SDK
输入参数名字 | 输入参数的描述 | 参数类型 | 是否必须 |
assistant_id | 待检索的智能体 ID | str | 是 |
* | 其他可选的输入参数 | str | 否 |
model | 智能体所使用的大模型 ID | str | 是 |
name | 智能体使用的名字 | str | 否 |
description | 用于描述智能体的文字 | str | 否 |
instructions | System prompt 用于智能体里的大模型 | str | 否 |
tools | 一个可以被智能体调用tools list,用户需要在阿里云百炼中被注册 | Optional[List[Dict]] | 否(default=[]) |
metadata | 其他相关参数用于智能体,用于存储其他相关参数 | Dict | 否 |
删除智能体
- HTTP
- SDK
输入参数名字 | 输入参数的描述 | 参数类型 | 是否必须 |
assistant_id | 待检索的智能体 ID | str | 是 |
智能体对象
一个能够调用模型并使用工具的Assistant对象。
智能体对象示例
参数名 | 数据类型 | 描述 |
|---|---|---|
id | string | 智能体唯一标识符,即 assistant ID。 |
object | string | 对象类型,始终为 |
created_at | integer | 创建智能体时的 Unix 13位时间戳(以毫秒为单位)。 |
model | string | 智能体使用的模型名。您可以在Assistant API功能概览查看所有可用模型,或者查看选择模型以了解它们的详情。 |
name | string | 智能体的名称。 |
description | string | 智能体的描述。 |
instructions | string | 智能体使用的系统指令。 |
tools | array | 智能体上启用的工具列表。工具的类型可以是官方插件(code_interpreter 代码解释器、quark_search 夸克搜索、text_to_image 文生图)、知识检索增强(RAG)或函数调用(Function Calling)。 |
metadata | dict | 以结构化格式存储的智能体对象的附加信息。 |
temperature | float | 采样温度,其取值在 0 到 2 之间。较高的值(如 1)会使输出更加随机;而较低的值(如 0.2)则会使输出更加集中和确定。 |
top_p | float | 一种替代温度采样的方法,称为核采样。在这种采样方法中,大模型选取具有前 top_p 的累积概率质量的Token结果。其值为 0.1 表示仅考虑构成前 10% 概率质量的Token。 通常建议调整此参数或 |
top_k | integer | 与top_p类似,但样本是从 k 个最高概率的Token中选取的,而不考虑它们的累积概率质量。 不要同时调整此参数和 |
max_tokens | integer | 智能体能够一次性生成Token的最大数量。 |
request_id | string | 智能体关联的调用的唯一标识符。 |