本文档介绍如何在阿里云百炼平台通过OpenAI兼容接口或DashScope SDK调用DeepSeek系列模型。
服务接入地址
不同地域的服务接入地址不同,请根据您选择的地域配置对应的 Base URL(调用时请将{WorkspaceId}替换为真实的业务空间ID)。各地域可调用的模型及限流不同,请参见限流文档。
- OpenAI兼容
- OpenAI兼容-Responses API
- DashScope
- 华北2(北京)
- 美国(弗吉尼亚)
- 新加坡
- 德国(法兰克福)
- 日本(东京)
SDK 调用配置的
base_url:https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1HTTP 请求地址:POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1/chat/completions快速开始
deepseek-v4-pro-0813 是 DeepSeek 系列旗舰模型,在编程、数学和通用任务方面表现出色。deepseek-v4-flash-0731 是Flash系列最新版本。您可以通过enable_thinking参数在思考与非思考模式之间切换。以下示例以 deepseek-v4-pro 模型为例展示思考模式的调用方式,您可以将 model 参数替换为其他 DeepSeek 模型。
需要已获取与配置 API Key并完成配置API Key到环境变量。如果通过SDK调用,需要安装 OpenAI 或 DashScope SDK。
- OpenAI兼容
- DashScope
- Anthropic兼容
enable_thinking非 OpenAI 标准参数,OpenAI Python SDK通过 extra_body传入,Node.js SDK作为顶层参数传入。reasoning_effort是 OpenAI 标准参数,可直接作为顶层参数传入。- Python
- Node.js
- HTTP
示例代码
返回结果
推理强度(reasoning_effort)
deepseek-v4-pro、deepseek-v4-flash 、 deepseek-v4-flash-0731 和 deepseek-v4-pro-0813默认开启思考模式。通过reasoning_effort参数可以调整推理强度,可选值为low(仅deepseek-v4-flash-0731 和 deepseek-v4-pro-0813 支持)、high和max,默认为high。
- OpenAI兼容
- DashScope
Python
Responses API
deepseek-v4-flash、deepseek-v4-flash-0731、deepseek-v4-pro与deepseek-v4-pro-0813支持通过 OpenAI 兼容的 Responses API 调用,仅支持华北2(北京)与新加坡地域,服务接入地址参见服务接入地址。
通过 Responses API 调用时,可在tools参数中添加web_search(联网搜索)、web_extractor(网页抓取)与code_interpreter(代码解释器)工具。
Python
其它功能
| 模型 | 多轮对话 | Function Calling | 联网搜索 | 上下文缓存 | 结构化输出 | 前缀续写 |
|---|---|---|---|---|---|---|
| deepseek-v4-pro | 支持 | 支持 | 支持 | 支持 | 支持 | 不支持 |
| deepseek-v4-pro-us | 支持 | 支持 | 支持 | 支持 | 支持 | 不支持 |
| deepseek-v4-flash-0731 | 支持 | 支持 | 支持 | 支持 | 支持 | 不支持 |
| deepseek-v4-flash | 支持 | 支持 | 支持 | 支持 | 支持 | 不支持 |
| deepseek-v4-flash-us | 支持 | 支持 | 支持 | 支持 | 支持 | 不支持 |
| deepseek-v3.2 | 支持 | 支持 | 支持 | 支持 | 不支持 | 不支持 |
| deepseek-v3.2-exp | 支持 | 支持仅支持非思考模式。 | 支持 | 不支持 | 不支持 | 不支持 |
| deepseek-v3.1 | 支持 | 支持仅支持非思考模式。 | 支持 | 支持 | 不支持 | 不支持 |
| deepseek-r1 | 支持 | 支持 | 支持 | 支持 | 不支持 | 不支持 |
| deepseek-r1-0528 | 支持 | 支持 | 支持 | 不支持 | 不支持 | 不支持 |
| deepseek-v3 | 支持 | 支持 | 支持 | 支持 | 不支持 | 不支持 |
| 蒸馏模型 | 支持 | 不支持 | 不支持 | 不支持 | 不支持 | 不支持 |
参数默认值
模型 | temperature | top_p | repetition_penalty | presence_penalty | max_tokens | thinking_budget |
|---|---|---|---|---|---|---|
deepseek-v4-pro | 1.0 | 1.0 | - | - | 共393,216 | |
deepseek-v4-pro-us | 1.0 | 1.0 | - | - | 共393,216 | |
deepseek-v4-flash-0731 | 1.0 | 1.0 | - | - | 共393,216 | |
deepseek-v4-flash | 1.0 | 1.0 | - | - | 共393,216 | |
deepseek-v4-flash-us | 1.0 | 1.0 | - | - | 共393,216 | |
deepseek-v3.2 | 1.0 | 0.95 | - | - | 65,536 | 32,768 |
deepseek-v3.2-exp | 0.6 | 0.95 | 1.0 | - | 65,536 | 32,768 |
deepseek-v3.1 | 0.6 | 0.95 | 1.0 | - | 65,536 | 32,768 |
deepseek-r1 | 0.6 | 0.95 | - | 1 | 16,384 | 32,768 |
deepseek-r1-0528 | 0.6 | 0.95 | - | 1 | 16,384 | 32,768 |
蒸馏版 | 0.6 | 0.95 | - | 1 | 16,384 | 16,384 |
deepseek-v3 | 0.7 | 0.6 | - | - | 16,384 | - |
- “-” 表示没有默认值,也不支持设置。
- deepseek-r1、deepseek-r1-0528、蒸馏版模型不支持设置以上参数值。
- “共393,216” 表示 deepseek-v4 系列模型的 max_tokens 与 thinking_budget 共用同一上限,两者合计最大为 393,216 Token(即模型的最大输出长度)。
- 参数含义请参考OpenAI兼容-Chat。
模型列表与计费
- 混合思考模型(通过
enable_thinking参数控制是否思考):deepseek-v4-pro、deepseek-v4-flash、deepseek-v4-flash-0731、deepseek-v3.2、deepseek-v3.2-exp、deepseek-v3.1 - 仅思考模型(回复前总会思考):deepseek-r1、deepseek-r1-0528
- 非思考模型:deepseek-v3
思考模式下,思维链按照输出 Token 计费。
常见问题
免费额度用完后如何购买 Token?
访问费用与成本中心进行充值,确保您的账户没有欠费即可调用 DeepSeek 模型。
调用 DeepSeek 模型会自动扣费,出账周期为分钟级,消费明细请前往 账单详情 进行查看。
如何接入Chatbox、Cherry Studio或Dify?
此处以常用工具为例进行说明,其它大模型工具的接入方式类似。
- Chatbox
- Cherry Studio
- Dify
请参见Chatbox。
可以上传图片或文档进行提问吗?
DeepSeek 模型仅支持文本输入,不支持图片或文档输入。如需图片输入,请使用千问VL模型;如需文档输入,请使用Qwen-Long模型。
如何查看Token消耗量及调用次数?
模型调用完一小时后,在模型观测页面设置查询条件(例如,选择时间范围、业务空间等),再在模型列表区域找到目标模型并单击操作列的监控,即可查看该模型的调用统计结果。具体请参见模型监控文档。
数据按小时更新,高峰期可能有小时级延迟,请您耐心等待。
还有哪些使用DeepSeek的方式?
在百炼平台使用DeepSeek有三种方式:
- 在线体验:访问模型广场。
- 通过API或客户端(如Chatbox)调用模型:请参考本文内容。
- 0代码构建大模型应用:请参考智能体应用(Agent 1.0)或工作流应用。