自动完成复杂研究课题——规划研究步骤、执行多轮联网搜索与信息整合,最终生成结构化研究报告,无需手动搜索。
本文档仅适用于华北2(北京)地域。如需使用模型,需使用华北2(北京)地域的API Key。
快速开始
您需要已获取与配置 API Key并配置API Key到环境变量。如果通过SDK调用,还需要安装DashScope SDK。请将示例代码中的 DASHSCOPE_API_HOST 替换为获取的 API Host。
模型采用两步工作流:第一步,模型提出细化问题,确认你的研究方向;第二步,基于你的回复执行完整研究并生成报告。第一步不是多余的——它让模型在启动耗时的多轮搜索前先对齐研究范围,避免跑偏。
模型目前仅支持 DashScope SDK调用,暂不支持 Java 版 DashScope SDK,也不支持 OpenAI 兼容接口调用。
模型列表
模型名称 | 上下文长度 (Token) | 最大输入 (Token) | 最大输出 (Token) |
|---|---|---|---|
qwen-deep-research | 1,000,000 | 997,952 | 32,768 |
qwen-deep-research-2025-12-15 |
qwen-deep-research为主线模型,持续更新优化。qwen-deep-research-2025-12-15为快照版本,研究深度和报告质量更优,额外支持 MCP 工具调用。两个模型均支持图片输入,独立计费。核心能力
通过 phase(当前任务)和 status(任务进度)两个字段跟踪模型工作进展。phase 表示当前执行的核心任务,status 表示该任务的内部进度。
反问确认与报告生成(phase: "answer")
分析用户问题,通过提问明确研究范围;最终研究报告也在此阶段输出。
状态值:
typing:正在生成文本内容finished:文本内容生成完毕
typing:正在生成研究计划finished:研究计划制定完成
WebResultFinished,整个阶段结束返回finished。
状态值:
streamingThinking:正在拆解研究任务并总结网页内容(qwen-deep-research-2025-12-15专用,替代streamingQueries和streamingWebResult)streamingQueries:正在生成搜索查询词(仅qwen-deep-research)streamingWebResult:正在执行网络搜索并分析网页内容(仅qwen-deep-research)WebResultFinished:单轮搜索结束finished:网络搜索阶段整体完成
图片输入
两个模型均支持在用户消息中传入图片,模型能理解图片内容并结合图片进行深入研究。content字段使用数组格式,同时包含image和text对象。
- 支持 JPEG、PNG、BMP、WEBP 格式,单张图片不超过 10 MB。
- 单次请求最多传入 5 张图片,支持公网URL和 Base64 编码两种方式。
- 响应格式与纯文本请求一致,模型会结合图片内容生成研究报告。
MCP 工具调用
MCP 工具调用仅
qwen-deep-research-2025-12-15支持,主线模型qwen-deep-research不支持此功能。research_tools 参数接入 MCP(Model Context Protocol)服务后,qwen-deep-research-2025-12-15可在 WebResearch 阶段调用知识库、内部文档、专有数据库等私有数据源,与公网搜索结合使用。响应格式与标准调用一致。
research_tools 的完整参数说明和 MCP 工具规范请参考 Qwen-Deep-Research 深入研究模型 。
请求示例
计费说明
模型名称 | 输入成本 (每千Token) | 输出成本 (每千Token) | 免费额度 |
|---|---|---|---|
qwen-deep-research | 0.054元 | 0.163元 | 无免费额度 |
qwen-deep-research-2025-12-15 | 0.079元 | 0.236元 | 无免费额度 |
应用于生产环境
必须使用流式输出
模型仅支持流式输出(stream=True)。一次完整的研究任务可能持续数分钟、经历数十轮迭代搜索,同步请求会超时。流式输出保持连接畅通,并通过 phase 和 status 字段实时追踪进度。
错误处理
对每个响应块检查状态码,非 200 状态读取 code 和 message 字段并做相应处理。流式响应早期阶段某些响应块可能只包含元数据,后续块会包含实际内容。
Token 消耗监控
status 为 finished 时,从 response.usage 获取 Token 消耗统计,包括输入 Token 数、输出 Token 数和请求 ID。
连接保持
KeepAlive 阶段用于维持长任务间的连接,不包含业务内容,忽略并继续处理后续响应即可。
常见问题
- 为什么某些响应块的 output 为空? 流式响应早期阶段,部分响应块只含元数据,实际内容在后续块中逐步到达。
-
如何判断某个阶段已完成?
status字段变为finished时,当前阶段完成。 - 模型是否支持 OpenAI 兼容接口调用? 不支持。
- 输入和输出 Token 如何计算? 输入 Token 包含用户消息和模型内置系统提示词;输出 Token 包含反问确认、研究计划、搜索查询和最终研究报告等所有生成内容。
-
qwen-deep-research 和 qwen-deep-research-2025-12-15 有什么区别?
qwen-deep-research是主线模型,持续更新。qwen-deep-research-2025-12-15是快照版本,研究深度和报告质量更优,额外支持 MCP 工具调用。两个模型均支持图片输入,独立计费,快照版本价格略高。 -
如何传入图片进行研究?
将
content设为数组格式,包含{"image": "图片URL"}和{"text": "文本描述"}。两个模型均支持图片输入。 -
如何跳过反问确认,直接进入研究?
在
parameters中将enable_feedback设为false,模型将跳过反问确认阶段,直接进入研究流程。