Skip to main content
文本生成

qwen-plus

Qwen3系列Plus模型,实现思考模式和非思考模式的有效融合,可在对话中切换模式。推理能力显著超过QwQ、通用能力显著超过Qwen2.5-Plus,达到同规模业界SOTA水平。该模型版本功能等同于快照模型 qwen-plus-2025-07-28。

推理服务供应商

qwen-plus模型的推理服务供应商为阿里云百炼。

模型能力

  • 华北2(北京)
  • 新加坡
  • 德国(法兰克福)
  • 美国(弗吉尼亚)
能力项支持情况能力项支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

支持

结构化输出

支持

联网搜索

支持

前缀续写

支持

上下文缓存

支持

批量推理

支持

模型调优

不支持

上下文限制

参数参数

最大输入长度

997952

最大输出长度

32768

上下文长度

1000000

最大输入长度(思考模式下)

995904

最大输出长度(思考模式下)

32768

最大思维链长度

81920

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。
  • 华北2(北京)
  • 新加坡
  • 德国(法兰克福)
  • 美国(弗吉尼亚)

输入<=128k

计费项价格(元)单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

输入(缓存命中)

0.16

每百万tokens

输入(思考模式缓存命中)

0.16

每百万tokens

思考模式输出(Batch File)

4

每百万tokens

输入(Batch File)

0.4

每百万tokens

输出(Batch File)

1

每百万tokens

输入(思考模式 Batch File)

0.4

每百万tokens

显式缓存创建

1

每百万tokens

显式缓存命中

0.08

每百万tokens

显式缓存创建(思考)

1

每百万tokens

显式缓存命中(思考)

0.08

每百万tokens

输入(Batch Chat)

0.8

每百万tokens

输出(Batch Chat)

2

每百万tokens

输入(思考模式 Batch Chat)

0.8

每百万tokens

输出(思考模式 Batch Chat)

8

每百万tokens

计费项价格(元)单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

输入(缓存命中)

0.48

每百万tokens

输入(思考模式缓存命中)

0.48

每百万tokens

思考模式输出(Batch File)

12

每百万tokens

输入(Batch File)

1.2

每百万tokens

输出(Batch File)

10

每百万tokens

输入(思考模式 Batch File)

1.2

每百万tokens

显式缓存创建

3

每百万tokens

显式缓存命中

0.24

每百万tokens

显式缓存创建(思考)

3

每百万tokens

显式缓存命中(思考)

0.24

每百万tokens

输入(Batch Chat)

2.4

每百万tokens

输出(Batch Chat)

20

每百万tokens

输入(思考模式 Batch Chat)

2.4

每百万tokens

输出(思考模式 Batch Chat)

24

每百万tokens

计费项价格(元)单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

输入(缓存命中)

0.96

每百万tokens

输入(思考模式缓存命中)

0.96

每百万tokens

思考模式输出(Batch File)

32

每百万tokens

输入(Batch File)

2.4

每百万tokens

输出(Batch File)

24

每百万tokens

输入(思考模式 Batch File)

2.4

每百万tokens

显式缓存创建

6

每百万tokens

显式缓存命中

0.48

每百万tokens

显式缓存创建(思考)

6

每百万tokens

显式缓存命中(思考)

0.48

每百万tokens

输入(Batch Chat)

4.8

每百万tokens

输出(Batch Chat)

48

每百万tokens

输入(思考模式 Batch Chat)

4.8

每百万tokens

输出(思考模式 Batch Chat)

64

每百万tokens

限流

  • 华北2(北京)
  • 新加坡
  • 德国(法兰克福)
  • 美国(弗吉尼亚)
参数

RPM(每分钟请求数)

30000

TPM(每分钟tokens)

5,000,000

动态更新

qwen-plus-latest

千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。本模型是动态更新版本,模型更新不会提前通知。

推理服务供应商

qwen-plus-latest模型的推理服务供应商为阿里云百炼。

模型能力

  • 华北2(北京)
  • 新加坡
能力项支持情况能力项支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

支持

结构化输出

支持

联网搜索

支持

前缀续写

支持

上下文缓存

不支持

批量推理

支持

模型调优

不支持

上下文限制

参数参数

最大输入长度

995904

最大输出长度

32768

上下文长度

1000000

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。
  • 华北2(北京)
  • 新加坡

输入<=128k

计费项价格(元)单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

思考模式输出(Batch File)

4

每百万tokens

输入(Batch File)

0.4

每百万tokens

输出(Batch File)

1

每百万tokens

输入(思考模式 Batch File)

0.4

每百万tokens

计费项价格(元)单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

思考模式输出(Batch File)

12

每百万tokens

输入(Batch File)

1.2

每百万tokens

输出(Batch File)

10

每百万tokens

输入(思考模式 Batch File)

1.2

每百万tokens

计费项价格(元)单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

思考模式输出(Batch File)

32

每百万tokens

输入(Batch File)

2.4

每百万tokens

输出(Batch File)

24

每百万tokens

输入(思考模式 Batch File)

2.4

每百万tokens

限流

  • 华北2(北京)
  • 新加坡
参数

RPM(每分钟请求数)

15000

TPM(每分钟tokens)

1,200,000

快照版本

qwen-plus-2025-12-01

本版本为2025年12月1日快照,相较7月28日快照在推理能力上有提升;智能体能力、多轮工具调用能力进一步增强;主观创作类任务表现更优。支持1M上下文长度,按照上下文长度进行阶梯计费。

推理服务供应商

qwen-plus-2025-12-01模型的推理服务供应商为阿里云百炼。

模型能力

  • 华北2(北京)
  • 新加坡
  • 德国(法兰克福)
  • 美国(弗吉尼亚)
能力项支持情况能力项支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

支持

结构化输出

支持

联网搜索

支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数参数

最大输入长度

997952

最大输出长度

32768

上下文长度

1000000

最大输入长度(思考模式下)

995904

最大输出长度(思考模式下)

32768

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。
  • 华北2(北京)
  • 新加坡
  • 德国(法兰克福)
  • 美国(弗吉尼亚)

输入<=128k

计费项价格(元)单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

计费项价格(元)单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

计费项价格(元)单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

限流

  • 华北2(北京)
  • 新加坡
  • 德国(法兰克福)
  • 美国(弗吉尼亚)
参数

RPM(每分钟请求数)

120

TPM(每分钟tokens)

1,000,000

qwen-plus-2025-09-11

本版本为2025年9月11日快照,相较7月28日快照在思考模式下指令遵循能力有提升、模型总结回复更加精简;在非思考模式下中文文本理解能力更佳、逻辑推理能力有增强。支持1M上下文长度,按照上下文长度进行阶梯计费。

推理服务供应商

qwen-plus-2025-09-11模型的推理服务供应商为阿里云百炼。

模型能力

  • 华北2(北京)
  • 新加坡
  • 德国(法兰克福)
  • 美国(弗吉尼亚)
能力项支持情况能力项支持情况

输入模态

Text

输出模态

Text

模型体验

不支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数参数

最大输入长度

995904

最大输出长度

32768

上下文长度

1000000

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。
  • 华北2(北京)
  • 新加坡
  • 德国(法兰克福)
  • 美国(弗吉尼亚)

输入<=128k

计费项价格(元)单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

计费项价格(元)单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

计费项价格(元)单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

限流

  • 华北2(北京)
  • 新加坡
  • 德国(法兰克福)
  • 美国(弗吉尼亚)
参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

1,000,000

qwen-plus-2025-07-28

Qwen3系列Plus模型,实现思考模式和非思考模式的有效融合,可在对话中切换模式。相较上个版本在中英文能力、工具调用上进行了专用增强。本版本为2025年7月28日快照,首次支持1M上下文长度,按照上下文长度进行阶梯计费。

推理服务供应商

qwen-plus-2025-07-28模型的推理服务供应商为阿里云百炼。

模型能力

  • 华北2(北京)
  • 新加坡
  • 德国(法兰克福)
  • 美国(弗吉尼亚)
能力项支持情况能力项支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

支持

结构化输出

支持

联网搜索

支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数参数

最大输入长度

995904

最大输出长度

32768

上下文长度

1000000

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。
  • 华北2(北京)
  • 新加坡
  • 德国(法兰克福)
  • 美国(弗吉尼亚)

输入<=128k

计费项价格(元)单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

计费项价格(元)单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

计费项价格(元)单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

限流

  • 华北2(北京)
  • 新加坡
  • 德国(法兰克福)
  • 美国(弗吉尼亚)
参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

1,000,000

qwen-plus-2025-07-14

Qwen3系列Plus模型,实现思考模式和非思考模式的有效融合,可在对话中切换模式。此版本为2025年7月14日快照模型,相较上个版本在非thinking模式下中英文能力均有大幅提升,工具调用能力专项增强。

推理服务供应商

qwen-plus-2025-07-14模型的推理服务供应商为阿里云百炼。

模型能力

  • 华北2(北京)
  • 新加坡
能力项支持情况能力项支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

支持

结构化输出

支持

联网搜索

支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数参数

最大输入长度

98304

最大输出长度

16384

上下文长度

131072

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。
  • 华北2(北京)
  • 新加坡
计费项价格(元)单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

限流

  • 华北2(北京)
  • 新加坡
参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

100,000

qwen-plus-2025-04-28

Qwen3系列Plus模型,实现思考模式和非思考模式的有效融合,可在对话中切换模式。推理能力显著超过QwQ、通用能力显著超过Qwen2.5-Plus,达到同规模业界SOTA水平。此版本为2025年4月28日快照模型。

推理服务供应商

qwen-plus-2025-04-28模型的推理服务供应商为阿里云百炼。

模型能力

  • 华北2(北京)
  • 新加坡
能力项支持情况能力项支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数参数

最大输入长度

98304

最大输出长度

16384

上下文长度

131072

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。
  • 华北2(北京)
  • 新加坡
计费项价格(元)单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

限流

  • 华北2(北京)
  • 新加坡
参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

1,000,000

qwen-plus-2025-01-25

千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。相对于通义千问-Plus-2025-0112版本,整体中英文能力都有综合能力升级,中英文code能力、逻辑能力、多语言能力显著提升,回复风格面向人类偏好进行大幅调整,尤其是数学、逻辑推理、知识问答等客观类query,模型回复详实程度和格式清晰度明显改善,创作类专项、json格式遵循专项、角色扮演专项能力均定向提升,预计维护至下一个快照上线前一个月。

推理服务供应商

qwen-plus-2025-01-25模型的推理服务供应商为阿里云百炼。

模型能力

  • 华北2(北京)
  • 新加坡
能力项支持情况能力项支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数参数

最大输入长度

129024

最大输出长度

8192

上下文长度

131072

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。
  • 华北2(北京)
  • 新加坡
计费项价格(元)单位

输入

0.8

每百万tokens

输出

2

每百万tokens

限流

  • 华北2(北京)
  • 新加坡
参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

150,000

qwen-plus-0112

千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。相对于千问-Plus-2024-1220版本,中英文整体能力有提升,中英常识知识类、阅读理解能力提升较为显著,codeswtich现象相比上一版有显著改善,中文指令遵循能力显著提升。

推理服务供应商

qwen-plus-0112模型的推理服务供应商为阿里云百炼。

模型能力

能力项支持情况能力项支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数参数

最大输入长度

129024

最大输出长度

8192

上下文长度

131072

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。
  • 华北2(北京)
计费项价格(元)单位

输入

0.8

每百万tokens

输出

2

每百万tokens

限流

  • 华北2(北京)
参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

150,000

qwen-plus-1220

千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。相对于千问-Plus-1125版本,中英文整体能力有提升,中英常识知识类、阅读理解能力提升较为显著,codeswtich现象相比上一版有显著改善,中文指令遵循能力显著提升。

推理服务供应商

qwen-plus-1220模型的推理服务供应商为阿里云百炼。

模型能力

能力项支持情况能力项支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数参数

最大输入长度

129024

最大输出长度

8192

上下文长度

131072

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。
  • 华北2(北京)
计费项价格(元)单位

输入

0.8

每百万tokens

输出

2

每百万tokens

限流

  • 华北2(北京)
参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

150,000

Token Plan
模型体验
  • 3D模型生成
  • 音乐生成
模型调优
模型压缩目录节点
用量统计与性能监控
资产中心
服务支持