通过文生图API,您可以基于文本描述创造出全新的图像。阿里云百炼提供万相(Wan)、千问(Qwen-Image)和z-image系列模型。
- 模型体验中心:点击上方的在线体验链接(北京、新加坡)进入,可选择模型、设置输出分辨率、开启智能改写后直接提交生成。
- 通义万相独立站:访问通义万相,在图像生成中直接体验。
模型效果
千问(Qwen-image)
复杂布局 ![]() | 长段落 ![]() | 写实人像 ![]() |
UI设计 ![]() | PPT ![]() | 插画设计 ![]() |
点击查看提示词
点击查看提示词
万相
人像写真 ![]() | 写实摄影 ![]() | 绘画流派 ![]() |
文字生成 ![]() | 海报设计 ![]() | 组图生成 ![]() |
点击查看提示词
点击查看提示词
模型选型
- qwen-image-3.0-pro:千问图像3.0旗舰版,支持prompt智能改写,擅长文本渲染,能精准生成贴合物理材质的中英文。
- wan2.7-image-pro:功能最全面,支持组图生成和高达4096x4096的分辨率,并增强了五官控制、色彩控制和超长文字渲染能力。
- z-image-turbo:追求速度与性价比。生成速度快、成本低,擅长高逼真度的人像与产品图。
使用方式
文生图提供两种使用方式,请按需选择:
使用方式 | 是否需要编程 | 入口 | 适用场景 |
|---|---|---|---|
网页版在线体验 | 否 | 模型体验中心(见本文开篇的在线体验链接);通义万相独立站 | 快速试用模型、验证提示词效果、少量出图 |
API 调用 | 是 | 见下方快速开始 | 在自有应用或服务中批量、自动化地集成文生图能力 |
快速开始
前提条件
在调用前,请获取与配置 API Key,再配置API Key到环境变量。如果通过DashScope SDK进行调用,还需要安装SDK。
示例代码
调用方式说明:
- 千问生图模型(qwen-image-3.0系列、qwen-image-2.0系列)均支持同步调用,其中qwen-image-3.0系列、qwen-image-plus、qwen-image模型支持异步调用,详情请参见千问-图像生成与编辑3.0和千问-文生图。
- 万相文生图模型均支持异步调用,其中wan2.7-image-pro、wan2.7-image、wan2.6-image、wan2.6-t2i支持同步调用,详情请参见万相-图像生成与编辑2.7、万相-图像生成与编辑2.6和万相-文生图V2。
- 千问-同步调用
- 万相-异步调用
- Python
- Java
- curl
关键能力
1. 指令遵循(提示词)
参数:messages.content.text或input.prompt(必选)、negative_prompt(可选)。
- text \ prompt(正向提示词):描述希望在画面中看到的内容、主体、场景、风格、光照和构图。文生图的核心控制参数。
- negative_prompt(反向提示词):描述不希望在画面中出现的内容,如“模糊”、“多余的手指”等。仅用于辅助优化生成质量。
- 文本渲染(画面中的文字):模型可在画面中生成中英文文字,但对长文本(如完整古诗、长段落或多行文字)难以逐字精准还原,易出现错字、漏字或形近字替代。如对画面内文字的准确性有要求,建议尽量缩短画面内文字、仅保留关键标题或短语,或对成图中的关键文字进行后期编辑。
wan2.7-image-pro、wan2.7-image不支持negative_prompt参数,对于不希望出现的元素,请在正向提示词中描述(不要出现xxx)。
2. 开启prompt智能改写
参数: parameters.prompt_extend (bool, 默认为 true)。
此功能可自动扩展和优化较短的Prompt,提升出图效果。开启此功能额外耗时 3-5 秒。此耗时为使用大模型改写文本。
实践建议:
- 建议开启:当输入 Prompt 较简洁或宽泛时,此功能可显著提升图像效果。
- 建议关闭:若需控制画面细节、或已提供详细描述,或对响应延迟敏感。请将参数
prompt_extend显式设为false。
wan2.7-image-pro、wan2.7-image不支持参数:prompt_extend参数,可通过开启thinking_mode提升出图质量。
parameters.prompt_extend_mode (string,可选,默认为 direct)。仅qwen-image-3.0系列支持,用于指定prompt_extend开启后的改写方式:
direct:直接提示词增强(DPE),适用于大多数场景。文生图(T2I)和图生图/图像编辑(I2I)均支持。agent:智能体提示词增强(APE),提供更精细的改写效果,仅支持文生图(T2I)。图生图/图像编辑(I2I)场景传入agent将返回400错误。
3. 设置输出图像分辨率
参数: parameters.size (string),格式为 "宽*高"。
模型 | size格式 | 总像素支持范围 | 默认 | 宽高比 |
|---|---|---|---|---|
wan2.7-image-pro | 缩写 |
|
| 1:8 – 8:1 |
自定义 | 768*768 – 4096*4096 | |||
wan2.7-image | 缩写 |
|
| 1:8 – 8:1 |
自定义 | 768*768 – 2048*2048 | |||
wan2.6-image(图文混排输出模式) | 自定义 | 768*768 – 1280*1280 | 匹配输入宽高比 (≤1280*1280) | 1:4 – 4:1 |
wan2.6-t2i, wan2.5-t2i-preview | 自定义 | 1280*1280 – 1440*1440 | 1280*1280 | 1:4 – 4:1 |
wan2.2 及更早的 t2i 模型 | 自定义 | [512, 1440],且总像素 ≤1440*1440 | 1024*1024 | - |
qwen-image-3.0 系列 | 自定义 | 512*512 – 2048*2048 | 模型自动推荐 | 1:8 – 8:1 |
qwen-image-2.0 系列 | 自定义 | 512*512 – 2048*2048 | 2048*2048 | - |
qwen-image-max / qwen-image-plus 系列 | 仅限固定预设尺寸 | 见下方预设尺寸 | 1664*928 (16:9) | - |
wan2.7-image-pro仅文生图场景(无图片输入、非组图生成)支持4K与自定义40964096分辨率,其余场景仅支持2K与20482048分辨率。qwen-image-max、qwen-image-plus 系列:仅支持以下 5 种固定的分辨率:
1664*928(默认值):16:91472*1104:4:31328*1328:1:11104*1472:3:4928*1664:9:16
宽高比 | 4K (wan2.7-image-pro) | 2K (wan2.7-image, qwen-image-3.0系列, qwen-image-2.0系列) | 1K (Wan t2i) |
|---|---|---|---|
1:1 | 4096*4096 | 2048*2048 | 1280*1280 |
16:9 | 4096*2304 | 2688*1536 | 1696*960 |
9:16 | 2304*4096 | 1536*2688 | 960*1696 |
4:3 | 4096*3072 | 2368*1728 | 1472*1104 |
3:4 | 3072*4096 | 1728*2368 | 1104*1472 |
4. 组图生成
参数:parameters.enable_sequential(bool,默认为 false)。仅wan2.7-image-pro和wan2.7-image支持。
设为true时启用组图模式,模型将根据提示词和参考图片的内容一次性生成多张有故事连贯性的图像。
- 生成数量:通过
n参数控制,开启组图模式时,取值范围1~12(默认12),实际数量由模型决定且不超过n。 - 注意:开启组图模式时,
thinking_mode和color_palette参数不可用。
5. 思考模式
参数:parameters.thinking_mode(bool,默认为 true)。仅wan2.7-image-pro和wan2.7-image支持。
开启时,模型将增强推理能力以提升出图质量,但会增加生成耗时。
仅在关闭组图模式(enable_sequential=false)时可用。
6. 自定义颜色主题
参数:parameters.color_palette(array)。仅wan2.7-image-pro和wan2.7-image支持。
通过传入包含颜色(hex)和占比(ratio)的对象数组,自定义生成图像的颜色方案。需包含3至10种颜色,推荐设置为8种。所有ratio值相加总和必须为100.00%。
仅在关闭组图模式(enable_sequential=false)时可用。
点击查看输入示例
点击查看输入示例
7. 其他通用参数
参数:parameters.n(integer,可选,默认为 1)。输出图像的数量。qwen-image-3.0 系列支持 1~6 张;wan2.7-image-pro、wan2.7-image 在关闭组图模式时支持 1~4 张;开启组图模式时表示最大生成图像数量(取值范围 1~12,默认为 12),详见上文“组图生成”。
n 直接影响费用:费用 = 单价 × 成功生成的图片张数。参数:
parameters.seed(integer,可选,取值范围 [0, 2147483647])。随机数种子,未传入时由服务随机选择;使用相同 seed 可使生成结果保持相对稳定。具体支持情况以各模型的 API 参考为准。
参数:parameters.watermark(bool,可选,默认为 false)。是否添加水印标识,水印位于图片右下角,文案为“AI生成”。
应用于生产环境
-
容错策略
- 处理限流:当 API 返回
Throttling错误码或 HTTP 429 状态码时,表明已触发限流,限流处理请参见限流。 - 异步任务轮询:轮询查询异步任务结果时,建议采用合理的轮询策略(如前30秒每3秒一次,之后拉长间隔),避免因过于频繁的请求而触发限流。为任务设置一个最终超时时间(如 2 分钟),超时后标记为失败。
- 处理限流:当 API 返回
-
风险防范
- 结果持久化:API 返回的图片 URL 有 24 小时有效期。生产系统必须在获取 URL 后立即下载图片,并转存至您自己的持久化存储服务中(如阿里云对象存储 OSS)。
- 内容安全审核:所有
prompt和negative_prompt都会经过内容安全审核。若输入内容不合规,请求将被拦截并返回DataInspectionFailed错误。 - 生成内容的版权与合规风险:请确保您的提示词内容符合相关法律法规。生成包含品牌商标、名人肖像、受版权保护的 IP 形象等内容可能涉及侵权风险,请您自行评估并承担相应责任。
API文档
错误码
如果模型调用失败并返回报错信息,请参见错误码进行解决。
常见问题
Q: 图片 URL 多久会失效?我应该如何永久保存图片?
A: 图片 URL 的有效期为 24 小时。您必须在获取到 URL 后,立即通过程序下载图片,并将其保存到您自己的持久化存储中,例如本地服务器或阿里云对象存储 OSS。
Q: 调用API返回DataInspectionFailed错误,如何处理?
A: 该错误表示输入文本触发了内容安全审核。请检查并修改prompt或negative_prompt中的文本,移除可能违规的内容后重试。
Q: prompt_extend参数应该开启还是关闭?
A: 当输入的prompt比较简洁或希望模型发挥更多创意时,建议保持开启(默认)。当prompt已经非常详细、专业,或对API响应延迟有严格要求时,建议显式设置为false。
注意:wan2.7-image-pro、wan2.7-image不支持prompt_extend参数,可通过开启thinking_mode提升出图质量。
Q:模型体验如何清空会话的内容?
A: 点击控制台右上角清空当前对话。










