千问-图像编辑模型支持多图输入和多图输出,可精确修改图内文字、增删或移动物体、改变主体动作、迁移图片风格及增强画面细节。
快速开始
在调用前,您需要获取与配置 API Key,再配置API Key到环境变量。
如需通过SDK进行调用,请安装DashScope SDK。目前,该SDK已支持Python和Java。
请将示例代码中的 DASHSCOPE_API_HOST 替换为获取的 API Host。
- Python
- Java
- curl
通过URL下载图像到本地
通过URL下载图像到本地
模型选型建议
qwen-image-3.0-pro系列(推荐):千问图像3.0旗舰版,图像生成与编辑能力全面升级,文字渲染、真实质感、语义遵循能力更强。qwen-image-3.0系列:千问图像3.0标准版,兼顾质量与速度。
输入说明
输入图像(messages)
messages 是一个数组,且必须仅包含一个对象。该对象需包含 role 和 content 属性。其中role必须设置为user,content需要同时包含image(1-3张图像)和text(一条编辑指令)。
输入图片必须满足以下要求:
-
图片格式:JPG、JPEG、PNG、BMP、TIFF、WEBP和GIF。
输出图像为PNG格式,对于GIF动图,仅处理其第一帧。
- 图片分辨率:为获得最佳效果,建议图像的宽和高均在384像素至3072像素之间。分辨率过低可能导致生成效果模糊,过高则会增加处理时长。
- 文件大小:单张图片文件大小不得超过 10MB。
图像输入顺序
多图输入时,按照数组中的顺序定义图像顺序。因此,提示词引用的图像编号需要与图像数组中的顺序一一对应,例如:数组中的第一张图片为"图1",第二张为"图2",或者使用标记形式如"[图1]"、"[图2]"。
输入图像 | 输出图像 | ||
|---|---|---|---|
![]() 图1 | ![]() 图2 | ![]() 提示词:把图1移动到图2上 | ![]() 提示词:把图2移动到图1上 |
图像传入方式
公网URL
- 提供一个公网可访问的图像地址,支持 HTTP 或 HTTPS 协议。本地文件请参见上传文件获取临时URL。
- 示例值:
https://xxxx/img.png。
data:{mime_type};base64,{base64_data}。
{mime_type}:图像的媒体类型,需与文件格式对应。{base64_data}:文件经过 Base64 编码后的字符串。- 示例值:
data:image/jpeg;base64,GDU7MtCZz...(示例已截断,仅做演示)
更多参数
可以通过以下可选参数调整生成效果:
- n:指定输出图像数量,默认值为1。qwen-image-3.0系列、qwen-image-2.0系列、qwen-image-edit-max和qwen-image-edit-plus系列模型支持输出1-6张图片,
qwen-image-edit模型仅支持输出1张图片。 - negative_prompt(反向提示词):描述不希望在画面中出现的内容,如“模糊”、“多余的手指”等,用于辅助优化生成质量。
- watermark:是否在图像右下角添加 "Qwen-Image" 水印。默认值为
false。 - seed:随机数种子。取值范围是
[0, 2147483647]。如果不提供,则算法自动生成一个随机数作为种子。使用相同的 seed 值可帮助生成内容保持相对稳定。
- size:设置输出图像的分辨率,格式为
宽*高,例如"1024*2048"。对于qwen-image-3.0系列模型,像素面积范围为512512至20482048,宽高比限制为1:8至8:1,未指定时由模型根据提示词自动推荐分辨率。对于qwen-image-2.0系列模型,支持自由设置宽高,输出图像总像素需在512512至20482048之间,默认分辨率与输入图(多图输入时为最后一张图)一致。对于qwen-image-edit-max、qwen-image-edit-plus系列模型,宽和高的取值范围均为[512, 2048]像素,默认保持与原图相似的长宽比,总像素接近1024*1024分辨率。 - prompt_extend:是否开启prompt智能改写功能,默认值为
true。开启后,模型将优化提示词,对描述性不足、较为简单的prompt提升效果较明显。
效果概览
多图融合
输入图像1 | 输入图像2 | 输入图像3 | 输出图像 |
|---|---|---|---|
![]() | ![]() | ![]() | ![]() 图1中的女生戴着图2中的项链,左肩挎着图3中的包 |
主体一致性保持
输入图像 | 输出图像1 | 输出图像2 | 输出图像3 |
|---|---|---|---|
![]() | ![]() 修改为蓝底证件照,人物穿上白色衬衫,黑色西装,打着条纹领带 | ![]() 人物穿上白色衬衫,灰色西装,打着条纹领带,一只手摸着领带,浅色背景 | ![]() 人物穿着粗笔刷字体的“千问图像”的黑色卫衣,依靠在护栏边,阳光照在发丝上,身后是大桥和海 |
![]() | ![]() 把这个空调放在客厅,沙发旁边 | ![]() 在空调出风口增加雾气,一直到沙发上,并且增加绿叶。 | ![]() 在上方增加白色的手写体"自然新风 畅享呼吸" |
草图创作
输入图像 | 输出图像 | |
|---|---|---|
![]() | ![]() 生成一张图像,符合图1所勾勒出的精致形状,并遵循以下描述:一位年轻的女子在阳光明媚的日子里微笑着,她戴着一副棕色的圆形太阳镜,镜框上有豹纹图案。她的头发被整齐地盘起,耳朵上佩戴着珍珠耳环,脖子上围着一条带有紫色星星图案的深蓝色围巾,穿着一件黑色皮夹克。 | ![]() 生成一张图像,符合图1所勾勒出的精致形状,并遵循以下描述:一位年老的老人朝着镜头微笑,他的脸上布满皱纹,头发在风中凌乱,戴着一副圆框的老花镜。脖子上戴着一条破旧的红色围巾,上面有星星图案。穿着一件棉衣。 |
文创生成
输入图像 | 输出图像 | ||
|---|---|---|---|
![]() | ![]() 让这只熊坐在月亮下(用白色背景上的浅灰弯月轮廓表示),抱着吉他,周围漂浮着小星星和诗句气泡,如“Be Kind”。 | ![]() 将这个图案印在一件T恤和一个手提纸袋上。一个女模特正在展示这些物品。这个女生还戴着一顶鸭舌帽,帽子上写着"Be kind”。 | ![]() 一个超逼真的1/7比例角色模型,设计为商业产品成品,放置在一台带有白色键盘的iMac电脑桌上。模型站在一个干净、圆形的透明亚克力底座上,没有标签或文字。专业的摄影棚灯光凸显了雕刻细节。在背景的iMac屏幕上,展示同一模型的ZBrush建模过程。在模型旁边,放置一个包装盒,前面带有透明窗户,仅显示内部透明塑料壳,其高度略高于模型,尺寸合理以容纳模型。 |
![]() 这只熊穿着宇航服,伸出手指向远方 | ![]() 这只熊穿着华丽的舞裙,双臂展开,做出优雅的舞蹈动作 | ![]() 这只熊穿着运动服,手里拿着篮球,单腿弯曲 | |
根据深度图生成图像
输入图像 | 输出图像 | |
|---|---|---|
![]() | ![]() 生成一张图像,符合图1所勾勒出的深度图,并遵循以下描述:在一条街边的小巷中停放着一辆蓝色的自行车,背景中有几株从石缝中长出来的杂草 | ![]() 生成一张图像,符合图1所勾勒出的深度图,并遵循以下描述:一辆红色的破旧的自行车停在一条泥泞的小路上,背景是茂密的原始森林 |
根据关键点生成图像
输入图像 | 输出图像 | |
|---|---|---|
![]() | ![]() 生成一张图像,符合图1所勾勒出的人体姿态,并遵循以下描述:一位身穿着汉服的中国美女,在雨中撑着油纸伞,背景是苏州园林。 | ![]() 生成一张图像,符合图1所勾勒出的人体姿态,并遵循以下描述:一位男生,站在地铁站台上,他头上戴着一顶棒球帽,穿着T恤和牛仔裤。背后是飞驰而过的列车。 |
文字编辑
输入图像 | 输出图像 | 输入图像 | 输出图像 |
|---|---|---|---|
![]() | ![]() 将拼字游戏方块上'HEALTH INSURANCE’ 替换为'明天会更好' | ![]() | ![]() 将便条上的短语“Take a Breather”更改为“Relax and Recharge” |
输入图像 | 输出图像 | ||
|---|---|---|---|
![]() | ![]() 将“Qwen-Image”换成黑色的滴墨字体 | ![]() 将“Qwen-Image”换成黑色的手写字体 | ![]() 将“Qwen-Image”换成黑色的像素字体 |
![]() 将“Qwen-Image”换成红色 | ![]() 将“Qwen-Image”换成蓝紫渐变色 | ![]() 将“Qwen-Image”换成糖果色 | |
![]() 将“Qwen-Image”材质换成金属 | ![]() 将“Qwen-Image”材质换成云朵 | ![]() 将“Qwen-Image”材质换成玻璃 | |
增删改
能力 | 输入图像 | 输出图像 |
|---|---|---|
新增元素 | ![]() | ![]() 在企鹅前方添加一个小型木制标牌,上面写着“Welcome to Penguin Beach”。 |
删除元素 | ![]() | ![]() 删除餐盘上的头发 |
视角转换
输入图像 | 输出图像 | 输入图像 | 输出图像 |
|---|---|---|---|
![]() | ![]() 获得正视视角 | ![]() | ![]() 朝向左侧 |
![]() | ![]() 获得后侧视角 | ![]() | ![]() 朝向右侧 |
老照片处理
能力 | 输入图像 | 输出图像 |
|---|---|---|
老照片修复及上色 | ![]() | ![]() 修复老照片,去除划痕,降低噪点,增强细节,高分辨率,画面真实,肤色自然,面部特征清晰,无变形。 |
![]() | ![]() 根据内容智能上色,使图像更生动 |
API参考
API的输入输出参数,请参见千问-图像编辑。
错误码
如果模型调用失败并返回报错信息,请参见错误码进行解决。
常见问题
Q:千问图像编辑模型支持哪些语言?
A:目前正式支持简体中文和英文;其他语言可自行尝试,但效果存在不确定性。
Q: 如何查看模型调用量?
A: 模型调用完一小时后,请在模型监控(北京)或模型监控(新加坡) 页面,查看模型的调用次数、成功率等指标。详情请参见账单查询与成本管理。
Q:如何获取图像存储的访问域名白名单?
A: 模型生成的图像存储于阿里云OSS,API将返回一个临时的公网URL(链接有效期为 24 小时,请及时下载保存)。图片URL的域名格式为dashscope-{标识}.oss-accelerate.aliyuncs.com或dashscope-{标识}.oss-cn-{地域}.aliyuncs.com。若需要对该下载地址进行防火墙白名单配置,请注意:由于底层存储会动态变更,以下bucket名称仅供参考,可能随时更新:dashscope-a717、dashscope-66f3、dashscope-7c2c、dashscope-2522、dashscope-c72b、dashscope-0484、dashscope-7e0f、dashscope-5859、dashscope-5496、dashscope-35f9、dashscope-31d9、dashscope-7f1f、dashscope-cc75、dashscope-64e9。为避免过期信息影响访问,文档不提供固定的OSS域名白名单。如有安全管控需求,请联系客户经理获取最新OSS域名列表。API当前仅支持返回URL格式,不支持base64格式输出。
更多问题请参见图像生成常见问题。




























































