本文介绍万相-背景生成模型的输入输出参数。
相关指南:图像背景生成
模型效果示意
模型简介
更多说明请参见模型计费与限流。
图像背景生成API目前仅支持HTTP调用。
您需要已获取与配置 API Key并配置API Key到环境变量。请将示例代码中的
图像模型处理时间较长,为了避免请求超时,HTTP调用仅支持异步获取模型结果。您需要发起两个请求:
边缘引导元素生成方法因其能够有效保留图像中的边缘和结构信息,在图像背景生成任务中常用于生成前景或背景元素图像。
步骤1:PS抠图,导出带透明背景的4通道格式图像。
步骤2:生成边缘引导元素图像。
针对步骤2,我们提供两种方案,任选一种即可。
方案一:ModelScope在线生成。
访问ModelScope背景图edge元素生成,直接上传第一步抠图后的图像点击运行即可获得符合要求的元素图像。
方案二:使用代码本地生成。
大模型服务通用状态码请查阅:错误码
同时本模型还有如下特定错误码:
图像模型的通用问题请参见常见问题文档,包含模型计费与限流、接口高频报错等。
本模型还存在一些特有问题。
报错场景:如果您想切换V3模型,并将model参数设置为wanx-background-generation-v3,发送请求后发现报错,报错信息显示模型不存在。
原因及解决方案:目前图像背景生成只有
报错场景:如果您将文档的示例图片下载到本地,重新上传到自己的存储服务器,并使用新的图片链接发起请求。请求后报错提示图像格式是RGB格式,而不是RGBA格式。
主要原因:存在主体图像、前景元素图像或背景元素图像不是RGBA图像的情况。在从文档示例链接下载图片至本地并再上传至存储服务的过程中,这些环节可能会改变原始的RGBA图像。可能出现的情况包括:图片下载至本地时保存的格式不支持透明度,例如.jpg、.jpeg等;上传至存储服务器时不支持RGBA格式;在使用工具进行图像编辑或转换时,未能保留图像透明度等。
解决方案:请参见如何查看并获取RGBA图像。
模型概览
模型效果示意

模型名 | 模型简介 |
wanx-background-generation-v2 | 万相-图像背景生成模型为主体商品生成背景图,适用于电商和海报场景。 支持多种背景生成方法:文本引导、图像引导、文本与图像结合引导,以及文本、图像与边缘引导元素的综合应用。 |
模型名 | 计费单价 | 限流(含主账号与RAM子账号) | 免费额度(查看) | |
任务下发接口QPS限制 | 同时处理中任务数量 | |||
wanx-background-generation-v2 | 0.08元/张 | 2 | 1 | 500张 |
前提条件
图像背景生成API目前仅支持HTTP调用。
您需要已获取与配置 API Key并配置API Key到环境变量。请将示例代码中的 DASHSCOPE_API_HOST 替换为获取的 API Host。
HTTP调用
图像模型处理时间较长,为了避免请求超时,HTTP调用仅支持异步获取模型结果。您需要发起两个请求:
- 创建任务获取任务ID:首先发起创建任务请求,该请求会返回任务ID(task_id)。
- 根据任务ID查询结果:使用上一步获得的任务ID,查询任务状态及结果。任务成功执行时将返回图像URL,有效期24小时。
创建任务后,该任务将被加入到排队队列,等待调度执行。后续需要调用“根据任务ID查询结果接口”获取任务状态及结果。
步骤1:创建任务获取任务ID
POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/background-generation/generation
请求头(Headers)Content-Typestring(必选)请求内容类型。此参数必须设置为application/json。Authorizationstring(必选)请求身份认证。接口使用阿里云百炼API Key进行身份认证。示例值:Bearer sk-xxxx。X-DashScope-Asyncstring(必选)异步处理配置参数。HTTP请求只支持异步,必须设置为enable。X-DashScope-WorkSpacestring(可选)阿里云百炼业务空间ID。示例值:llm-xxxx。您可以在此获取Workspace ID。
详细说明 此参数根据阿里云百炼API Key进行填写。
关于如何区分阿里云百炼主账号和RAM子账号,请参考主账号管理。 请求体(Request Body)modelstring(必选)模型名称。当前仅支持填写wanx-background-generation-v2。wanx-background-generation-v2模型有两个版本:v2和v3,默认版本为v2。如需切换版本,请设置parameters.model_version参数。注意:切换模型版本时,请不要将model设置为wanx-background-generation-v3。 正确的做法是:model设置为wanx-background-generation-v2,parameters.model_version设置为v3。
如何切换模型版本? object(必选)输入图像的基本信息,比如图像URL。
属性 base_image_url string(必选)主体图像URL。主体图像必须为带透明背景的RGBA四通道图像。输出图像的分辨率与该图像保持一致。URL 需为公网可访问的地址,并支持 HTTP 或 HTTPS 协议。您也可在此获取临时公网URL。图像格式为png,图像长边不超过2048像素。更多说明请参见主体图像限制、如何查看并获取RGBA图像。ref_image_urlstring(可选)引导图像URL。它与ref_prompt参数至少填写一个。URL 需为公网可访问的地址,并支持 HTTP 或 HTTPS 协议。您也可在此获取临时公网URL。图像要求:jpg、png、webp等常见格式。引导图像可以是 RGB 图像或带透明背景的 RGBA 图像。对于RGBA图像,Alpha通道值为0的区域将不参与引导过程的生成,适用于带有主体的引导图。ref_promptstring(可选)引导文本提示词,支持中英双语。它与ref_image_url参数至少填写一个。英文最多支持150个单词,中文大概是100-120个中文字符,超过部分会被自动忽略。示例:山脉和晚霞。neg_ref_promptstring(可选)负向提示词,描述画面不希望出现的内容。一般不填,使用模型内置的默认值。英文最多支持150个单词,中文大概是100-120个中文字符,超过部分会被自动忽略。示例:低质量的,模糊的,错误的。reference_edgeobject(可选)边缘引导元素图像,包括前景元素图像列表和背景元素图像列表。
属性 foreground_edge s tring list(可选)前景元素图像URL列表。每个图像必须为带透明背景的RGBA四通道图像,分辨率和主体图像相同,如果不同则会自动缩放到和主体图像相同的分辨率。所有前景元素生成的图层在主体前面,可以对主体形成遮挡。每个元素的图层顺序为从底到上。foreground_edge图像列表和background_edge图像列表之和不得超过10。前景元素图像的生成方式参考边缘引导元素生成方法。foreground_edge_prompts tring list(可选)前景元素列表对应的prompt列表。如果输入该参数,长度必须和foreground_edge列表相等,且顺序一一对应。如果无需填写某个元素的prompt,可用空字符串占位。对于每个列表元素,若为英文,则最多支持150个单词;若为中文,则大约支持100至120个中文字符。超过该范围的部分将被自动忽略。background_edges tring list(可选)背景元素图像URL列表。每个图像必须为带透明背景的RGBA四通道图像,分辨率和主体图像相同,如果不同则会自动缩放到和主体图像相同的分辨率。生成图层在主体的后面,如果重叠会被主体遮挡,每个元素的图层顺序为从底到上。foreground_edge图像列表和background_edge图像列表之和不得超过10。背景图像的生成方式参考边缘引导元素生成方法。background_edge_prompts tring list(可选)背景元素列表对应的prompt列表。如果输入该参数,长度必须和background_edge列表相等,且顺序一一对应,如果无需填写某个元素的prompt,可用空字符串占位。对于每个列表元素,若为英文,则最多支持150个单词;若为中文,则大约支持100至120个中文字符。超过该范围的部分将被自动忽略。object(可选)图像处理参数。
属性 n integer (可选)图片生成的数量,支持1~4 张,默认值1。model_versionstring (可选)模型版本。可选值有:
integer (可选)当ref_image_url不为空时生效。该参数在图像引导的过程中添加随机变化,数值越大生成背景与引导图像的相关性越低,默认值300,取值范围[0,999]。ref_prompt_weightfloat (可选)仅当ref_image_url和ref_prompt同时输入时生效,表示引导文本prompt的权重。取值范围 [0,1],默认值为0.5。默认值表示引导文本和引导图像的权重都是0.5,对生成背景的影响程度相当。数值越大(大于0.5)表示引导文本对生成背景的影响程度越大。
已废弃字段 scene_type string(可选)已废弃,不建议使用该参数。使用场景,当前包含3种场景:
|
调用时请将 {WorkspaceId}替换为真实的业务空间ID。 |
响应outputobject任务输出信息。
属性 task_id string任务ID。查询有效期24小时。task_status string任务状态。
枚举值
string请求唯一标识。可用于请求明细溯源和问题排查。codestring请求失败的错误码。请求成功时不会返回此参数,详情请参见错误码。messagestring请求失败的详细信息。请求成功时不会返回此参数,详情请参见错误码。 |
步骤2:根据任务ID查询结果
GET https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/tasks/{task_id}
请求头(Headers)Authorizationstring(必选)请求身份认证。接口使用阿里云百炼API Key进行身份认证。示例值:Bearer sk-xxxx。URL路径参数(Path parameters)task_idstring(必选)任务ID。 |
请将 86ecf553-d340-4e21-xxxxxxxxx替换为真实的task_id。若使用新加坡地域的模型,需将base_url替换为https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/tasks/86ecf553-d340-4e21-xxxxxxxxx,其中{WorkspaceId}需替换为真实的业务空间ID。 |
响应outputobject任务输出信息。
属性 task_id string任务ID。查询有效期24小时。task_status string任务状态。
枚举值
string任务提交时间。格式为 YYYY-MM-DD HH:mm:ss.SSS。scheduled_time string任务执行时间。格式为 YYYY-MM-DD HH:mm:ss.SSS。end_time string任务完成时间。格式为 YYYY-MM-DD HH:mm:ss.SSS。resultslist返回结果图像,图像分辨率大小与输入图像(base_image_url)保持一致。示例值: [{"url":"http://oss.aliyuncs.com/xxx/a.jpg"},{"url":"http://oss.aliyuncs.com/xxx/b.jpg"}]。object任务结果统计。
属性 TOTAL integer总的任务数。SUCCEEDED integer任务状态为成功的任务数。FAILED integer任务状态为失败的任务数。object输出信息统计。
属性 image_count integer模型成功生成图片的数量。计费公式:费用 = 图片数量 × 单价。string请求唯一标识。可用于请求明细溯源和问题排查。 |
任务数据(如任务状态、图像URL等)仅保留24小时,超时后会被自动清除。请您务必及时保存生成的图像。 |
边缘引导元素生成方法
边缘引导元素生成方法因其能够有效保留图像中的边缘和结构信息,在图像背景生成任务中常用于生成前景或背景元素图像。
步骤1:PS抠图,导出带透明背景的4通道格式图像。
步骤2:生成边缘引导元素图像。
针对步骤2,我们提供两种方案,任选一种即可。
方案一:ModelScope在线生成。
访问ModelScope背景图edge元素生成,直接上传第一步抠图后的图像点击运行即可获得符合要求的元素图像。
方案二:使用代码本地生成。
- 环境准备,Python环境中安装需要用到的依赖包。
- 运行代码,使用如下Python脚本生成边缘引导元素。
错误码
大模型服务通用状态码请查阅:错误码
同时本模型还有如下特定错误码:
HTTP 返回码 | 错误码(code) | 错误信息(message) | 含义说明 |
|---|---|---|---|
400 | InvalidParameter.DataInspection | Download the media resource timed out during the data inspection process. | 可能原因:图片所属服务器不稳定,导致下载超时 |
常见问题
图像模型的通用问题请参见常见问题文档,包含模型计费与限流、接口高频报错等。
本模型还存在一些特有问题。
接口报错
wanx-background-generation-v3模型不存在
报错场景:如果您想切换V3模型,并将model参数设置为wanx-background-generation-v3,发送请求后发现报错,报错信息显示模型不存在。
wanx-background-generation-v2这一个模型。如果需要切换V3模型,请设置parameters.model_version为v3,才能成功调用v3模型。