Skip to main content
万相-早期视频模型(2.1-2.6)

万相-视频编辑API参考(2.1)

万相2.1-视频编辑统一模型支持文本、图像、视频等多种模态输入,可执行多种视频生成与编辑任务。

相关文档使用指南

适用范围

为确保调用成功,请务必保证模型、Endpoint URL 和 API Key 均属于同一地域。跨地域调用将会失败。
本文的示例代码适用于北京地域
阿里云百炼为华北2(北京)、新加坡地域推出了业务空间专属域名,能够为推理请求提供卓越的性能和更高的稳定性,建议迁移至新域名:
  • 华北2(北京)地域:从 https://dashscope.aliyuncs.com 迁移至 https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com
  • 新加坡地域:从 https://dashscope-intl.aliyuncs.com 迁移至 https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com
其中 {WorkspaceId} 为您的业务空间 ID,可在阿里云百炼控制台的业务空间详情页面查看。现有域名仍可正常使用。

HTTP调用

视频编辑统一模型的处理耗时较长(约5-10分钟),API采用异步调用的方式。整个流程包含 “创建任务 -> 轮询获取” 两个核心步骤,具体如下:

步骤1:创建任务获取任务ID

  • 北京
  • 新加坡
POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis调用时请将{WorkspaceId}替换为真实的业务空间ID

请求参数

请求头(Headers)
Content-Typestring(必选)请求内容类型。此参数必须设置为application/jsonAuthorizationstring(必选)请求身份认证。接口使用阿里云百炼API Key进行身份认证。示例值:Bearer sk-xxxx。X-DashScope-Asyncstring(必选)异步处理配置参数。HTTP请求只支持异步,必须设置为enable
缺少此请求头将报错:“current user api does not support synchronous calls”。
请求体(Request Body)
  • 多图参考
  • 视频重绘
  • 局部编辑
  • 视频延展
  • 视频画面扩展
model string (必选)模型名称。示例值:wanx2.1-vace-plus。
input object (必选)输入的基本信息,如提示词等。

属性

promptstring(必选)提示词,用来描述生成视频中期望包含的元素和视觉特点。支持中英文,长度不超过800个字符,每个汉字/字母占一个字符,超过部分会自动截断。提示词技巧请参见文生视频/图生视频Prompt指南functionstring(必选)功能名称。多图参考设置为image_reference多图参考支持最多3张参考图。图像内容可以包括主体与背景,例如人物、动物、服饰、场景等。使用 prompt 描述期望生成的视频画面内容,模型可将多张图片融合生成连贯的视频内容。ref_images_urlarray[string] (必选)输入参考图像的URL 数组。
  1. 公网URL:
  2. 临时URL:
参考图像支持1-3 张图像,若超过 3 张,则仅保留前 3 张作为输入。图像限制:
  • 图像格式:JPG、JPEG、PNG、BMP、TIFF、WEBP。
  • 图像分辨率:图像的宽和高范围在[360, 2000],单位像素。
  • 图像大小:不超过10MB。
  • URL地址中不能包含中文字符。
使用建议:
  • 若使用参考图像中的主体时,建议每张图像中仅包含一个主体。背景建议为纯色(如白色或单一颜色),以便更好地突出主体。
  • 若使用参考图像的背景时,背景图像最多只有一张,且背景图像中不包含任何主体对象。
parameters object (可选)视频处理参数,如设置水印等。

属性

obj_or_bg array[string] (可选)该参数用于标识每张参考图像的用途,与 ref_images_url 参数一一对应。数组中每个元素表示对应位置的图像为“主体”还是“背景”:
  • obj:表示该图像作为主体参考。
  • bg:表示该图像作为背景参考 (最多仅允许一个)。
使用说明:
  • 建议传入该参数,且长度必须与 ref_images_url保持一致,否则将报错。
  • 仅当 ref_images_url为单元素数组时,可不传,此时默认值为 ["obj"]
示例值: ["obj", "obj", "bg"]。size string (可选)生成视频的分辨率(宽*高)。目前支持生成720P 视频,分辨率的取值为:
  • 1280*720(默认值):视频宽高比为16:9。其中,1280代表宽度,720代表高度。
  • 720*1280:视频宽高比为9:16。
  • 960*960:视频宽高比为1:1。
  • 832*1088:视频宽高比为3:4。
  • 1088*832:视频宽高比为4:3。
duration integer (可选)视频生成时长,单位为秒。当前参数值固定为5,且不支持修改。模型将始终生成5秒时长的视频。prompt_extendbool (可选)是否开启prompt智能改写。开启后使用大模型对输入prompt进行智能改写。对于较短的prompt生成效果提升明显,但会增加耗时。
  • true(默认值):开启智能改写。
  • false:关闭智能改写。
seedinteger(可选)随机数种子,用于控制模型生成内容的随机性。seed参数取值范围是[0, 2147483647]如果不提供,则算法自动生成一个随机数作为种子。如果您希望生成内容保持相对稳定,请使用相同的seed参数值。watermark bool(可选)是否添加水印标识,水印位于图片右下角,文案为“AI生成”。
  • false(默认值):不添加水印。
  • true:添加水印。
# 以下为华北2(北京)地域的URL,调用时请将 {WorkspaceId} 替换为真实的业务空间ID,各地域的URL不同。
curl --location 'https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
--header 'X-DashScope-Async: enable' \
--header "Authorization: Bearer $DASHSCOPE_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
    "model": "wanx2.1-vace-plus",
    "input": {
        "function": "image_reference",
        "prompt": "视频中,一位女孩自晨雾缭绕的古老森林深处款款走出,她步伐轻盈,镜头捕捉她每一个灵动瞬间。当女孩站定,环顾四周葱郁林木时,她脸上绽放出惊喜与喜悦交织的笑容。这一幕,定格在了光影交错的瞬间,记录下女孩与大自然的美妙邂逅。",
        "ref_images_url": [
            "http://wanx.alicdn.com/material/20250318/image_reference_2_5_16.png",
            "http://wanx.alicdn.com/material/20250318/image_reference_1_5_16.png"
        ]
    },
    "parameters": {
        "prompt_extend": true,
        "obj_or_bg": ["obj","bg"],
        "size": "1280*720"
    }
}'

响应参数

output object任务输出信息。

属性

task_id string任务ID。查询有效期24小时。task_status string任务状态。

枚举值

  • PENDING:任务排队中
  • RUNNING:任务处理中
  • SUCCEEDED:任务执行成功
  • FAILED:任务执行失败
  • CANCELED:任务已取消
  • UNKNOWN:任务不存在或状态未知
request_idstring请求唯一标识。可用于请求明细溯源和问题排查。codestring请求失败的错误码。请求成功时不会返回此参数,详情请参见错误码messagestring请求失败的详细信息。请求成功时不会返回此参数,详情请参见错误码
  • 成功响应
  • 异常响应
请保存 task_id,用于查询任务状态与结果。
{
    "output": {
        "task_status": "PENDING",
        "task_id": "0385dc79-5ff8-4d82-bcb6-xxxxxx"
    },
    "request_id": "4909100c-7b5a-9f92-bfe5-xxxxxx"
}

步骤2:根据任务ID查询结果

  • 北京
  • 新加坡
GET https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/tasks/{task_id}调用时请将{WorkspaceId}替换为真实的业务空间ID

请求参数

请求头(Headers)
Authorizationstring(必选)请求身份认证。接口使用阿里云百炼API Key进行身份认证。示例值:Bearer sk-xxxx。
URL路径参数(Path parameters)
task_id string(必选)任务ID。
  • 查询任务结果
{task_id}完整替换为上一步接口返回的task_id的值。task_id查询有效期为24小时,并请将{WorkspaceId}替换为真实的业务空间ID
curl -X GET https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/tasks/{task_id} \
--header "Authorization: Bearer $DASHSCOPE_API_KEY"

响应参数

outputobject任务输出信息。

属性

task_id string任务ID。查询有效期24小时。task_status string任务状态。

枚举值

  • PENDING:任务排队中
  • RUNNING:任务处理中
  • SUCCEEDED:任务执行成功
  • FAILED:任务执行失败
  • CANCELED:任务已取消
  • UNKNOWN:任务不存在或状态未知
submit_time string任务提交时间。格式为 YYYY-MM-DD HH:mm:ss.SSS。scheduled_time string任务执行时间。格式为 YYYY-MM-DD HH:mm:ss.SSS。end_time string任务完成时间。格式为 YYYY-MM-DD HH:mm:ss.SSS。video_urlstring视频URL。链接有效期24小时,可通过此URL下载视频。输出视频格式为mp4(H.264 编码)。orig_prompt string原始的输入prompt。actual_prompt string开启prompt智能改写后实际使用的prompt。若不开启prompt智能改写,不会返回该字段。codestring请求失败的错误码。请求成功时不会返回此参数,详情请参见错误码messagestring请求失败的详细信息。请求成功时不会返回此参数,详情请参见错误码
usage object输出信息统计。只对成功的结果计数。

属性

video_duration integer生成视频的时长,单位为秒。video_ratio string生成视频的比例。固定为standardvideo_count integer生成视频的数量。
request_idstring请求唯一标识。可用于请求明细溯源和问题排查。
  • 任务执行成功
  • 任务执行失败
任务数据(如任务状态、视频URL等)仅保留24小时,超时后会被自动清除。请您务必及时保存生成的视频。
{
    "request_id": "851985d0-fbba-9d8d-a17a-xxxxxx",
    "output": {
        "task_id": "208e2fd1-fcb4-4adf-9fcc-xxxxxx",
        "task_status": "SUCCEEDED",
        "submit_time": "2025-05-15 16:14:44.723",
        "scheduled_time": "2025-05-15 16:14:44.750",
        "end_time": "2025-05-15 16:20:09.389",
        "video_url": "https://dashscope-result-wlcb.oss-cn-wulanchabu.aliyuncs.com/xxx.mp4?xxxxxx",
        "orig_prompt": "视频中,一位女孩自晨雾缭绕的古老森林深处款款走出,她步伐轻盈,镜头捕捉她每一个灵动瞬间。当女孩站定,环顾四周葱郁林木时,她脸上绽放出惊喜与喜悦交织的笑容。这一幕,定格在了光影交错的瞬间,记录下女孩与大自然的美妙邂逅。",
        "actual_prompt": "一位身着浅色长裙的女孩从晨雾缭绕的古老森林深处缓缓走出,步伐轻盈如舞。她长发微卷,面容清秀,眼神明亮。镜头跟随她的动作,捕捉每一个灵动瞬间。当她站定,转身环顾四周葱郁林木时,脸上绽放出惊喜与喜悦交织的笑容。阳光透过树叶洒下斑驳光影,定格这一人与自然和谐共处的美好时刻。画面风格为清新自然系写真,中景全景结合,平视视角带有轻微移动运镜。"
    },
    "usage": {
        "video_duration": 5,
        "video_ratio": "standard",
        "video_count": 1
    }
}

使用限制

  • 数据时效:任务task_id和 视频video_url均只保留 24 小时,过期后将无法查询或下载。
  • 音频支持:当前仅支持生成无声视频,不支持音频输出。如有需要,可通过语音合成生成音频。

错误码

如果模型调用失败并返回报错信息,请参见错误码进行解决。

常见问题

Q:如何获取视频存储的访问域名白名单?

A: 模型生成的视频存储于阿里云OSS,API将返回一个临时的公网URL。若需要对该下载地址进行防火墙白名单配置,请注意:由于底层存储会根据业务情况进行动态变更,为避免过期信息影响访问,文档不提供固定的OSS域名白名单。如有安全管控需求,请联系客户经理获取最新OSS域名列表。
文本生成
图像生成
3D模型生成
音频
Realtime API
  • 概述
向量与排序
模型生产