万相视频编辑模型支持对输入视频进行内容增删改、背景替换、风格转换、动作/特效/运镜复刻等编辑操作,提供以下两种方式:
- 指令编辑:通过文字指令修改视频内容,如替换人物服饰、更改场景元素、调整画面风格等。
- 指令+参考图编辑:除指令外,还支持传入参考图像,将图像中的元素(如人物、服饰、道具)应用到视频中。
视频编辑(尤其是复刻指定视频的动作/运镜/特效)推荐使用视频编辑 2.7。若需视频续写能力,推荐使用万相2.7-图生视频。
快速开始
| 输入提示词和参考图 | 输入视频(特效视频) | 输出视频 |
参考视频的特效,将这个特效应用到图片中的这个长发的女人身上,场景为晚会。![]() |
- Python SDK
- Java SDK
- curl
video_url 有效期24小时,请及时下载视频。
适用范围
- 各地域支持的模型有所差异,且资源相互独立。各地域支持的模型请参见百炼控制台。
- 调用时,确保模型、Endpoint URL 和 API Key 均属于同一地域,跨地域调用将会失败。
本文的示例代码适用于华北2(北京)地域。
核心能力
纯指令编辑
支持模型:wan2.7-videoedit。
功能介绍:仅传入视频和文本提示词,通过指令直接修改视频内容。适用于风格转换、动作修改、运镜调整等场景。
参数设置:
media:传入一个待编辑的视频(type=video),无需传入参考图像。prompt:描述编辑意图,如“视频改为8bit像素风格”。
| 输入提示词 | 输入视频 | 输出视频 |
| 视频改为8bit像素风格 |
- Python SDK
- Java SDK
- curl
指令+参考图编辑
支持模型:wan2.7-videoedit。
功能介绍:传入视频、文本提示词和参考图像,将参考图中的元素(如服饰、道具等)应用到视频中。
参数设置:
media:传入一个待编辑的视频(type=video)和参考图像(type=reference_image)。最多支持4张参考图像。prompt:描述编辑意图,如“让视频中的马头人身角色穿上图片中的条纹毛衣”。
| 输入提示词和参考图 | 输入视频 | 输出视频 |
让视频中的马头人身角色穿上图片中的条纹毛衣![]() |
- Python SDK
- Java SDK
- curl
使用场景及效果示例
添加/删除/修改元素
对视频内特定元素进行添加、删除或替换。
| 类型 | 输入提示词和参考图 | 输入视频 | 输出视频 |
| 添加 | 杯子里加一块黑色正方形巧克力 | ||
| 删除 | 将视频中的火车删除,其他保持不变。 | ||
| 修改 | 将视频中的胶片替换为图片中的盘子![]() | ||
| 修改 | 让视频中的马男穿上图片中的条纹毛衣![]() | ||
| 修改 | 把猫换成狗 | ||
| 修改 | 将画面唱歌的女生替换为一只可爱的拟人猫咪在唱歌,其他保持不变。 |
修改环境或背景
通过指令变换视频的光照条件、季节色彩,修改地理空间,也支持变换视频背景,让物体穿越到任意空间。
| 类型 | 输入提示词 | 输入视频 | 输出视频 |
| 修改季节 | 背景修改季节为白雪皑皑的冬天,树上全是积雪,河流保持不变。 | ||
| 修改天气 | 人物动作不变,整个场景由现在的阴天改为晴天,其他保持不变 | ||
| 修改光影 | 其他保持不变,画面整体的光的颜色和滤镜由白色变为暖色调,保持人物肤色细节,使人物与背景统一和谐。 | ||
| 修改背景 | 主体女人动作不变,将视频背景修改为健身房。 |
修改视频风格
将既有视频快速转化为多种艺术风格,如动画、3D、黏土、毛线等。
| 类型 | 输入提示词 | 输入视频 | 输出视频 |
| 修改风格 | 视频改为图片的C4D卡通风格![]() | ||
| 修改风格 | 将整个画面转变为真人电影风格 | ||
| 修改风格 | 将整个画面转换为水彩画风格 |
修改角色行为/台词/拍摄方式
对已经拍摄或生成的视频内容,通过指令修改剧情内容(如角色行为或台词)和拍摄方法,实现二次创作。
| 类型 | 输入提示词 | 输入视频 | 输出视频 |
| 修改角色行为 | 让视频里的男人盛一勺汤并喝下,其他保持不变。 | ||
| 修改角色情绪 | 画面中的女孩表情变得悲伤并开始流泪,其他保持不变。 | ||
| 修改角色台词 | 保持人物音色和语气,将 左边女生的说话内容改为:“Mom, what color is this?”,将右边女生说话内容改为:“It's green, baby” | ||
| 修改拍摄方式 | 将相机运镜改为顺时针环绕人物拍摄,人物跟随镜头移动。 | ||
| 修改拍摄方式 | 将视频运镜改为向上抬高并同时向下俯视。 |
复刻动作/运镜/特效
复刻参考视频的动作序列、运镜轨迹与视觉特效,生成动态特征一致的视频。
| 类型 | 输入提示词或参考图 | 输入视频 | 输出视频 |
| 复刻单人动作 | 让图片中的人物模仿视频中的人的动作。![]() | ||
| 复刻多人动作 | 参考视频五个人物动作,改为五个人在城市街道的路边摊上唱歌弹琴。 | ||
| 复刻运镜 | 参考原视频运镜方式,镜头快速移动,场景更改为在颁奖典礼上,参考图片中的女人在走红毯。![]() | ||
| 复刻特效 | 参考视频的特效,将这个特效应用到图片中女人身上,场景为街边。![]() |
如何输入视频和图像
输入视频
- 视频数量:必传,有且仅有1个。
-
输入方式:
- 公网URL:支持 HTTP 或 HTTPS 协议。示例:https://xxxx/xxx.mp4。
- 临时URL:支持OSS协议,必须通过上传文件获取临时 URL。示例:oss://dashscope-instant/xxx/xxx.mp4。
输入参考图像
- 图像数量:可选,最多4张。
-
输入方式:
- 公网URL:支持 HTTP 或 HTTPS 协议。示例:https://xxxx/xxx.png。
- 临时URL:支持OSS协议,必须通过上传文件获取临时 URL。示例:oss://dashscope-instant/xxx/xxx.png。
-
Base64 编码字符串:示例:data:image/png;base64,iVBORw0KGgoAAAANSUhEUgAABDg......(示例已截断,仅做演示)。
-
格式:
data:{MIME_type};base64,{base64_data},其中:- {base64_data}:图像文件经过 Base64 编码后的字符串。
- {MIME_type}:图像的媒体类型,需与文件格式对应。
图像格式
MIME Type
JPEG
image/jpeg
JPG
image/jpeg
PNG
image/png
BMP
image/bmp
WEBP
image/webp
示例代码
-
格式:
输出视频
- 视频数量:1个。
- 视频规格:格式为MP4。具体请参见视频规格范围。
- 视频URL有效期:24小时。
- 视频尺寸:由参数resolution指定视频分辨率,参数ratio指定视频宽高比。
计费与限流
- 模型免费额度和计费单价请参见模型价格。
- 模型限流请参见万相系列。
-
计费说明:
- 输入图像不计费,输入视频和输出视频计费,按视频秒数计费。即:
总计费时长(秒)= 输入视频时长(秒)+ 输出视频时长(秒)。 - 模型调用失败或处理错误不产生任何费用,也不消耗新人免费额度。
- 输入图像不计费,输入视频和输出视频计费,按视频秒数计费。即:
API文档
万相2.7-视频编辑
常见问题
Q:视频编辑2.7(wan2.7-videoedit)与视频编辑2.1(wanx2.1-vace-plus)有什么区别?
A:视频编辑2.7通过指令直接编辑视频,使用简单,能力全面升级。视频编辑2.1需指定function参数,侧重掩码局部编辑、画面扩展等功能。推荐优先选用视频编辑 2.7。
Q:如何传入多张参考图像?
A:在media数组中添加多个type=reference_image的对象即可,最多4张。示例:






