Skip to main content
爱诗

爱诗-参考生视频API参考

爱诗-参考生视频模型支持传入多张参考图片或视频,通过 文本提示词 描述场景,将素材中的主体角色融合生成一段流畅的视频。

本文档仅适用于华北2(北京)地域,且必须使用该地域的API Key

服务开通

  1. 前往阿里云百炼控制台,搜索 PixVerse,找到 PixVerse 模型卡片,单击立即开通
  2. 在弹窗内确认开通及授权。

适用范围

为确保调用成功,请务必保证模型、Endpoint URL 和 API Key 均属于同一地域。跨地域调用将会失败。

HTTP调用

由于参考生视频任务耗时较长(通常为1-5分钟),API采用异步调用。整个流程包含 "创建任务 -> 轮询获取" 两个核心步骤,具体如下:

步骤1:创建任务获取任务ID

北京地域POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis 调用时请将{WorkspaceId}替换为真实的业务空间ID
  • 创建成功后,使用接口返回的 task_id 查询结果,task_id 有效期为 24 小时。请勿重复创建任务,轮询获取即可。
  • 新手指引请参见Postman

请求参数

请求头(Headers)
Content-Typestring(必选)请求内容类型。此参数必须设置为application/jsonAuthorizationstring(必选)请求身份认证。接口使用阿里云百炼API Key进行身份认证。示例值:Bearer sk-xxxx。X-DashScope-Asyncstring(必选)异步处理配置参数。HTTP请求只支持异步,必须设置为enable
缺少此请求头将报错:“current user api does not support synchronous calls”。
请求体(Request Body)
model string (必选)模型名称。模型输出规格请参见模型列表可选值:
  • pixverse/pixverse-v6-r2v-omni
  • pixverse/pixverse-c1-r2v
  • pixverse/pixverse-v6-r2v
  • pixverse/pixverse-v5.6-r2v

模型选型

  • 需要图片+视频融合参考生成时,推荐选用 v6-r2v-omni,支持同时传入参考图片和参考视频。
  • 针对打斗、法术特效及高速运动等动态场景以及多宫格场景,推荐选用 c1
  • 通用场景推荐使用v6v5.6建议直接升级至v6。
input object (必选)输入的基本信息,包括参考图片和提示词。

属性

prompt string (必选)文本提示词。用来描述生成视频中期望包含的元素和视觉特点。支持中英文,每个汉字/字母占一个字符,字符编码为UTF-8,超过部分会自动截断。
  • pixverse/pixverse-v6-r2v-omni:不超过5000个字符。
  • pixverse/pixverse-c1-r2v:不超过5000个字符。
  • pixverse/pixverse-v6-r2v:不超过2048个字符。
  • pixverse/pixverse-v5.6-r2v:不超过2048个字符。
图片引用说明:当在 media 参数中传入参考图时,可以通过 @ref_name在prompt中直接引用该图片。
  • media 中设置的 ref_name 在同一请求内必须全局唯一,且须与 prompt 中的引用一一对应。
  • 书写规范:必须在 @ref_name 后保留一个空格作为分隔。
示例值:
  • 普通提示词:男人坐在靠窗的椅子上,手持吉他,在咖啡厅旁演奏一首舒缓的美国乡村民谣。
  • 含引用的提示词:@男人 坐在靠窗的椅子上,手持@吉他 ,在@咖啡厅 旁演奏一首舒缓的美国乡村民谣。
media array (必选)媒体素材列表,用于指定视频生成所需的参考图像和视频。数组的每个元素为一个媒体对象,包含 typeurl字段。

元素属性

type string (必选)媒体素材类型。可选值:
  • image_url:图像URL。
  • video_url:视频URL(仅 pixverse/pixverse-v6-r2v-omni 支持)。
素材数量限制:
  • 图像数量:pixverse/pixverse-v6-r2v-omni 最多10张,其他模型最多7张。
  • 视频数量(仅 omni):1~2个。
url string (必选)媒体素材URL。素材包括图像、视频(视频仅 omni 模型支持)。

传入图像(type=image_url)

参考图像URL,必须为公网可访问的 URL。图像限制:
  • 格式:JPG、PNG、WEBP。
  • 分辨率:图像的宽度和高度均不超过10000像素。
  • 文件大小:不超过20MB。

传入视频(type=video_url,仅 omni 模型)

参考视频URL,必须为公网可访问的 URL。视频限制:
  • 格式:MP4、MOV。
  • 分辨率:长边不超过1920像素。
  • 文件大小:单个视频不超过50MB。
  • 时长:两个视频总时长不超过15秒。
ref_name string (可选)参考图片或视频中主体的名称标识,用于在prompt中通过@ref_name引用。长度不超过30个字符。
parameters object (必选)视频生成参数。如设置视频分辨率、时长、是否生成音频等。

属性

resolution string (omni 模型必选)生成视频的分辨率档位。仅 pixverse/pixverse-v6-r2v-omni 使用此参数。可选值:
  • 360P
  • 540P
  • 720P
  • 1080P
aspect_ratio string (omni 模型必选)生成视频的宽高比。仅 pixverse/pixverse-v6-r2v-omni 使用此参数。可选值:
  • auto:自动采用第一个图片或视频的宽高比。
  • 16:9
  • 4:3
  • 1:1
  • 3:4
  • 9:16
  • 3:2
  • 2:3
  • 21:9
size string (c1/v6/v5.6 模型必选)生成视频的分辨率,格式为宽*高的像素值。不支持 pixverse/pixverse-v6-r2v-omni 模型。不同分辨率档位对应的可选值见下方表格。

pixverse/pixverse-c1-r2v模型

分辨率档位

宽高比

size取值(宽*高)

360P

16:9

640*360

4:3

640*480

1:1

640*640

3:4

480*640

9:16

360*640

3:2

640*432

2:3

432*640

21:9

640*288

540P

16:9

1024*576

4:3

1024*768

1:1

1024*1024

3:4

768*1024

9:16

576*1024

3:2

1024*688

2:3

688*1024

21:9

1024*448

720P

16:9

1280*720

4:3

1108*832

1:1

960*960

3:4

832*1108

9:16

720*1280

3:2

1200*800

2:3

800*1200

21:9

1280*560

1080P

16:9

1920*1080

4:3

1664*1248

1:1

1440*1440

3:4

1248*1664

9:16

1080*1920

3:2

1776*1184

2:3

1184*1776

21:9

1920*832

分辨率档位

宽高比

size取值(宽*高)

360P

16:9

640*360

4:3

640*480

1:1

640*640

3:4

480*640

9:16

360*640

3:2

640*432

2:3

432*640

21:9

640*288

540P

16:9

1024*576

4:3

1024*768

1:1

1024*1024

3:4

768*1024

9:16

576*1024

3:2

1024*688

2:3

688*1024

21:9

1024*448

720P

16:9

1280*720

4:3

1108*832

1:1

960*960

3:4

832*1108

9:16

720*1280

3:2

1200*800

2:3

800*1200

21:9

1280*560

1080P

16:9

1920*1080

4:3

1664*1248

1:1

1440*1440

3:4

1248*1664

9:16

1080*1920

3:2

1776*1184

2:3

1184*1776

21:9

1920*832

分辨率档位

宽高比

size取值(宽*高)

360P

16:9

640*360

4:3

640*480

1:1

640*640

3:4

480*640

9:16

360*640

540P

16:9

1024*576

4:3

1024*768

1:1

1024*1024

3:4

768*1024

9:16

576*1024

720P

16:9

1280*720

4:3

1108*830

1:1

960*960

3:4

830*1108

9:16

720*1280

1080P

16:9

1920*1080

4:3

1662*1246

1:1

1440*1440

3:4

1246*1662

9:16

1080*1920

示例值:1280*720。duration integer (必选)
duration直接影响费用,请在调用前确认爱诗-参考生视频
生成视频的时长,单位为秒。可选值:
  • pixverse/pixverse-v6-r2v-omni:
    • 有视频参考时:必须填 0,系统将自动取输入视频中的最长时长。
    • 仅图片参考时:取值范围为[1, 15]之间的整数。
  • pixverse/pixverse-c1-r2v:取值范围为[1, 15]之间的整数。
  • pixverse/pixverse-v6-r2v:取值范围为[1, 15]之间的整数。
  • pixverse/pixverse-v5.6-r2v:
    • 当 size 为 360P / 540P / 720P 对应的所有分辨率时:取值为5、8、10。
    • 当size为1080P对应的所有分辨率时:取值为5、8。
示例值:5。audio boolean (可选)
audio直接影响费用,请在调用前确认爱诗-参考生视频
是否生成有声视频。开启后模型将根据视频内容自动生成匹配的背景音乐或音效。
  • false:默认值,输出无声视频。
  • true:输出有声视频。
示例值:false。watermark boolean (可选)是否添加水印标识,水印位于视频右下角,文案固定为“AI生成”。
  • false:默认值,不添加水印。
  • true:添加水印。
示例值:false。seedinteger(可选)随机数种子,取值范围为[0, 2147483647]未指定时,系统自动生成随机种子。若需提升生成结果的可复现性,建议固定seed值。请注意,由于模型生成具有概率性,即使使用相同 seed,也不能保证每次生成结果完全一致。
  • 参考生视频(图片+视频,omni)
  • 参考生视频
  • 参考生视频(使用ref_name)
通过 media 传入参考视频和参考图片,使用 resolutionaspect_ratio 控制输出分辨率和画面比例。
# 调用时请将 {WorkspaceId} 替换为真实的业务空间ID。
curl --location 'https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
    -H 'X-DashScope-Async: enable' \
    -H "Authorization: Bearer $DASHSCOPE_API_KEY" \
    -H 'Content-Type: application/json' \
    -d '{
    "model": "pixverse/pixverse-v6-r2v-omni",
    "input": {
        "media": [
            {
                "type": "video_url",
                "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/qigswt/wan-r2v-role2.mp4",
                "ref_name": "参考视频"
            },
            {
                "type": "image_url",
                "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260320/knsple/wan-r2v-role-frame.jpg",
                "ref_name": "男人"
            },
            {
                "type": "image_url",
                "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260129/wfjikw/wan-r2v-backgroud5.png",
                "ref_name": "咖啡厅"
            }
        ],
        "prompt": "@男人 在@咖啡厅 中弹吉他 参考@参考视频"
    },
    "parameters": {
        "resolution": "720P",
        "aspect_ratio": "16:9",
        "duration": 0,
        "audio": true,
        "watermark": false
    }
}'

响应参数

output object任务输出信息。

属性

task_id string任务ID。查询有效期24小时。task_status string任务状态。

枚举值

  • PENDING:任务排队中
  • RUNNING:任务处理中
  • SUCCEEDED:任务执行成功
  • FAILED:任务执行失败
  • CANCELED:任务已取消
  • UNKNOWN:任务不存在或状态未知
request_idstring请求唯一标识。可用于请求明细溯源和问题排查。codestring请求失败的错误码。请求成功时不会返回此参数,详情请参见错误码messagestring请求失败的详细信息。请求成功时不会返回此参数,详情请参见错误码
  • 成功响应
  • 异常响应
请保存 task_id,用于查询任务状态与结果。
{
    "output": {
        "task_status": "PENDING",
        "task_id": "0385dc79-5ff8-4d82-bcb6-xxxxxx"
    },
    "request_id": "4909100c-7b5a-9f92-bfe5-xxxxxx"
}

步骤2:根据任务ID查询结果

北京地域GET https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/tasks/{task_id}
  • 轮询建议:视频生成过程约需数分钟,建议采用轮询机制,并设置合理的查询间隔(如 15 秒)来获取结果。
  • 任务状态流转:PENDING(排队中)→ RUNNING(处理中)→ SUCCEEDED(成功)/ FAILED(失败)。
  • task_id 有效期24小时,超时后将无法查询结果,接口将返回任务状态为UNKNOWN
  • RPS 限制:查询接口默认RPS为20。如需更高频查询或事件通知,建议配置异步任务回调
  • 更多操作:如需批量查询、取消任务等操作,请参见管理异步任务

请求参数

请求头(Headers)
Authorizationstring(必选)请求身份认证。接口使用阿里云百炼API Key进行身份认证。示例值:Bearer sk-xxxx。
URL路径参数(Path parameters)
task_id string(必选)任务ID。
  • 查询任务结果
{task_id}完整替换为上一步接口返回的task_id的值。task_id查询有效期为24小时,并请将{WorkspaceId}替换为真实的业务空间ID
curl -X GET https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/tasks/{task_id} \
--header "Authorization: Bearer $DASHSCOPE_API_KEY"

响应参数

outputobject任务输出信息。

属性

task_id string任务ID。查询有效期24小时。task_status string任务状态。

枚举值

  • PENDING:任务排队中
  • RUNNING:任务处理中
  • SUCCEEDED:任务执行成功
  • FAILED:任务执行失败
  • CANCELED:任务已取消
  • UNKNOWN:任务不存在或状态未知
轮询过程中的状态流转:
  • PENDING(排队中) → RUNNING(处理中)→ SUCCEEDED(成功)/ FAILED(失败)。
  • 初次查询状态通常为 PENDING(排队中)或 RUNNING(处理中)。
  • 当状态变为 SUCCEEDED 时,响应中将包含生成的视频URL。
  • 若状态为 FAILED,请检查错误信息并重试。
  • 若状态为 CANCELED,表示任务已取消,如需继续请重新提交任务。
  • 若状态为 UNKNOWN,表示任务不存在或状态未知,可能在 task_id 不存在或超过 24 小时有效期后出现。
submit_time string任务提交时间。格式为 YYYY-MM-DD HH:mm:ss.SSS。scheduled_time string任务执行时间。格式为 YYYY-MM-DD HH:mm:ss.SSS。end_time string任务完成时间。格式为 YYYY-MM-DD HH:mm:ss.SSS。video_urlstring视频URL。仅在 task_status 为 SUCCEEDED 时返回。视频格式为MP4(H.264 编码)。视频链接暂无过期时间,但不建议将其作为长期存储依赖,请及时下载。orig_prompt string原始输入的prompt,对应请求参数promptcodestring请求失败的错误码。请求成功时不会返回此参数,详情请参见错误码messagestring请求失败的详细信息。请求成功时不会返回此参数,详情请参见错误码
usage object输出信息统计。只对成功的结果计数。

属性

duration integer生成视频的总视频时长,用于计费。size string生成视频的分辨率。fps integer生成视频的帧率。SR string生成视频的分辨率档位。audio boolean生成视频是否为有声视频。video_count integer生成视频的数量。固定为1。
request_idstring请求唯一标识。可用于请求明细溯源和问题排查。
  • 任务执行成功
  • 任务执行失败
  • 任务查询过期
{
    "request_id": "35137489-2862-96cb-b6f2-xxxxxx",
    "output": {
        "task_id": "1469cfc3-3004-4d9e-ab10-xxxxxx",
        "task_status": "SUCCEEDED",
        "submit_time": "2026-03-10 15:03:25.848",
        "scheduled_time": "2026-03-10 15:03:25.884",
        "end_time": "2026-03-10 15:04:05.882",
        "orig_prompt": "男人坐在靠窗的椅子上,手持吉他,在咖啡厅旁演奏一首舒缓的美国乡村民谣",
        "video_url": "https://media.pixverseai.cn/xxxx.mp4"
    },
    "usage": {
        "duration": 5,
        "size": "1280*720",
        "fps": 24,
        "video_count": 1,
        "audio": false,
        "SR": "720"
    }
}

错误码

如果模型调用失败并返回报错信息,请参见错误码进行解决。

常见问题

Q: prompt 效果不理想时,如何优化?

A: 可尝试使用 @ref_name 作为替代方案。
  • 默认做法:直接使用 prompt,模型会自动全局解析参考图内容,适用于大多数常规场景。
  • 替代方案:若发现生成效果偏离预期,可通过 @ref_name将参考图指定在提示词中,增强生成效果。

Q:如何使用ref_name?

A:ref_name 用于建立参考图与提示词的绑定关系。在 media数组中为图片设置 ref_name 后,prompt 中可通过 @ref_name语法引用对应的参考图主体。
  • 例如:media 中设置 "ref_name": "小猫",则 prompt 中使用@小猫来引用该主体。注意:@小猫后必须保留空格。
  • 示例:@小猫 和@小狗 在草地上玩耍。
文本生成
图像生成
3D模型生成
音频
Realtime API
  • 概述
向量与排序
模型生产