表情包emoji-detect-v1是一个图像合规性检测模型,用于判断输入图像中的人物形象是否满足“表情包Emoji模型”的要求。检测通过后,该模型输出人脸区域及扩展后的动态表情区域坐标,供后续视频生成使用。
模型概览
模型名称 | 模型简介 |
|---|---|
emoji-detect-v1 | 检测输入的图像是否符合Emoji 视频生成所需要的图像规范。 |
输入图像要求
合规图像示例(检测通过)
图像要求 | 合规图像示例 |
|---|---|
| ![]() |
脸部区域附近露出手部 | 存在面部遮挡 | 存在夸张表情 | 头部倾斜角度过大 |
|---|---|---|---|
![]() | ![]() | ![]() | ![]() |
前提条件
您需要已获取与配置 API Key并配置API Key到环境变量。请将示例代码中的 DASHSCOPE_API_HOST 替换为获取的 API Host。
HTTP调用
POST https://dashscope.aliyuncs.com/api/v1/services/aigc/image2video/face-detect
请求参数请求头(Headers)Content-Typestring(必选)请求内容类型。此参数必须设置为application/json。Authorizationstring(必选)请求身份认证。接口使用阿里云百炼API Key进行身份认证。示例值:Bearer sk-xxxx。请求体(Request Body)modelstring (必选)模型名称。固定为emoji-detect-v1。input object (必选)输入的基本信息,如待检测图像。
属性 image_url string (必选)待检测图像的公网 URL。支持 HTTP 或 HTTPS 协议。本地文件可通过上传文件获取临时URL。图像限制:
object (必选)图像处理参数。
属性 ratio string (必选)待检测区域的长宽比。对于 Emoji 视频生成,此值固定为 1:1。示例值:1:1。 |
|
响应参数outputobject任务输出信息。
属性 bbox_face array of integer检测到的人脸区域坐标,格式为 [x1, y1, x2, y2],单位为像素,对应左上和右下两个点的坐标。仅在检测通过时返回。此值应作为Emoji 视频生成接口 input.face_bbox 参数的值。示例值:[212,194,460,441]。ext_bbox_face array of integer扩展后的动态表情区域坐标,格式为 [x1, y1, x2, y2],单位为像素,对应左上和右下两个点的坐标。仅在检测通过时返回。此值应作为Emoji 视频生成接口 input.ext_bbox 参数的值。示例值:[63,30,609,575]。codestring错误码。仅在检测不通过时返回,详情请参见错误码。messagestring错误信息。仅在检测不通过时返回,详情请参见错误码。string请求唯一标识。可用于请求明细溯源和问题排查。usage object输出信息统计。
属性 image_count integer本次请求检测图像数量,固定为 1 张,用于计费。无论检测是否通过,只要请求成功就计费;请求失败不计费。计费信息详见模型价格。 当图像因不合规而导致检测不通过时,本次API调用仍会正常计费,因为模型已经执行了完整的检测流程。 string请求失败的详细信息。请求成功时不会返回此参数,详情请参见错误码。request_idstring请求唯一标识。可用于请求明细溯源和问题排查。 |
请求成功且检测通过,将产生计费,接口会在响应中返回usage.image_count。请保存返回的 bbox_face 和 ext_bbox_face。这是下一步Emoji 视频生成接口中input.face_bbox和input.ext_bbox参数的值。 |




