图搜图工具使模型能够根据输入图片从互联网搜索视觉相似的图片,并基于搜索结果进行分析和推理,适用于以图找同款、视觉内容溯源等场景。
使用方式
图搜图功能通过 Responses API 调用。您需要在 tools 参数中添加 image_search 工具,并在 input 中以多模态格式传入图片。
input中必须包含图片内容,通过input_image类型传入图片 URL。可同时传入input_text类型的文本,为搜索提供补充说明。
支持的模型
推荐模型
为获得最佳工具调用效果,推荐使用以下模型:
千问Plus:Qwen3.7-Plus系列、Qwen3.6-Plus系列、Qwen3.5-Plus系列
千问Max:Qwen3.8-Max系列、qwen3.7-max-2026-06-08
qwen3.8-27b
其他模型
以下模型也支持此工具调用,但效果不如推荐模型。
- 千问Flash:Qwen3.8-Flash系列、Qwen3.7-Flash系列、Qwen3.6-Flash系列、Qwen3.5-Flash系列
快速开始
运行以下代码,通过 Responses API 调用图搜图工具,根据输入的图片搜索相似或相关图片。
需要已获取与配置 API Key并配置API Key到环境变量。
请将示例代码中的 image_url 替换为可公网访问的图片 URL。
流式输出
运行图搜图工具需要较长处理时间,建议启用流式输出,实时获取中间过程输出结果。
计费说明
计费涉及以下方面:
- 模型调用费用:图片搜索的结果信息会拼接到提示词中,增加模型的输入 Token,按照模型的标准价格计费。价格详情请参考百炼控制台。
- 工具调用费用:每1000次调用收费:华北2(北京)地域为48元,新加坡地域为58.713905元。
常见问题
Q:支持的图片格式有哪些?支持哪些图片传入方式?
A:请参见:图像与视频理解与文件传入方式。
OpenAI SDK 不支持本地路径传入。
Q:支持传入几张图片?
A:图片数量受模型最大输入长度限制:图片和文本的总 Token 数需小于模型支持的最大值。模型每次仅搜索一张图片,但可多次调用以处理多张。
搜索图片的数量由模型决策。