介绍百炼平台从阿里云 OSS 导入 LoRA 模型的全流程操作,涵盖首次 OSS 授权、模型文件准备、导入表单填写、导入模型管理与常见问题排查。
模型导入概述
本篇介绍将本地训练的 LoRA 模型从阿里云对象存储 OSS 导入到百炼平台的全流程,覆盖首次 OSS 授权、模型文件准备、导入表单填写、模型查看管理与删除,以及导入失败、已失效等常见问题排查。导入成功后即可部署服务,部署、扩缩容与下线操作详见部署运维,通过 API 完成部署与调用详见使用 API 进行模型部署,部署前置概念与计费方案对比详见模型部署简介,本篇与三者构成概念、导入、部署、调用的完整链路。
导入页基础模型字段由平台接口动态返回当前支持导入的基础模型清单,可能随版本更新,请以控制台可选列表为准。当前支持的基础模型如下:
当前支持的基础模型清单(点击展开)
当前支持的基础模型清单(点击展开)
模型系列 | 模型名称 |
|---|---|
千问3 | 千问3-32B |
千问3 | 千问3-14B |
千问3 | 千问3-8B |
千问3 | 千问3-4B-Instruct-2507 |
千问3-VL | 千问3-VL-8B-Instruct |
千问2.5 | 千问2.5-72B-Instruct |
千问2.5 | 千问2.5-32B-Instruct |
千问2.5 | 千问2.5-14B-Instruct |
千问2.5 | 千问2.5-7B-Instruct |
千问2.5-VL | 千问2.5-VL-72B-Instruct |
千问2.5-VL | 千问2.5-VL-7B-Instruct |
首次导入前完成 OSS 授权
首次从 OSS 导入模型前,须完成 OSS 服务关联角色授权,并为目标 Bucket 添加访问标签。授权通过导入页一键完成,授权后系统自动创建服务关联角色 AliyunServiceRoleForSFMDataHubOSSImport(服务名 datahub.sfm.aliyuncs.com,权限策略 AliyunServiceRolePolicyForSFMDataHubOSSImport),通常秒级生效。服务关联角色说明详见OSS 服务关联角色,主账号与子账号的概念与区别详见主账号与子账号。
在导入模型页的「导入来源」选择「从 OSS 导入」后,若未授权,OSS 字段区会提示「您还未授权OSS」并显示「前往授权」链接,确定按钮在未授权时不可用。主账号与子账号的授权路径不同,请按账号类型选择。
- 使用主账号
- 使用子账号
- 在导入模型页「导入来源」选择「从 OSS 导入」后,页面提示「您还未授权OSS」,在提示栏右侧点击「前往授权」。
- 在弹出的对话框中点击「立即授权」,系统自动创建服务关联角色 AliyunServiceRoleForSFMDataHubOSSImport,通常秒级生效,服务高峰期可能稍有延迟。
- 为目标 OSS Bucket 添加标签:访问 OSS 管理控制台的 Bucket 列表,找到目标 Bucket,悬停标签列图标并点击「前往编辑」→「创建标签」,添加标签名 bailian-datahub-access、标签值 read,保存。
- 返回导入模型页,重新选择目标 Bucket 再尝试导入。百炼不支持访问 Bucket 根目录下的文件,须选择 Bucket 下已有的子目录或新建子目录。
旧授权方式升级
若您此前使用的是旧授权方式,导入页 Bucket 字段下方会提示「建议转换为新的 Bucket 授权方式,提升安全性」并提供「直接转换」链接。点击后弹出确认框,确认即可升级为服务关联角色授权方式,升级不影响原有数据。
未开通 OSS 产品
若主账号尚未开通对象存储 OSS,导入页会提示「您还未开通OSS」并提供前往购买的链接。须由主账号前往 OSS 控制台开通 OSS 后返回导入页重新授权。
准备 LoRA 模型文件
导入前须将 LoRA 模型文件按以下要求存放在 OSS Bucket 的子目录中(不支持 Bucket 根目录),并在提交前通过系统的自动校验。模型文件须直接放在所选子目录下,系统会自动识别。
必需文件与目录结构
子目录中须包含以下文件:adapter_model.safetensors(LoRA 适配器权重,SafeTensors 格式)、adapter_config.json(含 rank、alpha 等参数的配置文件)、config.json(基础模型配置)。选中目录后系统会自动校验这些文件的格式与完整性。
训练参数约束
- rank 取值:rank 必须为 8、16、32 或 64 之一,且同一模型的所有 LoRA 层须使用相同的 rank 值,否则无法导入。
- 词汇表不可修改:训练中添加新 token 或修改原始词汇表的模型无法导入,须与基础模型词汇表完全一致。
- 对话模板不可修改:训练中修改 chat_template 的模型无法导入,须与基础模型默认配置一致。chat_template 位于 config.json 或 tokenizer_config.json 的 chat_template 字段。
- 视觉模型须冻结 VIT:视觉语言模型必须冻结 Vision Transformer 部分。若 LoRA 适配器中包含 visual 相关权重参数(即未冻结 VIT),该模型无法导入。
提交前自动校验
在导入页选中模型目录后,系统会自动调用文件校验接口检查目录下模型文件的格式与完整性。校验失败会在目录字段下方显示红标提示并阻断提交,须按提示修正文件后再提交。常见失败原因如缺少必需文件,对应错误码 AvailableModelFileNotFound。
导入 LoRA 模型
完成 OSS 授权并准备好模型文件后,在百炼控制台·我的模型页面点击右上角「导入模型」按钮进入创建页,按以下步骤完成导入。
- 在「我的模型」页面,点击右上角的「导入模型」按钮进入导入模型创建页。
- 按下方表格填写模型信息,其中基础模型须与 LoRA 训练时的基座一致,Bucket 须已添加 bailian-datahub-access=read 标签,模型目录选中后系统会自动校验文件。
- 确认信息无误后点击确定提交,系统自动验证文件格式和完整性,通过后开始导入;如需放弃点击取消返回列表页。导入后可在管理导入的模型查看状态。
字段 | 说明 | 约束 |
|---|---|---|
模型名称 | 输入模型的显示名称。 | 必填,最多 50 字符 |
基础模型 | 选择 LoRA 训练时的基座模型,须与训练基座一致。 | 必填,下拉选择 |
训练方式 | 可选项取决于所选基础模型,选择基础模型后自动渲染并默认选中第一项。 | 必填,下拉选择 |
导入来源 | 当前仅支持「从 OSS 导入」,无其他选项。 | 只读,默认选中 |
Bucket | 选择存放模型文件的 OSS Bucket,仅列出已添加 bailian-datahub-access=read 标签的 Bucket。 | 必填,下拉选择 |
模型目录 | 在选定 Bucket 中浏览并选择模型 Checkpoint 所在子目录,不支持选 Bucket 根目录。 | 必填,树形选择 |
模型加密 | 平台自动为导出的模型文件开启 OSS 服务端加密(SSE-OSS),使用 OSS 完全托管密钥,加密算法为 AES256。 | 只读,平台强制 |
管理导入的模型
导入提交后返回我的模型列表页,可查看与管理所有导入的模型。列表展示模型名称、模型 ID(附复制按钮)、基础模型、来源、支持部署方式、状态、创建时间与操作列,右上角提供导入模型入口与刷新按钮。
状态与流转
模型状态包括创建中、创建成功、创建失败和已失效。创建中表示正在导入;创建成功表示导入完成可部署;创建失败表示导入未成功;已失效表示创建成功后 OSS 源模型文件发生变更。列表对处于创建中状态的模型每 3 秒自动静默刷新,属正常行为,非接口异常。
创建失败状态旁附「详情」链接,悬停可查看失败错误码(如 AvailableModelFileNotFound)与对应的 oss://bucket/path 路径,用于定位失败文件。
已失效状态可悬停查看弹出框,展示「如下文件检测到更新」及发生变更的源文件名列表,提示须重新导入。
操作列可用性
- 部署:仅创建成功状态可点击,点击后跳转部署创建页,部署操作详见部署运维;其余状态或无可选部署方式时按钮不可用。
- 增量训练:从 OSS 导入的模型不支持增量训练,按钮不可用。
- 删除:创建中状态不可删除;量化模型须前往模型压缩界面删除。
常见问题
汇总导入过程中常见的问题与处理方式。
导入失败提示 AvailableModelFileNotFound 怎么办?
导入失败提示 AvailableModelFileNotFound 怎么办?
模型状态显示「已失效」是怎么回事?
模型状态显示「已失效」是怎么回事?
遇到「10041495」报错怎么办?
遇到「10041495」报错怎么办?
子账号授权 OSS 失败怎么办?
子账号授权 OSS 失败怎么办?
Bucket 下拉列表中目标 Bucket 不可选怎么办?
Bucket 下拉列表中目标 Bucket 不可选怎么办?
我的模型列表每隔几秒自动刷新是故障吗?
我的模型列表每隔几秒自动刷新是故障吗?
为什么导入的模型与本地使用 vLLM、SGLang 推理的效果不一致?
为什么导入的模型与本地使用 vLLM、SGLang 推理的效果不一致?
参数名称 | 推荐值(对应 vLLM 默认值) |
|---|---|
temperature | 取值范围 [0, 2),设置为 1.0 等同于 vLLM 引擎默认值。 |
top_p | 取值范围 (0, 1.0],设置为 1.0 等同于 vLLM 引擎默认值。 |
top_k | 取值为 None 或大于 100 时不启用 top_k 策略,仅 top_p 生效;设置为 99 不支持全采样,接近 vLLM 默认值 0(全采样)。 |
presence_penalty | 取值范围 [-2.0, 2.0],设置为 0 等同于 vLLM 引擎默认值。 |
repetition_penalty(DashScope 协议) | 提高可降低生成重复度,1.0 表示不惩罚;取值范围大于 0,设置为 1.0 等同于 vLLM 引擎默认值。 |
删除导入的模型会影响 OSS 中的源文件吗?
删除导入的模型会影响 OSS 中的源文件吗?