Skip to main content
知识库(RAG)

知识库

知识库用于为大模型补充私有数据和最新信息。基于 RAG(检索增强生成)技术,大模型在生成回答前会先从知识库中检索相关内容,从而提升回答的准确性。

知识库功能仅能在中国站华北2(北京)地域开通和使用,其他地域如新加坡、德国(法兰克福)等均不支持知识库功能。

无专属知识库的应用

无专属知识库时,大模型无法准确回答特定领域的问题。

例如,用户在对话界面中发送"请你帮我挑选一款拍照效果最好的百炼手机,价格在 3000 元以内",AI 助手因缺乏相关知识库而无法给出准确的产品推荐。

有专属知识库的应用

引入专属知识库后,大模型可准确回答特定领域的问题。

有

支持的模型

以下模型支持使用知识库。配置千问使用知识库教程
预置模型(阿里云百炼支持的标准模型)自定义模型(在阿里云百炼调优后的模型)
  • 千问-QwQ/Long/Max/Plus/Turbo/Coder/Deep-Research
  • 千问VL-Max/Plus/Flash/OCR
  • 千问-开源版(Qwen3、Qwen2.5、Qwen2等)
  • 第三方文本生成模型(DeepSeek-R1、DeepSeek-V3.1、abab6.5s、Llama3.1、Yi-Large等)
指基于以下模型调优后的自定义模型。
  • 千问-Plus/Turbo
  • 千问VL-Max/Plus
  • 千问-开源版(Qwen3、Qwen2.5、Qwen2等)
上述列表随时可能更新。请以在 应用管理 页面创建应用时实际可选的模型为准。

工作原理

知识库支持对私有数据或文件进行语义检索,可找出语义相同或相近的内容,即使关键词匹配度极低甚至为零。 更多详细信息,请参见阿里云大模型ACA课程的检索增强生成

快速开始

本节介绍如何无需编写代码,快速构建一个能够回答特定领域问题(以"阿里云百炼手机"为例)的大模型问答应用。

1. 构建知识库

  1. 进入知识库,选择标准版旗舰版点击创建知识库
  2. 填写知识库名称知识库描述,其余设置保持默认,点击下一步
  3. 选择配置类目,上传阿里云百炼系列手机产品介绍.docx文件。点击下一步,然后点击完成

2. 集成到业务应用

知识库创建后,可将其关联至同一业务空间下的阿里云百炼应用或外部应用,以处理检索请求。
  • 集成到智能体应用
  • 集成到工作流应用
  • 集成到外部应用
  1. 进入应用管理页面,找到目标智能体应用,点击卡片上的配置,并为应用选择模型。
  2. 点击页面上文档知识库右侧的 + 按钮,添加上一步创建的知识库。相似度阈值和权重可保持默认。
    知识库采用语义检索,可在私有数据或文件中找出与查询意图相关、但关键词可能完全不同的文本。例如,用户查询:哪款阿里云手机适合拍照?实际答案(千问Vivid 7...)中并不包含查询中的任何关键词。
    下表中的关键词相似度基于 Jaccard 计算,语义相似度基于 text-embedding-v4 模型计算的 Cosine相似度

    召回文本

    关键词相似度

    语义相似度

    千问Vivid 7:智能摄影新体验

    0

    0.43

    阿里云百炼Ace Ultra:游戏玩家之选

    0.17

    0.32

    阿里云百炼Flex Fold+:折叠屏新纪元

    0.25

    0.24

    相似度阈值:仅语义相似度高于此阈值的文本才会被召回。阈值设置过高会导致相关文本被过滤丢弃。
    当智能体应用同时关联多个知识库时,可按信息源的重要程度为各知识库分配权重。多路召回时,若多个知识库召回的文本切片相似度相同,系统将优先返回权重更高的知识库中的文本切片
    • 关键限制:权重仅在同类型知识库之间生效。例如,文档搜索类知识库的权重不影响数据查询类知识库的召回顺序,反之亦然。
    • 工作原理:系统先计算用户问题与各知识库内容的相关度,筛选出最相关的文本切片,再将相似度分数与对应知识库的权重相乘,经加权重排后输出给大模型参考(加权得分越高,被采纳的可能性越大)。
  3. 在页面右侧的输入框中输入问题,大模型将基于所构建的知识库进行回答。
    例如:"请帮我挑选一款拍照效果最好的阿里云百炼手机,价格在3000元以内。"
分批生成策略:当需要智能体应用基于知识库批量生成大量内容(如题目、摘要)时,一次性请求可能因单次回复的输出长度受限而导致实际生成数量不足。建议将请求拆分为多批,每批约 30 条,通过多轮对话逐步完成。例如先发送"请根据知识库内容生成第 1-30 题",该批生成完成后再发送"请继续生成第 31-60 题"。实测参考:一次性请求 100 题实际仅生成约 24 题;改为每批 30 题、共 3 批后,每批均完整生成 30 题,合计 90 题。实际可生成数量随所选模型与内容长度变化,请以实际测试结果为准。

3. 优化知识库效果(可选)

若问答过程中出现知识召回不完整或内容不准确的情况,请参见知识库效果优化

操作指南

知识库页面,可查看和管理当前业务空间下的所有知识库。
知识库ID: 即每个知识库卡片上 ID 字段的值,用于API调用等场景。
  • 创建知识库
  • 更新知识库
  • 编辑知识库
  • 删除知识库
  • 变更配置
  • 命中测试
点击创建知识库后,首先选择知识库规格(标准版:0.03 元/小时,旗舰版:0.2 元/小时),然后按三步完成创建:填写基础信息并选择知识库类型、配置数据来源、设置索引参数。
  1. 知识库页面,点击创建知识库
  2. 填写基础信息 根据应用场景选择合适的知识库类型(单一知识库不支持同时选择多个类型)。选择文档搜索类型后,还需选择使用场景(基础文档问答、视觉理解(富文本文档)或极速问答):
    • 基础文档问答:适用于纯文本文档的语义检索。
    • 视觉理解(富文本文档):使用多模态向量模型对 PDF、图片等富文本文档进行视觉级理解和索引,保留原始版面信息。适合含有复杂排版、图表、公式的文档,支持文字、图片和图文组合三种命中测试模式。
    • 极速问答:针对检索速度进行优化,适合高度结构化或简单文档类型(如 FAQ、产品参数表等),提供极速低延时的问答体验。索引配置与基础文档问答一致,差异在于后端检索策略针对低延迟场景进行了专项优化。仅支持文本查询,不支持图片输入。
    选择视觉理解后,向量模型将自动切换为 qwen3 多模态向量(qwen3-vl-embedding),不可更改。
    创建后,知识库类型不可更改。
    • 文档搜索(检索场景)
      • 适用场景:
      • 选择连接器:选择指定数据连接器。如未创建数据连接器,请参阅数据连接
      • 数据来源:支持本地上传文件或从阿里云对象存储OSS导入。
        1. 选择数据:为知识库指定数据来源(文件或内容)。数据源内容将导入知识库,用于后续检索。支持本地上传云端导入(选择现有类目或文件)两种方式。
          • 本地上传:直接从本地电脑上传文件。展开下方折叠面板了解如何选择解析方式
            请根据实际需求配置解析策略,如不确定建议保持默认设置。有关文档智能解析大模型文档解析电子文档解析的详细说明,请参见文档理解
            • 电子文档解析:不支持解析文件中的插图与图表。解析速度最快,10~20 页纯文本文档通常在数秒至 1 分钟内完成。
            • 文档智能解析:对文件中的插图进行文本识别与提取,生成文本摘要。摘要将与其他非图片内容一同切分并向量化,参与知识库检索。解析速度较快,10~20 页含插图文档通常需要 1~5 分钟。
            • 大模型文档解析:使用千问VL模型的智能体应用支持对文件中插图和图表内容进行提问。如需识别和理解文件中的插图与图表,请选择大模型文档解析。因需调用大模型进行深度理解,10~20 页含图表文档通常需要 2~10 分钟。
            • Qwen VL解析:专用于图片文件。可指定千问VL模型并传入 Prompt,以指导对图片版面及元素的识别与提取。单张图片通常在数秒至 1 分钟内完成解析。
            • 音视频解析:对文件进行语音识别、视频帧提取(仅限视频)和剧情解析(仅限视频),将所有声画信息按时间轴结构化对齐。解析耗时与文件时长正相关,30 分钟音频约需 5~15 分钟,1 小时视频(含剧情解析)约需 15~60 分钟。
              • 语音识别:通过录音文件识别将语音转为文本。暂不支持识别音乐或自然环境声(如喇叭声、钟声、雷声等)。
              • 视频帧提取:从视频中抽取有代表性的画面,并生成对应的文本描述。
              • 剧情解析(需手动开启):分析视频内容,定位具体事件并标注时间戳,生成对应的文本描述。开启后会显著增加解析时间。
          • 云端导入:从阿里云百炼数据连接器或对象存储OSS导入已有文件。
        2. 索引配置:定义导入数据的处理和存储方式,直接影响检索效果。
          以下配置项中,仅"向量存储"选用 ADB-PG 时可能产生费用,其余配置均免费。
          • Meta信息抽取
          • Excel文件表头拼装
          • 切片方式
          • 多轮对话改写
          • 向量模型
          • 排序模型
          • 相似度阈值
          • 最大召回数量
          • 向量存储
          metadata(元数据)是与非结构化数据关联的一组附加属性,以 key-value 键值对的形式集成到文本切片中。
          • 作用:元数据为文本切片提供重要的上下文信息,可显著提升知识库检索的准确性。例如,知识库中包含上千个以产品名称命名的产品介绍文件。检索"A产品的功能概述"时,若所有文件正文都含有"功能概述"但均未提及"A产品",知识库可能召回大量无关文本切片。将产品名称作为元数据附加到所有文本切片后,知识库可精准过滤出与"A产品"相关且包含"功能概述"的切片,从而提高检索准确性,同时降低模型输入Token消耗。
          • 用法:通过API调用应用时,可在请求参数metadata_filter中指定metadata。应用检索知识库时,将先根据metadata筛选相关文件。
          • 注意:知识库一旦创建,无法再配置metadata抽取
          下方示例中,该文件所有文本切片的元数据包含 5 个自定义属性:date(文件中出现的所有年份)、reference(文件中出现的所有参考文献)、filename(文件名称)、keywords(文件中出现的关键词)以及author(文件作者信息)。开启Meta信息抽取,然后单击设置为该知识库中的所有文件附加统一或个性化的元数据。切分时,每个文件的元数据将集成到各自的文本切片中。
          取值方法说明:
          • 常量:为知识库中的所有文件附加固定属性。
            如上方示例所示,若知识库中所有文件的作者相同,可统一设置字段名为 author 的常量。
          • 变量:为知识库中的每个文件附加可变属性。目前支持file_namecat_name。选择file_name时,阿里云百炼将文件名称附加到其元数据中,如上方示例所示。选择cat_name时,阿里云百炼将文件所在类目的名称附加到文件元数据中。
          • 大模型:系统依据设定的实体描述规则,对知识库中每个文件的文本内容进行匹配,自动识别并提取相关信息,将其作为属性附加到文件元数据中。
            如上方示例的meta信息模板所示,如需提取每个文件中所有出现过的年份信息作为文件属性,可设置名为 date 的大模型字段,实体描述配置如下:
            实体描述输入框中填写日期信息,只提取年份,然后单击确定
          • 正则:系统依据设置的正则表达式,对知识库中每个文件的文本内容进行匹配,提取符合该表达式的内容,并将其作为属性添加到文件元数据中。
            如上方示例的meta信息模板所示,如需提取每个文件中所有出现过的参考资料(假设规律为:以"《"开头、以"》"结尾),可设置名为 reference 的正则字段,正则表达式配置如下:
            正则表达式的值设置为 《.*?》
          • 关键词搜索:系统在每个文件中查找预设的关键词,并将匹配到的关键词作为属性添加至文件元数据中。
            例如,在上述示例的meta信息模板中,预设的关键词为:
            融资,租赁,产业,汽车,钢铁,绿色,环保,资本,排放
            由于该文件中仅出现了"融资、产业、绿色、资本"这四个关键词,系统只提取了这四个关键词作为该文件 keywords 属性的值。
          是否参与检索:开启后,元数据字段和值将与文本切片内容一同参与知识库检索;关闭时,仅文本切片内容参与检索,元数据字段和值不参与。是否参与模型回复:开启后,元数据字段和值将与文本切片内容一同参与大模型的回答生成;关闭时,仅文本切片内容参与大模型回答生成,元数据字段和值不参与。
        选择视觉理解(富文本文档)使用场景后,知识库将使用多模态向量模型对文档进行视觉级理解,保留原始版面布局信息,而非采用传统的文本切片方式。

        文件格式限制

        在选择数据页签的文件上传区域,鼠标悬浮查看格式要求查看。

        索引配置差异

        视觉理解场景下的索引配置与基础文档问答不同:
        • 向量模型:自动选择 qwen3 多模态向量(qwen3-vl-embedding),创建后不可更改。
        • 多轮对话改写:可配置开启或关闭。
        • 相似度阈值:默认 0.20。
        • 最终召回最大数量:默认 5。
        • 切片方式:视觉理解不使用传统文本切片(智能切分/自定义切分等),而是基于视觉索引对文档整页进行理解。

        编辑限制

        • Embedding 模型(qwen3 多模态向量)和向量存储类型(内置)创建后不可更改。
        • 知识库规格变更每天仅支持一次。
    • 数据查询(Chatbot 或 NL2SQL 场景)
      • 适用场景:
        • 适合构建基于结构化数据(按预定义表结构组织的数据)的问答系统,例如 FAQ、商品数据、人员信息查询助手等。
        • 若数据为完整的 FAQ 问答对,请选择数据查询。例如,Excel 文件包含两列,分别为问题答案。数据查询类知识库支持将问题列用于知识库检索,答案列用于大模型回答参考。
          文档搜索类知识库无法实现此效果。
        • 支持导入单份xlsx、xls格式的文档,文件大小限制20MB以内。
      • 选择连接器:选择指定的数据连接器。如尚未创建数据连接器,请参阅数据连接
      • 数据源接入:支持本地上传 XLS 或 XLSX 文件,或从阿里云数据库RDS导入数据。
        image_urlvideo_urlaudio_url 为系统保留字段名(用于存储图片、视频、音频等多媒体资源)。导入的数据表(Excel 文件或 RDS 数据表)中请勿使用这三个名称作为列名(表头),否则会与系统保留字段冲突,导致数据无法正常导入、影响后续检索与问答。如现有数据表已使用上述列名,请先重命名对应列后再导入。
        1. 选择数据:为知识库指定数据来源(含文件或内容)。数据源内容将导入知识库,用于后续检索。支持本地上传云端导入(选择数据连接器中已有数据表)和从RDS导入三种方式。
          知识库创建后数据源不可更改,且单个知识库不支持同时使用多个数据源。
          • 本地上传:从本地计算机上传数据表(XLS 或 XLSX 格式,首行必须为表头)。
          • 云端导入(选择数据表):选择阿里云百炼数据连接器中的现有数据表。
          • 从RDS导入(关联数据库):数据表存储于阿里云RDS中。操作步骤请参见集成MySQL数据至知识库
        2. 索引配置:定义导入数据的处理和存储方式,直接影响检索效果。
          以下配置项中,仅"向量存储"选用 ADB-PG 时可能产生费用,其余配置均免费。
          • 是否参与检索/参与模型回复
          • 多轮对话改写
          • 向量模型
          • 排序模型
          • 相似度阈值
          • 最大召回数量
          • 向量存储
          • 是否参与检索:开启后,知识库将在该列数据中执行检索。
          • 是否参与模型回复:开启后,该列的检索结果将作为大模型生成回答的输入信息。示例配置:对"姓名"、"性别"、"岗位"、"年龄"列开启是否参与检索,仅对"姓名"和"岗位"列开启是否参与模型回复后,知识库将在所有列中执行检索,但仅将"姓名"和"岗位"两列的检索结果提供给大模型作为回答依据。 由于"年龄"列未开启参与模型回复,关联该知识库的大模型仍无法回答"张三的年龄"。
    • 图片问答(图搜场景)
      • 适用场景:
        • 适合构建以图搜图、以图搜"图文"的多模态检索应用,如商品导购助手、视觉问答助手等。
      • 选择连接器:选择指定的数据连接器。如尚未创建数据连接器,请参阅数据连接
      • 数据源接入:支持本地上传 XLS 或 XLSX 文件,或从阿里云数据库RDS导入数据。
        XLS、XLSX 文件 或RDS数据表 中需包含 公开可访问 的图片 URL,以便构建图片索引。详见下方创建说明。
        1. 选择数据:为知识库指定数据来源(含文件或内容)。数据源内容将导入知识库,用于后续检索。支持本地上传云端导入(选择数据连接器中已有数据表)和从RDS导入三种方式。
          知识库创建后数据源不可更改,且单个知识库不支持同时使用多个数据源。
          • 本地上传:从本地计算机上传数据表(XLS 或 XLSX 格式)。
            • 字段要求:数据表中至少需包含一个类型为image_url的字段,用于生成图片索引。
            • 构建过程:知识库将访问image_url字段中的图片 URL,提取视觉特征并转换为向量存储。
            • 检索过程:知识库将用户上传图片生成的向量与已存储的图片向量进行相似度比对,返回最相关的记录。
          • 云端导入(选择数据表):选择阿里云百炼应用数据中的现有数据表。
          • 从RDS导入(关联数据库):数据表存储于阿里云RDS中。操作步骤请参见集成MySQL数据至知识库
        2. 索引配置:定义导入数据的处理和存储方式,直接影响检索效果。
          以下配置项中,仅"向量存储"选用 ADB-PG 时可能产生费用,其余配置均免费。
          • 是否参与检索/参与模型回复
          • 多轮对话改写
          • 向量模型
          • 排序模型
          • 相似度阈值
          • 最大召回数量
          • 向量存储
          • 是否参与检索:开启后,知识库将在该列数据中执行检索。
          • 是否参与模型回复:开启后,该列的检索结果将作为大模型生成回答的输入信息。示例配置:对"姓名"、"性别"、"岗位"、"年龄"列开启是否参与检索,仅对"姓名"和"岗位"列开启是否参与模型回复后,知识库将在所有列中执行检索,但仅将"姓名"和"岗位"两列的检索结果提供给大模型作为回答依据。 由于"年龄"列未开启参与模型回复,关联该知识库的大模型仍无法回答"张三的年龄"。
    • 音视频搜索(音视频内容检索分析场景)
      • 适用场景:
        • 构建基于音视频内容的智能检索与问答应用,如直播回放问答、课程助教、客服质检等。
        • 基于多模态内容进行二次创作(根据文字需求从知识库检索音视频片段,生成脚本、字幕或剪辑建议)。
      • 选择连接器:选择指定的数据连接器。如尚未创建数据连接器,请参阅数据连接
      • 数据源接入:支持本地上传音视频文件,或从阿里云对象存储OSS导入。支持的音频格式:MP3、WAV、AAC、FLAC、OGG、M4A、WMA;支持的视频格式:MP4、AVI、MOV、MKV、FLV、WMV。
        1. 选择数据:为知识库指定数据来源(含音视频文件)。数据源内容将导入知识库,用于后续检索。支持本地上传云端导入(选择现有类目或已解析文件)两种方式。
          • 本地上传:从本地计算机上传音视频文件并进行解析。展开下方折叠面板,了解解析方式的具体选项。
            音视频解析:对文件执行语音识别、视频帧提取(仅限视频)和剧情解析(仅限视频),将全部声画信息按时间轴结构化对齐。解析耗时与文件时长正相关,30 分钟音频约需 5~15 分钟,1 小时视频(含剧情解析)约需 15~60 分钟。
            • 语音识别:字幕内容解析器通过录音文件识别将语音转为文本。暂不支持识别音乐或自然环境声(如喇叭声、钟声、雷声等)。
            • 视频帧提取:从原始视频中抽取代表性画面,并生成对应的文本描述。
            • 剧情解析(需手动开启):分析视频内容,定位具体事件并标注时间戳,同时生成相应的文本描述。开启后会显著增加解析时间。
          • 云端导入:从阿里云百炼数据连接器或对象存储OSS导入音视频文件并进行解析。
        2. 索引配置:定义导入音视频文件的处理和存储方式,直接影响检索效果。
          以下配置项中,仅"向量存储"选用 ADB-PG 时可能产生费用,其余配置均免费。
          • 切片方式
          • Meta信息抽取
          • 多轮对话改写
          • 向量模型
          • 排序模型
          • 相似度阈值
          • 最大召回数量
          • 向量存储
          系统先将音视频文件解析所得的文本切分为语义完整的文本切片,再通过向量模型将每个切片转换为向量,以键值对形式存入向量数据库。知识库创建完成后,可查看或编辑各文本切片的具体内容。
          • 智能切分:知识库先依据内置的分句标识符将文本序列拆分为若干段落,再根据段落生成文本切片。拆分和切分过程中,知识库会尽量保持语义完整,减少不必要的截断;但当文本切片的字符数超过最大分段长度时,将强制截断。
    使用场景可根据需求选择基础文档问答视觉理解(富文本文档)极速问答(适用于高度结构化或简单文档类型,任务明确,提供极低延迟的问答体验)。
在请求高峰时段,创建过程可能需要数小时(取决于数据量),请耐心等待。

重排(Rerank)配置

重排(Rerank)功能的开关位置取决于调用知识库的方式,配置错误可能导致排序功能未生效或产生非预期费用。
  • 旧版智能体应用、工作流应用 在应用页面,找到已挂载的知识库,单击其右侧的调试按钮,进入页面后对重排策略开关进行设置。
    应用内的配置优先级高于知识库本身的配置。
  • 新版智能体应用
    1. 在知识库卡片上,单击命中测试
    2. 选择排序模型处选择不使用模型
    3. 单击保存使配置生效。
新版智能体将知识库作为标准工具调用,配置以知识库自身设置为准
  • OpenAPI
    • 控制台:即您在知识库的编辑命中测试页面所做的配置。
    • API:相关参数设置,参阅检索知识库
    优先级:API参数设置优先级高于控制台页面配置。

日志与监控

知识库的检索调用日志、字段说明、SQL示例与监控边界,详见知识库日志与监控

配额与限制

  • 关于知识库支持的数据源与容量等信息,请参见知识库配额与限制
  • 单个阿里云百炼应用可关联的知识库数量:
    • 新版智能体应用(Agent 2.0):
      • 各类型知识库均可无限量关联。
    • 工作流应用 / 旧版智能体应用(Agent 1.0):
      • 文档搜索类:最多5
      • 数据查询类:最多5
      • 图片问答类:最多1
      • 音视频搜索类:最多5个(旧版智能体应用)/ 不支持(工作流应用)
      不同类型知识库可同时关联,总数最多为16个(旧版智能体应用)/11个(工作流应用)。

计费说明

知识库采用按量付费(后付费)模式,按小时统计各计费项用量并自动扣费。请保持阿里云账户余额充足(可前往费用与成本充值),避免因欠费导致服务中断。

计费项

说明

规格费用

标准版旗舰版 知识库的实际运行时长费用,价格详见知识库计费说明。变更配置时,按变更时间点分段计费

向量、排序模型调用费用

创建、更新或检索知识库时会调用向量(embedding)和排序(rerank)模型,按输入 Token 用量计费,价格以模型调用计费页为准。

账单查询:账单详情

API参考

常见问题

构建知识库

  • 文档搜索、音视频搜索类知识库:可以删除。数据连接器与知识库中的文件相互独立,删除数据连接器中的源文件不影响已导入知识库的文件。
  • 数据查询、图片问答类知识库:不可删除,否则会导致数据同步、查看知识库等功能异常。
错误码 BailianIndexServiceNotOpen 表示阿里云百炼知识库服务尚未激活。请登录百炼控制台,进入数据 > 知识库页面,点击立即开通按钮激活知识库服务后重试。

处理图片及多模态内容

  • 使用文档搜索类知识库
  • 使用图片问答类知识库
  1. 构建知识库时,知识库类型选择文档搜索,使用场景选择视觉理解(富文本文档)
    选择视觉理解(富文本文档)回复后,知识库将从文件插图中提取摘要,大模型根据摘要与问题的相关性自主决定是否插入图片。
  2. 创建或编辑智能体应用时,选择千问-Plus千问-Plus-Latest模型(经测试,两款模型效果最佳)。点击文档知识库右侧的+按钮,添加上一步构建的知识库。
  3. 实际问答效果:
    image
  1. 将图片上传至公网可访问位置并获取完整 URL。推荐使用 OSS,具体操作请参见将图片上传至OSS并使用其文件URL
  2. 在文件中插入完整 URL(不支持相对路径)。不支持直接在文档中嵌入图片文件(如通过复制粘贴或菜单插入本地图片),必须使用公网可访问的URL链接引用图片。
    若已按说明操作但图片仍无法显示,请检查文本切片中的URL是否完整,确认是否存在多余空格或特殊字符(可能被系统误解析),如有问题可直接编辑修正。
    文件正确引用图片示例提示词模板示例实际问答效果
    image
    # 知识库
    请记住以下材料,他们可能对回答问题有帮助。
    ${documents}
    
    # 要求
    如果有图片链接,则以markdown的格式完整显示出来。
    
    image
    文件错误引用图片示例提示词模板示例实际问答效果
    image
    # 知识库
    请记住以下材料,他们可能对回答问题有帮助。
    ${documents}
    
    # 要求
    如果有图片,请展示图片。
    
    在对话测试界面中,输入提示语后,AI 回复仅返回纯文本内容,未展示任何图片。解释:直接在文件中嵌入图片时,阿里云百炼应用不会在回答中展示该图片。

权限与安全

RAM 用户默认无法执行创建、更新、删除知识库等写操作,需由阿里云账号(主账号)为其授予管理员权限(或至少同时包含应用数据-操作知识库-操作权限)页面权限
知识库仅限其所在业务空间内的成员访问和操作,不对外公开。
阿里云严格保护数据隐私,不会将您的知识库用于回答其他用户的问题或模型训练。数据安全与隐私承诺详见合规资质与隐私说明

迁移与导出

当前不支持一键导出。您可调用ListChunks接口,编写脚本批量拉取文档和切片数据作为替代方案。

更多

长文本大模型(如 Qwen-Long)与 RAG 均可通过引入外部信息优化输出,但各有侧重。长文本大模型逐 Token 全量审视输入文本,在深度理解和长文本摘要方面通常更具优势,但计算和推理成本较高;RAG 通过跨源快速检索,只关注最相关的 Token,更适合无需全局理解、仅需整合最新信息片段即可快速作答的事实型问题场景。
不支持。百炼控制台仅支持查看切分后的文档切片内容(包括切片编号、字符数、切片标题和文本),不支持查看或导出切片对应的向量值(embedding 值)。
不可以。知识库创建后向量模型即固定,编辑知识库页面中该字段为只读,向量存储类型同样不可修改。如需使用其他向量模型,请删除现有知识库,并使用目标向量模型重新创建。
不支持。百炼没有自动训练或重新训练知识库的入口,知识库内容随源数据更新通过以下两种方式实现:
  • 手动上传:在上传数据页面通过上传文件导入本地文件,单次最多 50 个文件。源数据变更后需重新执行导入步骤。
  • 自动同步:配置对象存储 OSS 类型的数据连接器,监听 OSS 内的数据变动后自动同步更新至知识库;通过选择类目方式导入的数据同样支持自动同步。数据源为应用数据的知识库不支持自动同步,需手动重复导入步骤。

场景教程

通过阿里云百炼快速构建在线知识库问答应用,实现全天候(7 × 24)响应用户咨询,提升用户体验与业务竞争力:
Managed Agents
数据连接
Skill
应用评测
应用广场
权限管理