RAGFlow 从入门到实践:开发者快速上手指南

RAGFlow 是一个基于对文档深入理解的开源 RAG(检索增强生成)引擎。当与 LLM 集成时,它能够提供真实的问答功能,并以来自各种复杂格式数据的有根据的引用为后盾。接下来将介绍RAGFlow快速上手指南,帮助大家更快入门该引擎。

一、配置LLM

RAGFlow 是一个 RAG 引擎,需要与 LLM 合作才能提供接地气、无幻觉的问答功能。RAGFlow 支持大多数主流 LLM。

在登陆页面进行注册登录后即可使用

要添加和配置 LLM,请执行以下作:

  1. 点击页面右上角的 logo > Model providers :

    每个 RAGFlow 帐户都可以免费使用 text-embedding-v2 ,这是通意-千文的嵌入模型。这就是为什么您可以在 Added models (添加的模型 ) 列表中看到 Tongyi-Qianwen 的原因。您可能需要稍后更新您的 Tongyi-Qianwen API 密钥。

  2. 单击所需的 LLM 并相应地更新 API 密钥(在本例中为 DeepSeek-V2):


    您添加的模型如下所示:

  3. 单击 System Model Settings 以选择默认模型:

    • 聊天模型 /
    • 嵌入模型 /
    • 图像到文本模型。

某些模型(例如图像到文本模型 qwen-vl-max )是特定 LLM 的子公司。您可能需要更新 API 密钥才能访问这些模型。

二、创建知识库

您可以将文件上传到 RAGFlow 中的知识库并将其解析为数据集。知识库实际上是数据集的集合。RAGFlow 中的问题解答可以基于特定知识库或多个知识库。RAGFlow 支持的文件格式包括文档(PDF、DOC、DOCX、TXT、MD)、表格(CSV、XLSX、XLS)、图片(JPEG、JPG、PNG、TIF、GIF)和幻灯片(PPT、PPTX)。

要创建您的第一个知识库:

  1. 单击页面顶部中间的 知识库 选项卡 > 创建知识库 。
  2. 输入知识库的名称,然后单击 OK 确认您的更改。
    您将转到知识库的 Configuration (配置 ) 页面。
  3. RAGFlow 提供了多个块模板,可满足不同的文档布局和文件格式。为您的知识库选择嵌入模型和块方法(模板)。

重要

选择嵌入模型并使用它来解析文件后,将不再允许您更改它。显而易见的原因是,我们必须确保特定知识库中的所有文件都使用相同的嵌入模型进行解析(确保它们在同一个嵌入空间中进行比较)。

您将转到知识库的 Dataset (数据集 ) 页面。

  1. 单击 + 添加文件 > 本地文件 以开始将特定文件上传到知识库。
  2. 在上传的文件入口中,单击 play 按钮开始文件解析:文件解析完成后,其解析状态将更改为 SUCCESS。

三、干预文件解析

RAGFlow 具有可见性和可解释性,允许您查看分块结果并在必要时进行干预。为此,请执行以下作:

  1. 单击完成文件解析的文件以查看分块结果:
    您将转到 Chunk 页面:
  2. 将鼠标悬停在每个快照上可快速查看每个数据块。
  3. 双击分块文本以添加关键字或在必要时进行手动更改:

注意

您可以向文件块添加关键字,以提高其在包含这些关键字的查询中的排名。此作会增加其关键词权重,并可以提高其在搜索列表中的位置。

  1. 在 Retrieval testing (检索测试) 中,在 Test text (测试文本 ) 中提出一个快速问题,以仔细检查您的配置是否有效:
    从下面可以看出,RAGFlow 以真实的引用作为回应。

四、设置文件解析

RAGFlow 中的对话基于特定知识库或多个知识库。创建知识库并完成文件解析后,您可以继续并开始 AI 对话。

  1. 单击法师顶部中间的 Chat 选项卡 > Create an assistant 以显示下一个对话的 Chat Configuration 对话框。

    RAGFlow 提供了为每个对话选择不同聊天模型的灵活性,同时允许您在 系统模型设置 .

  2. 更新 助手设置 :
    • 为您的助手命名并指定您的知识库。
    • 空响应:
      • 如果您希望将 RAGFlow 的答案限制在您的知识库中,请在此处留下回复。然后,当它没有检索到答案时,它会统一响应您在此处设置的内容。
      • 如果您希望 RAGFlow 在未从您的知识库中检索到答案时 即兴创作 ,请将其留空,这可能会导致幻觉。
  3. 更新 Prompt Engine 或将其保留为开头。
  4. Update Model Setting(更新模型设置 )。
  5. 现在,让我们开始演示:​​​​​​​

五、设置AI聊天

RAGFlow 中的对话基于特定知识库或多个知识库。创建知识库并完成文件解析后,您可以继续开始 AI 对话。

  1. 点击法师顶部中间的 Chat 选项卡 > Create an assistant 显示下一个对话的 Chat Configuration 对话框。

    RAGFlow 提供了为每个对话选择不同聊天模型的灵活性,同时允许您在 系统模型设置 .

  2. 更新 助手设置 :
    • 为您的助手命名并指定您的知识库。
    • 空响应:
      • 如果您希望将 RAGFlow 的答案限制在您的知识库中,请在此处留下回复。然后,当它没有检索到答案时,它会统一响应您在此处设置的内容。
      • 如果您希望 RAGFlow 在未从您的知识库中检索到答案时 即兴创作 ,请将其留空,这可能会导致幻觉。
  3. 更新 Prompt 引擎或将其保留为开头。
  4. 更新 Model 设置 。
  5. 现在,让我们开始演示:​​​​​​​

RAGFlow部署教程指南请点击RAGFlow本地部署教程进行参考

评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
红包 添加红包
表情包 插入表情
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值