Skip to main content
Version: v0.15.1

启动一个AI驱动的聊天

知识库、无幻觉聊天和文件管理是RAGFlow的三大支柱。RAGFlow中的聊天基于特定的知识库或多个知识库。一旦您创建了知识库并完成了文件解析,您就可以开始进行AI对话。

开始一个AI聊天

您通过创建一个助手来开始AI对话。

  1. 点击页面顶部中间的Chat标签>创建助手以显示聊天配置对话框用于您的下一个对话

    RAGFlow 为您提供了为每次对话选择不同聊天模型的灵活性,同时允许您在系统模型设置中设置默认模型。

  2. 更新助手设置:

    • Assistant name 是您的聊天助手的名称。每个助手对应一个具有独特知识库、提示、混合搜索配置和大模型设置组合的对话。
    • 空响应:
      • 如果您希望将RAGFlow的答案限制在您的知识库中,请在此处留下响应。然后,当它没有检索到答案时,它会统一响应您在此处设置的内容。
      • 如果您希望RAGFlow在未从您的知识库中检索到答案时即兴发挥,请留空,这可能会导致幻觉。
    • 显示引用: 这是RAGFlow的一个关键特性,默认启用。RAGFlow不像一个黑盒子那样工作,而是清晰地展示其响应所基于的信息来源。
    • 选择相应的知识库。您可以选择一个或多个知识库,但请确保它们使用相同的嵌入模型,否则会发生错误。
  3. 更新 Prompt Engine:

    • 系统中,您可以为您的LLM填写提示,您也可以在开始时保留默认提示不变。
    • 相似度阈值 设置每个文本块的相似度“门槛”。默认值为0.2。相似度得分较低的文本块将被过滤掉,不会出现在最终响应中。
    • 向量相似度权重 默认设置为0.3。RAGFlow使用混合评分系统,结合关键词相似度和向量相似度,用于评估不同文本块的相关性。此值设置了混合评分中向量相似度组件的权重。
    • Top N 决定了提供给LLM的最大块数。换句话说,即使检索到更多的块,也只有前N个块作为输入提供。
    • 变量:
  4. 更新 模型设置:

    • 模型中:您可以选择聊天模型。尽管您已经在系统模型设置中选择了默认的聊天模型,RAGFlow允许您为对话选择替代的聊天模型。
    • 自由度 指的是LLM即兴发挥的程度。从 即兴精确平衡,每个自由度级别对应着 温度Top P存在惩罚频率惩罚 的独特组合。
    • 温度: 大语言模型预测随机性的水平。值越高,大语言模型越有创造力。
    • Top P 也被称为“核采样”。更多信息请参见这里
    • 最大令牌数: LLM响应的最大长度。请注意,如果此值设置过低,响应可能会被截断。
  5. 现在,让我们开始表演:

    question1

    question2

更新现有聊天助手的设置

将鼠标悬停在目标聊天助手上 > 编辑 以显示聊天配置对话框:

edit_chat

chat_config

将聊天功能集成到您的应用程序中

RAGFlow 还提供了 HTTP 和 Python API,以便您将 RAGFlow 的功能集成到您的应用程序中。阅读以下文档以获取更多信息: