启动一个AI驱动的聊天
知识库、无幻觉聊天和文件管理是RAGFlow的三大支柱。RAGFlow中的聊天基于特定的知识库或多个知识库。一旦您创建了知识库并完成了文件解析,您就可以开始进行AI对话。
开始一个AI聊天
您通过创建一个助手来开始AI对话。
-
点击页面顶部中间的Chat标签>创建助手以显示聊天配置对话框用于您的下一个对话。
RAGFlow 为您提供了为每次对话选择不同聊天模型的灵活性,同时允许您在系统模型设置中设置默认模型。
-
更新助手设置:
- Assistant name 是您的聊天助手的名称。每个助手对应一个具有独特知识库、提示、混合搜索配置和大模型设置组合的对话。
- 空响应:
- 如果您希望将RAGFlow的答案限制在您的知识库中,请在此处留下响应。然后,当它没有检索到答案时,它会统一响应您在此处设置的内容。
- 如果您希望RAGFlow在未从您的知识库中检索到答案时即兴发挥,请留空,这可能会导致幻觉。
- 显示引用: 这是RAGFlow的一个关键特性,默认启用。RAGFlow不像一个黑盒子那样工作,而是清晰地展示其响应所基于的信息来源。
- 选择相应的知识库。您可以选择一个或多个知识库,但请确保它们使用相同的嵌入模型,否则会发生错误。
-
更新 Prompt Engine:
- 在系统中,您可以为您的LLM填写提示,您也可以在开始时保留默认提示不变。
- 相似度阈值 设置每个文本块的相似度“门槛”。默认值为0.2。相似度得分较低的文本块将被过滤掉,不会出现在最终响应中。
- 向量相似度权重 默认设置为0.3。RAGFlow使用混合评分系统,结合关键词相似度和向量相似度,用于评估不同文本块的相关性。此值设置了混合评分中向量相似度组件的权重。
- Top N 决定了提供给LLM的最大块数。换句话说,即使检索到更多的块,也只有前N个块作为输入提供。
- 变量:
-
更新 模型设置:
- 在模型中:您可以选择聊天模型。尽管您已经在系统模型设置中选择了默认的聊天模型,RAGFlow允许您为对话选择替代的聊天模型。
- 自由度 指的是LLM即兴发挥的程度。从 即兴、精确 到 平衡,每个自由度级别对应着 温度、Top P、存在惩罚 和 频率惩罚 的独特组合。
- 温度: 大语言模型预测随机性的水平。值越高,大语言模型越有创造力。
- Top P 也被称为“核采样”。更多信息请参见这里。
- 最大令牌数: LLM响应的最大长度。请注意,如果此值设置过低,响应可能会被截断。
-
现在,让我们开始表演:
更新现有聊天助手的设置
将鼠标悬停在目标聊天助手上 > 编辑 以显示聊天配置对话框:
将聊天功能集成到您的应用程序中
RAGFlow 还提供了 HTTP 和 Python API,以便您将 RAGFlow 的功能集成到您的应用程序中。阅读以下文档以获取更多信息: