故障排查GitHub issue2 分钟阅读排错/错误码

解决FastGPT混合检索模式下知识库分类命中偏差问题

知识库内一般命令为1-20条,较重命令为21-41条,严重命令为42-50条。使用FastGPT混合检索模式时,提问"一般命令有哪些",预期返回1-20条一般命令内容,实际返回严重或较重违规的答案。

现象

知识库内一般命令为1-20条,较重命令为21-41条,严重命令为42-50条。使用FastGPT混合检索模式时,提问"一般命令有哪些",预期返回1-20条一般命令内容,实际返回严重或较重违规的答案。单独使用语义检索可检索到"一般XX"相关内容,但无法检索到"严重XX"相关内容;开启混合检索模式后,"一般"相关内容无法被检索到。

可能原因

AI生成结果基于概率逻辑,未绑定明确的分类匹配规则。混合检索的匹配逻辑存在偏差,导致分类命中不符合预期。提示词未明确指定分类匹配标准,无法引导模型精准匹配对应分类内容。

排查步骤

  1. 确认当前使用的检索模式为混合检索模式。
  2. 测试单独开启语义检索、关键词检索,分别查看对应分类内容的命中结果,对比混合检索的表现。
  3. 检查知识库中分类标签的标注是否清晰规范。
  4. 检查当前使用的提示词是否包含明确的分类匹配规则说明。

解决与验证

调整提示词,明确告知模型按分类标准回答问题,指定匹配规则。结合代码逻辑与AI检索,优化检索与生成流程。需按实际环境确认检索权重配置。验证时,提问对应分类的问题,检查返回内容是否符合预期分类结果。

来源: FastGPT GitHub issue #1996