现象
知识库搜索相关场景的引用返回上限存在不一致问题。简单模式、高级编排与搜索测试的可配置大小各不相同,且无法在配置文件中找到可修改对应参数的字段。模型设置的maxToken参数仅会影响上传与测试环节的上限,无法作用于引用上限。例如将maxToken设置为30000时,引入与测试的上限会同步调整为30000,但简单配置的引用上限仍为8000,高级编排的引用上限仍为3000,二者未发生变化。
可能原因
不同知识库搜索场景的引用上限由独立逻辑控制。搜索测试无模型限制,采用固定数值;简单配置与高级编排的引用上限分别固定为8000与3000,且不受模型maxToken参数影响。当前未提供公开配置项用于直接修改这些场景的引用返回长度。
排查步骤
- 确认当前使用的FastGPT版本,需按实际环境确认。
- 查看模型设置中的maxToken参数值,记录其对上传与测试上限的影响范围。
- 分别进入简单模式、高级编排、搜索测试三个场景,查看各自的引用上限数值,对比差异。
解决与验证
模型引用上限由quoteMaxToken参数控制。可通过配置该参数调整知识库搜索的引用返回长度。修改配置后,需验证以下内容:1. 确认maxToken参数的设置不再影响引用上限;2. 检查简单模式、高级编排、搜索测试三个场景的引用上限是否符合预期调整结果。需注意,搜索测试场景无模型限制,其固定数值的调整需按实际环境确认。