适用场景与历史记录
原议题请求识别用户是否上传图片或使用语音输入,以便选择不同模型和提示词。 原始讨论提交于 2024-06-18,本页按该记录说明症状或需求的适用范围。
已有证据与适用范围
当前文件输入文档区分图片、音频、视频与文档,语音配置也提供自动语音回复。文件类型与录音来源标记的支持范围应逐项验证。
排查与复测
- 先确定需要区分的是附件媒体类型,还是麦克风录音这一输入方式。
- 分别上传图片、音频和文档,核对工作流实际收到的文件类型与 URL。
- 选择对应多模态模型并开启识别能力;语音回复场景核对语音输入和播报配置。
这些检查用于复现和验证同类场景。继续反馈时,提供准确版本、最小输入、预期结果和脱敏日志,并引用原始讨论。
参考资料
来源: FastGPT 语音输入