# 问答设置
知识上传成功后自动开始训练并解析知识,训练成功后可点击相关文档激活抽屉查看解析后的内容。
# 模型切换
# 基础模式
全局调整当下机器人所有问答匹配的相似度阈值。算法会对各个问答进行打分,当问答得分超出阈值时,则判定为精确命中并返回Top1结果(若精确命中,则不出问题推荐),否则,将返回得分最高结果、相似问题推荐或未命中回复。
相似问题推荐
启用相似问题推荐后,若当前用户没有精确命中意图,机器人将返回一定数量(自定义设置1~5)的推荐问题;相似度要求越高则需要问题相关性更强,当未匹配到相关问题则可能没有推荐结果返回。
# RAG模式
RAG模式提供「思考」与「快速」两种模型选择:
●思考模型:具备深度推理能力,回答更精准,适合需要详细分析的问题。
●快速模型:响应速度更快,适合简单、直接的常见问题。
# Agent模式
Agent 模式下可设置推理轮数,该参数控制模型自动推理轮数上限:
●极速:固定单次推理,LLM 消耗较低(固定两次),延迟短,适合大多数知识问答场景。
●自动:由模型根据问题复杂度自动判断推理与工具调用轮数,适合复杂问题。
选择「自动」模式时,模型会动态增加推理步骤,以获得更全面的回答,但响应时间和额度消耗也会相应增加。
# 用量与额度说明
文档问答公测期间,对AI整体调用总量设有如下限额:
| 限制 | 说明 |
|---|---|
| 额度 | 每月拥有 RAG模式和Agent模式共享1000次 AI调用额度(自启用之日起按自然月计算) |
| 超额影响 | 当月额度用尽后,用户提问将不再触发文档检索 |
| 消耗规则 | 仅在未被“问答”和“技能”召回,且可以检索到内容相关性时被消耗 |
# 使用建议
●在 【常用问答】 中预先配置高频问题,可以直接给出精准答案,既提升用户体验,也能有效节省 AI 调用额度。
●定期检查模型额度使用情况,避免在高峰期因额度耗尽导致服务中断。
●若LLM额度不够使用,可以申请扩容: LLM知识库问答配额申请说明
# 兜底回复
# 功能简介
为你的机器人设置兜底回复,当没有精确命中且没有匹配问题推荐时,则会返回固定回复。
# 配置步骤
在【配置】→【基础设置】【问答设置】→【(基础模式/RAG模式)兜底回复】中,点击编辑按钮配置您的兜底回复。
1.不回复
- 当用户输入的语句未能被机器人理解时,机器人将不会作出任何回复。
2.自定义
- 当用户输入未能匹配到任何问题时,机器人将返回您设定的固定内容。最多可以配置三条自定义回复。
3.闲聊
- 当用户输入无法匹配的内容时,机器人将触发系统预置的闲聊技能,以机器人昵称的身份与用户进行轻松对话。