回答质量
Minaya 的设计理念是刻意保守:与其编造答案,不如坦承不知道。本页介绍 相关的防护机制,以及在答案出现两种方向偏差时应该如何处理。
依据原则
模型被要求只依据检索到的上下文作答,绝不推测,也绝不会因为某个相关 事物存在就推断出另一事物也存在。如果你的内容中没有提到某个产品或 服务,Minaya 就不会知道它的存在。
检索阈值
有两项检查决定一个问题是否被判定为可回答:
- 片段下限——低于相似度阈值的单个片段会被丢弃。
- 最佳匹配下限——最匹配的那个片段必须超过更高的门槛,否则该问题会被视为未覆盖。
第二项检查最为关键。如果没有它,一堆质量平庸的匹配结果看起来就像 证据,会诱使模型去填补空白。
两项阈值都可以按部署环境单独调整:
RETRIEVAL_SIMILARITY_THRESHOLD=0.25
RETRIEVAL_TOP_MATCH_THRESHOLD=0.3不同嵌入提供方之间的合理取值范围并不相同。OpenAI 和 Cloudflare 对同一对文本给出的评分并不一致,因此请根据你自己的日志来调优, 而不要直接照搬这些数值。
基于日志进行调优
每个问题都会记录检索到的结果:
Query: "do you ship to canada?" — 10 retrieved [0.593, 0.589, 0.586],
10 above 0.25, best=0.593 (needs >= 0.3) → answering from context如果合理的问题正被拒答,可以查看这些问题对应的 best= 取值,并将 RETRIEVAL_TOP_MATCH_THRESHOLD 调低到略低于 这些值聚集的区间。如果 Minaya 回答了不该回答的问题,则调高该阈值。
推荐问题
最多可设置四个一键提问选项,会显示在消息输入框上方,直到访客提出 自己的问题为止。请使用你最常回答的问题——它们能告诉访客 Minaya 是做什么用的,比一个空白的输入框更有用。
一旦对话开始,这些选项就会消失,并且已有历史记录的老访客永远不会 看到它们。
这一机制取代了此前的主题关键词方案——该方案会拒绝任何不包含 指定关键词的消息,这会误伤合理的问题——例如「我的订单什么时候 到?」并不包含明显的关键词,但显然属于相关问题。检索机制本身 已经会拒绝跑题的问题:当找不到相关内容时,会返回你设置的回退 消息。
回退消息
当一个问题未被覆盖时会显示此消息。请将它写成一种有帮助的引导,并 附上真实的联系方式:
Sorry, I don't have information about that. You can reach our team
at support@example.com and they'll be glad to help.过于生硬的回退消息会被自动柔化,以免小组件显得冷淡,但由你亲自 撰写一句更友好的话效果会更好。
常见问题
| 现象 | 可能原因 |
|---|---|
| 对于你明知存在的内容,回复「我没有这方面的信息」 | 该页面尚未被抓取,或内容是客户端渲染的。请检查片段数量,并参见抓取网站。 |
| 回答模糊笼统 | 检索匹配度较弱。请添加一个措辞贴近访客提问方式、内容聚焦的文本来源。 |
| 拒绝回答本应能回答的问题 | 阈值设置过高,或关键词范围过窄。 |
| 网站更新后答案变得过时 | 重新抓取该来源;片段不会自动刷新。 |