添加内容
Minaya 能够回答的一切内容,都来自你的知识库。共有三种内容来源类型, 并且可以自由混合使用。
内容来源类型
| 类型 | 适用场景 | 说明 |
|---|---|---|
url | 你的网站、文档、帮助中心 | 抓取所链接的页面。可以原地重新抓取。 |
pdf | 手册、价目表、宣传册 | 会提取其中的文本;没有文本层的扫描图片将无法使用。 |
text | 政策、FAQ,以及任何尚未发布的内容 | 直接粘贴。是纠正某个具体答案最快的方式。 |
添加 URL
输入一个起始 URL,Minaya 会抓取该页面以及它所链接的页面。深度、限制 以及会被跳过的内容,参见抓取网站。
上传 PDF
上传文件后,其文本层会被提取、分块并嵌入。由扫描纸质文档生成的 PDF 没有文本层——请先进行 OCR 识别,或者改为将内容作为文本来源粘贴。
粘贴文本
这是修正错误或缺失答案最直接的方式。如果访客总是询问你网站上没有 明确说明的内容,可以粘贴一段简短、明确的说明:
Returns: 30 days from delivery, unworn, with the original packaging.
Refunds are issued to the original payment method within 5 working days.
Exchanges are handled by contacting support@example.com.请按照真实提问的方式来撰写。检索是基于语义进行匹配的,因此措辞越 贴近真实问题,检索结果就越可靠。
摄取状态
| 状态 | 含义 |
|---|---|
pending | 已排队,等待工作进程处理。 |
processing | 正在抓取、分块并嵌入。 |
ready | 现已可被检索。 |
failed | 出现了问题;错误信息会显示在该来源上。 |
一直停留在
pending?摄取工作进程是与 API 分离的独立 进程,必须处于运行状态,任何来源才能被处理。
重新抓取
URL 类型的来源带有一个重新抓取按钮。它会删除已存储 的片段,并重新抓取该站点——当你的内容发生变化时可以使用它。片段会在 新一轮抓取开始前先被移除,因此会有一小段时间该来源没有答案可用, 而不是使用过时的内容作答。
文本和 PDF 类型的来源无法重新抓取,因为没有远程内容可供重新获取。 请改为删除后重新添加。
套餐限制
每个套餐都限定了你可以保留的内容来源数量。删除一个来源会立即删除 其片段并释放一个名额。