Inhalte hinzufügen
Alles, was Minaya beantworten kann, stammt aus Ihrer Wissensdatenbank. Es gibt drei Quellentypen, die Sie beliebig kombinieren können.
Quellentypen
| Typ | Am besten geeignet für | Hinweise |
|---|---|---|
url | Ihre Website, Dokumentation, Help Center | Crawlt verlinkte Seiten. Kann erneut an Ort und Stelle gecrawlt werden. |
pdf | Handbücher, Preislisten, Broschüren | Text wird extrahiert; gescannte Bilder ohne Textebene funktionieren nicht. |
text | Richtlinien, FAQs, alles noch nicht Veröffentlichte | Direkt eingefügt. Schnellster Weg, eine bestimmte Antwort zu korrigieren. |
Eine URL hinzufügen
Geben Sie eine Start-URL ein, und Minaya crawlt sie sowie die Seiten, auf die sie verlinkt. Siehe Eine Website crawlen für Tiefe, Limits und was übersprungen wird.
Ein PDF hochladen
Laden Sie die Datei hoch, und die Textebene wird extrahiert, in Abschnitte zerlegt und eingebettet. Ein durch das Scannen von Papier erzeugtes PDF hat keine Textebene — führen Sie zunächst eine OCR durch, oder fügen Sie den Inhalt stattdessen als Textquelle ein.
Text einfügen
Der direkteste Weg, eine falsche oder fehlende Antwort zu korrigieren. Fragen Besucher immer wieder etwas, das auf Ihrer Website nicht klar formuliert ist, fügen Sie einen kurzen, expliziten Hinweis ein:
Returns: 30 days from delivery, unworn, with the original packaging.
Refunds are issued to the original payment method within 5 working days.
Exchanges are handled by contacting support@example.com.Formulieren Sie es so, wie eine Person danach fragen würde. Retrieval trifft Treffer nach Bedeutung, daher liefert eine Formulierung, die echten Fragen entspricht, zuverlässigere Ergebnisse.
Ingestion-Status
| Status | Bedeutung |
|---|---|
pending | In der Warteschlange, wartet auf den Worker. |
processing | Wird abgerufen, in Abschnitte zerlegt und eingebettet. |
ready | Jetzt durchsuchbar. |
failed | Etwas ist schiefgelaufen; der Fehler wird bei der Quelle angezeigt. |
Bleibt der Status bei
pendinghängen? Der Ingestion-Worker ist ein von der API getrennter Prozess und muss laufen, damit eine Quelle verarbeitet werden kann.
Erneutes Crawlen
URL-Quellen verfügen über eine Schaltfläche Erneut crawlen. Sie löscht die gespeicherten Abschnitte und ruft die Website erneut ab — verwenden Sie sie, wenn sich Ihre Inhalte ändern. Die Abschnitte werden entfernt, bevor der neue Crawl beginnt, sodass es ein kurzes Zeitfenster ohne Antworten aus dieser Quelle gibt, statt Antworten aus veralteten Inhalten.
Text- und PDF-Quellen können nicht erneut gecrawlt werden; es gibt nichts Externes, das erneut abgerufen werden könnte. Löschen und erneut hinzufügen ist hier der richtige Weg.
Tariflimits
Jeder Tarif begrenzt, wie viele Quellen Sie vorhalten können. Das Entfernen einer Quelle löscht ihre Abschnitte sofort und gibt einen Platz frei.