Inhalte hinzufügen

Alles, was Minaya beantworten kann, stammt aus Ihrer Wissensdatenbank. Es gibt drei Quellentypen, die Sie beliebig kombinieren können.

Quellentypen

TypAm besten geeignet fürHinweise
urlIhre Website, Dokumentation, Help CenterCrawlt verlinkte Seiten. Kann erneut an Ort und Stelle gecrawlt werden.
pdfHandbücher, Preislisten, BroschürenText wird extrahiert; gescannte Bilder ohne Textebene funktionieren nicht.
textRichtlinien, FAQs, alles noch nicht VeröffentlichteDirekt eingefügt. Schnellster Weg, eine bestimmte Antwort zu korrigieren.

Eine URL hinzufügen

Geben Sie eine Start-URL ein, und Minaya crawlt sie sowie die Seiten, auf die sie verlinkt. Siehe Eine Website crawlen für Tiefe, Limits und was übersprungen wird.

Ein PDF hochladen

Laden Sie die Datei hoch, und die Textebene wird extrahiert, in Abschnitte zerlegt und eingebettet. Ein durch das Scannen von Papier erzeugtes PDF hat keine Textebene — führen Sie zunächst eine OCR durch, oder fügen Sie den Inhalt stattdessen als Textquelle ein.

Text einfügen

Der direkteste Weg, eine falsche oder fehlende Antwort zu korrigieren. Fragen Besucher immer wieder etwas, das auf Ihrer Website nicht klar formuliert ist, fügen Sie einen kurzen, expliziten Hinweis ein:

Returns: 30 days from delivery, unworn, with the original packaging.
Refunds are issued to the original payment method within 5 working days.
Exchanges are handled by contacting support@example.com.

Formulieren Sie es so, wie eine Person danach fragen würde. Retrieval trifft Treffer nach Bedeutung, daher liefert eine Formulierung, die echten Fragen entspricht, zuverlässigere Ergebnisse.

Ingestion-Status

StatusBedeutung
pendingIn der Warteschlange, wartet auf den Worker.
processingWird abgerufen, in Abschnitte zerlegt und eingebettet.
readyJetzt durchsuchbar.
failedEtwas ist schiefgelaufen; der Fehler wird bei der Quelle angezeigt.

Bleibt der Status bei pending hängen? Der Ingestion-Worker ist ein von der API getrennter Prozess und muss laufen, damit eine Quelle verarbeitet werden kann.

Erneutes Crawlen

URL-Quellen verfügen über eine Schaltfläche Erneut crawlen. Sie löscht die gespeicherten Abschnitte und ruft die Website erneut ab — verwenden Sie sie, wenn sich Ihre Inhalte ändern. Die Abschnitte werden entfernt, bevor der neue Crawl beginnt, sodass es ein kurzes Zeitfenster ohne Antworten aus dieser Quelle gibt, statt Antworten aus veralteten Inhalten.

Text- und PDF-Quellen können nicht erneut gecrawlt werden; es gibt nichts Externes, das erneut abgerufen werden könnte. Löschen und erneut hinzufügen ist hier der richtige Weg.

Tariflimits

Jeder Tarif begrenzt, wie viele Quellen Sie vorhalten können. Das Entfernen einer Quelle löscht ihre Abschnitte sofort und gibt einen Platz frei.