Wie die KI-Suche funktioniert

Die KI-Suche von WebSpeaker kombiniert moderne Verfahren der Sprachverarbeitung, um fundierte und kontextbezogene Antworten auf Besucherfragen zu liefern. Statt einfachem Keyword-Matching versteht das System die Bedeutung hinter einer Frage, ruft die relevantesten Inhalte aus Ihrer Wissensbasis ab und erzeugt daraus hilfreiche Antworten.

Semantische Suche und Keyword-Matching

Das Suchsystem nutzt einen hybriden Ansatz mit zwei ergänzenden Methoden. Semantische Suche verwendet Vektor-Embeddings, um die Bedeutung sowohl der Anfrage als auch Ihrer Inhalte zu erfassen. Dadurch kann das System relevante Inhalte finden, auch wenn Besucher ihre Frage anders formulieren als der entsprechende Text auf Ihrer Website. So kann zum Beispiel eine Frage nach „Preisplänen“ zu Inhalten über „Abonnementstufen“ führen, weil die zugrunde liegende Bedeutung ähnlich ist.

Keyword-Matching ergänzt die semantische Suche, indem exakte Begriffe und Phrasen ebenfalls berücksichtigt werden. Das ist besonders wichtig für Produktnamen, technische Begriffe und spezifische Kennungen, die wörtlich übereinstimmen sollen. Beide Methoden arbeiten zusammen: Semantik übernimmt das konzeptionelle Verständnis, Keyword-Matching sichert die Präzision bei konkreten Begriffen.

Die RAG-Pipeline

WebSpeaker verwendet eine Retrieval-Augmented-Generation-(RAG)-Pipeline, um Antworten zu erzeugen. RAG kombiniert Informationsabruf mit Textgenerierung durch ein Sprachmodell, sodass Antworten auf Ihren tatsächlichen Website-Inhalten basieren und nicht auf allgemeinem Trainingswissen des Modells. Die Pipeline arbeitet in mehreren Schritten:

  1. Benutzeranfrage — Ein Besucher stellt eine Frage im Widget. Das System verarbeitet die Anfrage und bereitet sie für den Abruf vor.

  2. Abruf — Das System durchsucht Ihre Wissensbasis mit semantischer Suche und Keyword-Matching, um die relevantesten Inhaltsabschnitte zu finden. Diese Abschnitte werden nach Relevanz sortiert und die besten Treffer ausgewählt.

  3. Kontextaufbau — Die abgerufenen Inhalte werden zu einem Kontextfenster zusammengeführt, das dem Sprachmodell die konkreten Informationen zur Beantwortung der Frage liefert. Dieser Kontext umfasst den extrahierten Text Ihrer Seiten sowie Metadaten wie Seitentitel und URLs.

  4. LLM-Generierung — Ein großes Sprachmodell erhält den aufgebauten Kontext zusammen mit der Besucherfrage und erstellt eine Antwort in natürlicher Sprache. Das Modell wird angewiesen, sich strikt auf den bereitgestellten Kontext zu stützen und Spekulationen zu vermeiden.

  5. Antwort mit Quellen — Die finale Antwort wird zusammen mit Quellenangaben angezeigt. Jede Quelle verlinkt auf die ursprüngliche Seite Ihrer Website, auf der die Information gefunden wurde. Besucher können die Antwort damit prüfen und bei Bedarf vertiefen.

Mehrstufiges Konversationsgedächtnis

Die KI-Suche behandelt nicht jede Besuchernachricht als isolierte Frage. Der Assistent verfolgt, was in der Konversation bereits gesagt wurde, und kann so Anschlussfragen verstehen, die sich auf den vorherigen Kontext beziehen. Fragt ein Besucher zum Beispiel zu einem bestimmten Thema und dann „Wie sieht es mit dem Preis dafür aus?”, versteht der Assistent, dass sich „dafür” auf das bereits Besprochene bezieht, statt dass die Frage vollständig wiederholt werden muss.

So können Besucher ein natürliches Gespräch führen: eine Frage stellen, eine Antwort erhalten und diese dann weiter eingrenzen oder eine verwandte Frage stellen, ohne dass der Kontext verloren geht.

Umfangreichere Quellmetadaten

Neben dem aus Ihren Seiten extrahierten Text erfasst die Inhaltsanalyse von WebSpeaker auch Metadaten zu jeder gecrawlten Seite - etwa welche Art von Seite es ist (zum Beispiel Dokumentation, eine Preisseite, eine Neuigkeit oder eine Kontaktseite) und welche Rolle sie innerhalb der Struktur Ihrer Website einnimmt (zum Beispiel eine allgemeine Übersichtsseite gegenüber einer spezifischeren Detailseite).

Der Assistent nutzt diese Metadaten zusammen mit semantischer Suche und Keyword-Matching, um zu beurteilen, welche gefundene Quelle am besten zur Frage eines Besuchers passt - zum Beispiel indem bei einer allgemeinen Frage eine breite Übersichtsseite bevorzugt wird oder bei einer engeren Frage eine spezifische Detailseite. Diese Metadaten wirken im Hintergrund; Besucher sehen weiterhin die bekannten Quellenlinks wie oben beschrieben, die nun mit diesem zusätzlichen Kontext ausgewählt werden.

Warum RAG wichtig ist

Der RAG-Ansatz macht die Antworten von WebSpeaker zuverlässig und vertrauenswürdig. Anders als ein allgemeiner Chatbot, der plausibel klingende, aber falsche Aussagen erzeugen kann, verankert WebSpeaker jede Antwort in Ihren realen Inhalten. Die Quellenangaben schaffen Transparenz und zeigen klar, woher die Information stammt. Das ist besonders wichtig für Bereiche, in denen Genauigkeit zählt, etwa Produktdokumentation, rechtliche Informationen oder technischer Support.

KI-Transparenz und menschliche Antworten

WebSpeaker unterscheidet klar zwischen KI-generierten Antworten und Nachrichten Ihres Support-Teams. So erkennen Besucher sofort, ob sie eine automatische Antwort auf Basis Ihrer Wissensbasis lesen oder eine Antwort von einem Menschen erhalten.

Wenn AI Search eine Frage beantwortet, zeigt das Widget an, dass die Antwort vom KI-Assistenten stammt. Falls verfügbar, werden außerdem Quellenlinks zu den Seiten angezeigt, die für die Antwort verwendet wurden. So können Besucher die Information leichter prüfen und direkt zur Originalseite wechseln.

Wenn Live Support antwortet, zeigt das Widget die Nachricht als Antwort eines menschlichen Support-Mitarbeiters. Dadurch ist der Übergang zwischen KI-Unterstützung und menschlicher Hilfe klar sichtbar, insbesondere wenn beide Funktionen im selben Widget aktiviert sind.

Diese Transparenz stärkt das Vertrauen. Besucher sehen schnell, ob sie mit KI oder mit einem Menschen interagieren, und Ihr Team kann AI Search für sofortige Antworten nutzen, während menschliche Unterstützung bei komplexeren Anliegen übernimmt.

Inhaltsqualität und Suchqualität

Die Qualität der KI-Suchergebnisse hängt direkt von der Qualität Ihrer gescrapten Inhalte ab. Saubere, gut strukturierte Inhalte liefern bessere Embeddings und präzisere Ergebnisse. Deshalb ist eine saubere Scraping-Konfiguration so wichtig: die richtigen Inhaltsbereiche erfassen, irrelevante Elemente ausschließen und die Wissensbasis aktuell halten.