RAG-System für Ihr Firmenwissen: ein Index statt Ordnersuche
Handbücher, Angebote und gelöste Tickets werden zu einem Bestand, aus dem sich antworten lässt: zerlegt, mit Stand und Rechten versehen, laufend nachgezogen.
- 11+
- Unternehmen mit KI im Einsatz
- 2–6 Wochen
- bis zum ersten geprüften Index
- 100 %
- unserer Server stehen in Deutschland
Hallo! Ich bin der KI-Berater von SEODACH. Erzählen Sie kurz, wo es in Ihrem Unternehmen hakt, und ich skizziere Ihnen einen Plan.
- Ihre Quellen, nicht das Internet
Angebunden wird, was Sie heute schon pflegen: Dokumentenmanagement, SharePoint, Confluence, Netzlaufwerk, Ticketsystem.
- Rechte kommen aus den Quellen
Jeder Abschnitt trägt die Gruppen Ihres Verzeichnisdienstes mit. Gefiltert wird vor der Suche, nicht nachträglich am Ergebnis.
- Eine Fassung gilt, der Rest ist Archiv
Jeder Abschnitt kommt mit Stand und Verantwortlichem herein. Abgelöste Fassungen bleiben erhalten, werden aber nicht mehr gefunden.
Die Unterlagen sind vollständig. Beantworten lässt sich damit nichts.
Drei Fassungen, eine davon gilt
Die Preisliste liegt dreimal im Laufwerk: mit Jahreszahl, als „final“ und als „final_neu“. Wer etwas nachschaut, wählt nach Dateinamen – und merkt den Irrtum erst beim Kunden.
Die Suche kennt nur Ihre Wörter
Im Handbuch steht „Instandsetzungsintervall“, gefragt wird nach „Wartung“. Die Volltextsuche meldet null Treffer, obwohl der Absatz zwei Ordner weiter liegt.
Ein Index, der allen alles zeigt
Eine Suche über sämtliche Ordner macht Kalkulationen und Personalunterlagen für jeden sichtbar. Genau daran scheitern solche Vorhaben meist schon in der Vorbesprechung.
Was die Suche gar nicht liest
Prüfprotokolle als Scan, Preistabellen mit verbundenen Zellen, Zeichnungen mit Text im Bild: abgelegt sind sie, lesbar sind sie für kein Suchfeld. Dieser Teil des Bestands ist heute faktisch nicht vorhanden.
Was zu einer KI-Wissensdatenbank gehört
Sechs Bausteine am Bestand selbst. Fehlt einer, merkt man es nicht am Vorführtag, sondern im vierten Monat – wenn niemand den Antworten mehr traut.
Quellen anbinden
Dokumentenmanagement, SharePoint, Confluence, Netzlaufwerk, PDF-Handbücher, Angebote aus dem CRM und gelöste Tickets kommen über Schnittstelle oder regelmäßigen Export herein. Jede Quelle behält ihren Ort und ihren Pfleger.
Mehr erfahrenZerlegen und beschreiben
Lange Dokumente werden an inhaltlichen Grenzen in Abschnitte geteilt und nach ihrer Bedeutung hinterlegt. Eine Frage trifft dadurch auch dann, wenn sie andere Wörter benutzt als das Handbuch.
Mehr erfahrenLesbar machen vor dem Index
Scans bekommen eine Texterkennung, Tabellen eine Struktur, Zeichnungen eine Beschreibung. Was nicht als Text vorliegt, findet kein Index – diesen Schritt rechnen wir offen in den Umfang ein, statt ihn zu überspringen.
Mehr erfahrenRechte aus den Quellen mitführen
Jeder Abschnitt trägt die Gruppen, die das Quellsystem der Datei zuweist. Die Suche filtert damit, bevor ein Sprachmodell etwas zu sehen bekommt; ein nächtlicher Abgleich zieht Änderungen im Verzeichnisdienst nach.
Fassungen, Stand und Verfallsdaten
Gültig ist eine Fassung, ältere wandern ins Archiv. Unterlagen ohne Verantwortlichen bekommen ein Datum, zu dem sich jemand bekennen muss. Dokument, Abschnitt und Stand hängen am Abschnitt – aus ihnen entsteht die Quellenangabe, die der KI-Assistent später unter die Antwort setzt.
Mehr erfahrenSpirale statt Einmalaufbau
Neue und geänderte Dateien kommen laufend herein, Gelöschtes verschwindet, und der Prüfsatz läuft nach jedem Eingriff erneut. So bleibt sichtbar, ob eine Ergänzung den Bestand besser oder schlechter gemacht hat.
Eine Kundenfrage, zwei Wege zur Antwort
„Welche Garantie haben Sie uns auf diese Position im Angebot vom letzten Jahr zugesagt?“ Derselbe Weg einmal durch das Laufwerk und einmal durch den Index. Beschrieben ist der Weg, nicht die Ersparnis: wie viel Zeit er in Ihrem Haus kostet, hängt am Zustand Ihrer Ablagen.
Wer fragt, und wo erscheint die Fundstelle?
Diese Seite baut und pflegt den Bestand. Das Fragefenster für Ihr Team – Rückfrage, Entwurf, Quellenangabe unter der Antwort – ist der KI-Assistent: eine eigene Leistung, die auf dieser Wissensdatenbank aufsitzt.
Woran Sie ablesen, wie gut der Bestand trägt
Antwortqualität ist bei einem RAG-System messbar – vorausgesetzt, vor dem Aufbau steht fest, woran gemessen wird.
Prüfsatz aus echten Fragen
Vor dem Aufbau sammeln wir mit Ihren Fachleuten 50 bis 100 Fragen samt geprüfter Antwort. Dieser Satz ist die Messlatte des Bestands, und er gehört Ihnen – auch wenn Ihr Team den Betrieb später selbst übernimmt.
Zwei Zahlen statt Eindruck
Wie oft liegt die richtige Fundstelle unter den gefundenen Abschnitten, und wie oft passt die formulierte Antwort dazu. Beide Zahlen schreiben wir nach jedem Durchlauf fort, damit der Verlauf sichtbar ist und nicht nur der letzte Eindruck.
Jeder Eingriff wird nachgemessen
Eine andere Zerlegung, eine neue Quelle, eine ausgetauschte Fassung: Danach läuft der Prüfsatz erneut. So fällt auf, wenn eine Ergänzung für den Einkauf die Antworten für die Fertigung verschlechtert – vor dem Alltag, nicht nach drei Beschwerden.
Alter und Abdeckung des Bestands
Zwei weitere Angaben gehören in die Auswertung: welche Ablagen angebunden sind und welche noch nicht, und wie viele Abschnitte ein überschrittenes Verfallsdatum oder keinen Verantwortlichen haben. Diese Liste ist der Arbeitsvorrat für die nächste Runde.
Darf kein Satz das Haus verlassen?
Index, Suche und Sprachmodell lassen sich vollständig im eigenen Netz betreiben. Wir arbeiten auf eigenen Servern bei Hetzner in Deutschland und der EU oder auf Hardware in Ihrem Rechenzentrum; welche Bausteine ein eigener Betrieb braucht, steht auf der Seite zur lokalen KI.
Von der Quellenliste zum geprüften Index
Bestand aufnehmen
1 WocheWir nehmen auf, welche Ablagen es gibt, wie viele Dokumente darin liegen, in welchen Formaten sie vorliegen und wer sie öffnen darf. Erst diese Liste zeigt, was sich anbinden lässt und was vorher Texterkennung oder eine Entscheidung über die gültige Fassung braucht.
Aufbereiten, zerlegen, kennzeichnen
1–2 WochenDie ausgewählten Quellen kommen herein, werden in Abschnitte geteilt und mit Stand, Verantwortlichem und den Gruppen Ihres Verzeichnisdienstes versehen. Parallel entscheidet Ihr Fachbereich, welche Fassung gilt und was ins Archiv wandert.
Prüfsatz gegen den Index fahren
14 TageDer Fragensatz läuft gegen den fertigen Index. Sie sehen schriftlich, welche Fragen getroffen werden, welche Unterlagen fehlen und wo die Suche die falsche Stelle zieht. Die Nachliste entsteht aus diesem Durchlauf, nicht aus Vermutungen.
In die Pflegespirale übergeben
2–6 WochenDie Aktualisierung läuft von selbst, überschrittene Verfallsdaten melden sich, der Prüfsatz wiederholt sich nach jedem Eingriff. Übergeben wird mit Dokumentation: den Betrieb übernehmen wir, oder Ihr Team führt die Spirale weiter.
Welche Ablage gehört als erste in den Index?
Vier Fragen: welche Quellen Sie führen, wie viele Dokumente darin liegen und wer sie heute öffnen darf. Danach wissen Sie, mit welchem Bestand sich der Anfang lohnt – kostenfrei und unverbindlich.
Häufige Fragen zu RAG und KI-Wissensdatenbank
Was ist ein RAG-System und was unterscheidet es von einer Suche?
Eine Suche liefert Dokumente, ein RAG-System liefert eine Antwort. Es sucht zuerst die passenden Abschnitte in Ihren Unterlagen und lässt ein Sprachmodell daraus formulieren – mit Verweis auf die Fundstelle. Das Modell selbst wird dabei nicht verändert; die Wissensbasis liegt getrennt davon und bleibt Ihr Bestand. Die Begriffe im Detail erklärt unser Lexikonartikel zu RAG.
Welche Quellen können wir anbinden?
Dokumentenmanagement, SharePoint, Confluence, Netzlaufwerke, interne Wiki-Seiten, PDF-Handbücher, Angebote aus dem CRM und gelöste Tickets. Entscheidend ist nicht das Produkt, sondern ob es eine Schnittstelle oder einen regelmäßigen Export hat. Eingescannte Unterlagen ohne Texterkennung und Tabellen mit verbundenen Zellen brauchen einen Zwischenschritt – den rechnen wir offen in den Umfang ein.
Wie kommen unsere Zugriffsrechte in den Index?
Als Angabe an jedem einzelnen Abschnitt. Beim Einlesen übernehmen wir die Gruppen, die das Quellsystem der Datei zuweist, und die Suche filtert damit, bevor überhaupt etwas an das Sprachmodell geht. Ein nächtlicher Abgleich zieht Änderungen aus Ihrem Verzeichnisdienst nach. Ablagen, die ihre Rechte nicht über eine Schnittstelle herausgeben, bleiben vorerst draußen: geraten wird an dieser Stelle nicht.
Was passiert mit veralteten Fassungen?
Sie kommen entweder nicht in den Index oder werden als Archiv gekennzeichnet und von der Suche ausgeschlossen. Pro Thema gilt eine Fassung, sichtbar mit Stand und Verantwortlichem. Wo heute drei Versionen nebeneinanderliegen, entscheidet Ihr Fachbereich beim Aufbau, welche gilt. Diese Stunde Aufräumen ersetzt später viele Korrekturen.
Wie oft wird der Index aktualisiert?
Laufend. Angebundene Systeme melden Änderungen, der Index zieht neue und geänderte Dokumente nach und entfernt gelöschte. Bestände ohne Schnittstelle bekommen einen nächtlichen Abgleich. Ein neues Training des Sprachmodells ist dafür nicht nötig: Sie pflegen das Dokument, nicht die KI.
Woran messen wir, ob die Antworten gut sind?
An einem Prüfsatz aus 50 bis 100 echten Fragen mit geprüfter Antwort. Daraus entstehen zwei Zahlen: Wie oft liegt die richtige Fundstelle unter den Treffern, und wie oft stimmt die Antwort dazu. Beide werden nach jedem Eingriff in den Bestand neu erhoben. Welche Höhe sie bei Ihnen erreichen, hängt am Zustand Ihrer Unterlagen und steht nach dem ersten Durchlauf fest.
Woran liegt es, wenn eine Antwort daneben liegt?
Meist am Bestand, nicht am Sprachmodell: Ein Abschnitt wurde mitten in einer Tabelle getrennt, zwei Dokumente widersprechen sich, oder der Fachbegriff aus der Frage steht nirgends im Text. Solche Fälle macht der Prüfsatz sichtbar, und behoben werden sie dort, wo sie entstehen – andere Zerlegung, Synonyme hinterlegen, Fassung klären. Warum ein Sprachmodell trotzdem überzeugend klingt, beschreibt unser Beitrag zu Halluzinationen.
Das könnte Sie auch interessieren
Retrieval Augmented Generation in vier Schritten, mit Abgrenzung zum Fine-Tuning.
Woher erfundene Antworten kommen und was Firmenwissen daran ändert.
Das Fragefenster für Ihre Mitarbeiter, das auf dieser Wissensdatenbank aufsitzt.
Wenn die KI eine Stelle hat: Zuständigkeit, Befugnisse, nachvollziehbare Arbeit.
Scans, Rechnungen und Formulare zu Text machen, bevor sie in den Index gehen.
Schnittstellen zu den Systemen, in denen Ihre Unterlagen heute liegen.
Nennen Sie uns zwei Ablagen und eine Frage, die darin steckt
Im Erstgespräch gehen wir Ihre Quellenliste durch: was sich anbinden lässt, was vorher eine Texterkennung braucht, wie die Rechte mitkommen und wie der Prüfsatz aussieht, an dem Sie die Antwortqualität ablesen.
Das Erstgespräch ist kostenfrei und unverbindlich.
Lieber direkt sprechen? (0) 89 24 8853 444 WhatsApp