Mandantentrennung für RAG und Agenten
Ein Pilot läuft. Der Index ist einer. Der Prompt ist einer. Der zweite Kunde kommt. Plötzlich liegen zwei Akten im selben Raum. Ohne Mandantentrennung bleibt das ein Einzelkunde.
Was getrennt sein muss
Nicht nur die Oberfläche. Der Retrieval-Pfad:
Ein gemeinsamer Vektorraum mit Hoffnung auf Metadata-Filter ist der häufigste Fund. Der Filter fehlt einmal. Die Antwort zitiert den Nachbarn.
Zwei Bilder aus der Praxis
Der KI-Workspace für Lebensmitteltechnologen war von Anfang an multi-tenant. Sonst bleibt er ein Team-Pilot.
Die ÖPNV-Plattform hat 20+ Instanzen. Dort ist Trennung Betrieb, nicht Feature: Pipeline und Rollback pro Mandant. Dieselbe Idee gilt für RAG. Ein Index für alle ist das Swarm-Skript für alle.
Was der Check daraus macht
Tag 4 im LLM-Readiness-Check ist Betrieb, Kosten, Mandanten. Ein Pilot ohne Trennung ist kein Go-Live für den zweiten Kunden.
Verwandt: Hybrid-RAG, Evaluation. Leistung: KI-Engineering. Wer die Plattformseite sucht: Cloud und Kubernetes und das Migrations-Assessment.
Verwandte Artikel
Hybrid-RAG und Reranking statt naiver Vektorsuche
Chunking nach Zeichenzahl und reine Vektorsuche erzeugen erwartbare Halluzinationen. Was Hybrid-Suche und Reranking ändern, und was der ältere RAG-Artikel falsch lehrt.
Artikel lesenLLM-Halluzinationen sind ein Compliance-Problem
Wenn ein Modell Belege erfindet, stoppt Revision das Projekt. LLM Nachvollziehbarkeit braucht Quellenbindung, nicht einen besseren Prompt.
Artikel lesenTermin
30 Minuten. Wenn der Use-Case nicht in den Betrieb kann, sage ich das.