🍪Wir verwenden Cookies

Diese Website verwendet Cookies für grundlegende Funktionen sowie – mit Ihrer Einwilligung – für Analyse, Personalisierung und zielgerichtete Werbung. Sie können Ihre Auswahl jederzeit ändern oder alle Cookies akzeptieren.

CaptivateClick
  • Startseite/
  • Leistungen/
    Webagentur
    • WebdesignResponsive Websites, die konvertieren.
    • Corporate Design & BrandingMarkenidentität, Logo und visuelles System – unverwechselbar und konsistent, auch wenn Sie wachsen.
    • OnlineshopOnlineshops, die verkaufen.
    • Shopify-AgenturShopify-Shops, die verkaufen.
    • LandingpagesKampagnen- und Angebotsseiten.
    Leadgenerierung
    • Cold E-MailRechtskonforme B2B-Ansprache, die Gespräche startet.
    • LinkedIn-OutreachSocial Selling mit menschlicher Stimme.
    • TerminvereinbarungQualifizierte B2B-Termine in Ihrem Kalender.
    • NeukundengewinnungDie richtigen Unternehmen, Personen und Zeitpunkte.
    SEO
    • Technisches SEODamit Google die richtigen Seiten findet, versteht und indexiert.
    • Lokales SEOSichtbarkeit in Google Maps und vor Ort.
    • SEO-AnalyseSehen Sie, was Sie bremst und was zuerst zu beheben ist.
    • Bei Google gefunden werdenDamit Kunden Ihr Unternehmen finden.
    Werbeagentur
    • Google AdsGoogle Ads und SEA rund um kaufbereite Suchanfragen, qualifizierte Conversions und messbaren Umsatz.
    • Meta AdsFacebook- und Instagram-Kampagnen mit Creative-Tests, sauberen Signalen und profitabler Skalierung.
    • LinkedIn AdsB2B-Kampagnen mit Account-Targeting, Ansprache des Buying Centers und qualifizierter Pipeline.
    KI-Automatisierung
    • KI-AgentenAgenten, die die Arbeit erledigen.
    • SAP-IntegrationSAP mit Ihren Systemen verbunden.
    • HubSpot-AutomatisierungAutomatisierte HubSpot-Pipelines.
    • SystemintegrationSysteme, die dieselben Daten teilen.
    KI-Sichtbarkeit
    • Answer Engine OptimizationWerden Sie die Antwort, die KI zitiert.
    • GEO SEOPräsent in KI-generierten Antworten.
    • KI-Suche (Ratgeber)Ratgeber: Was KI-Suche ist und was sie bedeutet.
    Alle Leistungen ansehen
  • Referenzen/
    • Climentum CapitalWebdesignCase ansehen
    • Nordic Acceleration GroupWebdesignCase ansehen
    • NorthforkWebdesignCase ansehen
    • Hawkeye AdvertisingWebdesignCase ansehen
    Alla projekt
  • Über uns/
  • Blog/Was Ist Rag
  • Kontakt/
CaptivateClick

Navigation

  • Startseite
  • Leistungen
  • Referenzen
  • Über uns
  • Blog
  • Kontakt

Dienstleistungen

  • Webagentur
  • Leadgenerierung
  • SEO
  • Werbeagentur
  • KI-Automatisierung
  • KI-Sichtbarkeit

Webagentur

  • Webdesign
  • Corporate Design & Branding
  • Onlineshop
  • Shopify-Agentur
  • Landingpages

Leadgenerierung

  • Cold E-Mail
  • LinkedIn-Outreach
  • Terminvereinbarung
  • Neukundengewinnung

SEO

  • Technisches SEO
  • Lokales SEO
  • SEO-Analyse
  • Bei Google gefunden werden

Werbeagentur

  • Google Ads
  • Meta Ads
  • LinkedIn Ads

KI-Automatisierung

  • KI-Agenten
  • SAP-Integration
  • HubSpot-Automatisierung
  • Systemintegration

KI-Sichtbarkeit

  • Answer Engine Optimization
  • GEO SEO
  • KI-Suche (Ratgeber)
© 2026 CaptivateClick

Blog

Was ist RAG? So antwortet KI auf Basis Ihrer eigenen Unternehmensdaten

8. Oktober 20267 Min. Lesezeit
Frau mit Brille und senfgelbem Pullover greift in einer Bibliothek nach einem Buch im Regal

Auf dieser Seite

  • Was ist RAG?
  • Wie funktioniert RAG?
  • RAG, Fine-Tuning oder normales ChatGPT?
  • Wofür Unternehmen RAG nutzen
  • Drei Wege zu KI mit eigenen Daten
  • 1. Eingebaut in Microsoft 365
  • 2. Fertige Cloud-Bausteine
  • 3. Eigene RAG-Lösung, auch on-premise
  • RAG und DSGVO: was die Aufsichtsbehörden sagen
  • Typische Fehler bei RAG-Projekten
  • Häufige Fragen
  • Quellen

Kurz gesagt: RAG (Retrieval-Augmented Generation) ist ein Verfahren, bei dem eine KI zuerst in Ihren eigenen Dokumenten und Daten sucht und erst dann auf Basis der Fundstellen antwortet. So bekommt ein Unternehmen Antworten im Stil von ChatGPT zu eigenen Produkten, Preisen und Abläufen, mit Quellenangabe und ohne ein eigenes Modell zu trainieren. Über die Qualität entscheiden vor allem die Datenbasis und die Zugriffsrechte, weniger die Wahl des KI-Modells.

Das Wichtigste in Kürze

RAG arbeitet in drei Schritten: Inhalte werden durchsuchbar gemacht, bei jeder Frage werden die passendsten Textabschnitte abgerufen, und das Sprachmodell formuliert daraus die Antwort. Das ist günstiger als ein eigenes Training, und Wissen lässt sich laufend aktualisieren. Die deutschen Datenschutzaufsichtsbehörden haben im Oktober 2025 eine eigene Orientierungshilfe zu RAG veröffentlicht. Ihr Fazit: RAG kann falsche Ausgaben verringern und lässt sich mit bewährten Rechte- und Rollenkonzepten absichern, ersetzt aber keine Prüfung im Einzelfall.

Inhalt

  1. Was ist RAG?
  2. Wie funktioniert RAG?
  3. RAG, Fine-Tuning oder normales ChatGPT?
  4. Wofür Unternehmen RAG nutzen
  5. Drei Wege zu KI mit eigenen Daten
  6. RAG und DSGVO
  7. Typische Fehler

Was ist RAG?

RAG ist eine Methode, die einem Sprachmodell kurz vor der Antwort Wissen zur Verfügung stellt, das nicht in seinen Trainingsdaten steckt. Der Begriff geht auf eine Forschungsarbeit von Patrick Lewis und Kollegen aus dem Jahr 2020 zurück. Sie kombinierten ein Sprachmodell mit einer Suche in einer großen Textsammlung und erhielten spezifischere und faktentreuere Antworten als mit einem Modell, das nur auf sein antrainiertes Wissen zurückgreift (Lewis u. a., 2020).

Das Problem kennt jeder, der ChatGPT im Job ausprobiert hat: Das Modell weiß nichts über Ihr Unternehmen und erfindet im Zweifel Antworten, die plausibel klingen, aber falsch sind. AWS beschreibt RAG als Weg, das Modell vor der Antwort in einer verlässlichen Wissensbasis außerhalb seiner Trainingsdaten nachschlagen zu lassen, damit es aktuelle Quellen nutzt und sie benennen kann, ohne neu trainiert zu werden (AWS).

Wenn in Unternehmen von „KI mit eigenen Daten“, einem „Firmen-ChatGPT“ oder einer „eigenen KI“ die Rede ist, steckt technisch fast immer RAG dahinter.

Wie funktioniert RAG?

RAG funktioniert in drei Schritten: Indexieren, Abrufen, Antworten (AWS).

  1. Indexieren. Dokumente, Handbücher, Webseiten und Datenbankinhalte werden in kleinere Textabschnitte („Chunks“) zerlegt. Jeder Abschnitt wird in einen Zahlenvektor übersetzt, ein sogenanntes Embedding, das seine Bedeutung abbildet, und in einer Vektordatenbank gespeichert.
  2. Abrufen. Stellt jemand eine Frage, wird auch sie in ein Embedding übersetzt. Das System sucht die Abschnitte, die inhaltlich am nächsten liegen. Viele Lösungen kombinieren das mit einer klassischen Stichwortsuche.
  3. Antworten. Die gefundenen Abschnitte gehen zusammen mit der Frage an das Sprachmodell. Es formuliert die Antwort und kann angeben, auf welchen Dokumenten sie beruht.

Ändert sich ein Dokument, wird der Index aktualisiert, nicht das Modell. Deshalb eignet sich RAG für Wissen, das sich ändert, etwa Preislisten, Produktdaten oder interne Richtlinien. Die Dateisuche von OpenAI kombiniert zum Beispiel semantische Suche und Stichwortsuche und liefert Verweise auf die Quelldatei mit (OpenAI).

Die Datenschutzkonferenz (DSK) weist auf eine Grenze hin: Weil nur inhaltlich ähnliche Abschnitte abgerufen werden, können logisch zusammenhängende Informationen fehlen, wenn sie über lange Textpassagen verteilt sind (DSK). Wie Dokumente zerlegt werden, ist deshalb keine Nebensache.

RAG, Fine-Tuning oder normales ChatGPT?

RAG ist die richtige Wahl, wenn KI korrekt auf Basis Ihres eigenen, sich ändernden Wissens antworten soll. Fine-Tuning eignet sich eher, um einem Modell einen bestimmten Stil oder ein festes Format beizubringen. Das Fraunhofer-Institut IESE rät ausdrücklich davon ab, einem Sprachmodell per Fine-Tuning Wissen antrainieren zu wollen (Fraunhofer IESE).

Normales ChatGPTRAGFine-Tuning
Kennt Ihre DatenNein, nur was Sie einfügenJa, ruft sie bei jeder Frage abTeilweise, was im Training enthalten war
AktualisierungEntfälltDokumente aktualisierenNeues Training nötig
QuellenangabenNeinJaNein
ZugriffsrechteEntfälltKann Nutzerrechte berücksichtigenSchwierig, alles steckt im Modell
Am besten fürAllgemeine Aufgaben und TexteFragen zu Ihrem WissenFester Stil, Format oder Fachsprache

Wofür Unternehmen RAG nutzen

RAG bringt am meisten, wo Mitarbeitende oder Kunden häufig etwas fragen, das bereits irgendwo schriftlich steht. Typische Einsatzfälle:

  • Kundenservice. Ein Chatbot auf der Website, der aus FAQ, Produktdatenblättern und AGB antwortet. Mehr dazu unter KI im Kundenservice.
  • Interne Wissensdatenbank. Mitarbeitende fragen nach Mitarbeiterhandbuch, Prozessen oder früheren Projekten, statt sich durch Ordner zu klicken.
  • Vertrieb und Angebote. Der Vertrieb bekommt Antworten zu Produkten, Konditionen und früheren Angeboten sowie erste Entwürfe für neue Angebote. Siehe Angebotsautomatisierung.
  • Technischer Service. Servicetechniker schlagen unterwegs in Handbüchern und Fehlerprotokollen nach.
  • Dokumente und Verträge. Fragen an Verträge, Richtlinien und Archive, oft zusammen mit einem Dokumentenmanagement.
  • Daten aus ERP und CRM. Fragen an Auftrags- oder Kundendaten, angebunden über eine Systemintegration.

Drei Wege zu KI mit eigenen Daten

Es gibt drei Hauptwege: die eingebaute Lösung Ihrer Office-Umgebung, fertige Cloud-Bausteine oder eine eigens gebaute RAG-Lösung, die auch auf eigenen Servern laufen kann.

1. Eingebaut in Microsoft 365

Microsoft Copilot nutzt einen semantischen Index über die Daten Ihrer Organisation in Microsoft 365. Der Index wird automatisch erstellt, und Copilot zeigt nur Inhalte an, auf die die jeweilige Person ohnehin Zugriff hat. Laut Microsoft werden Prompts, Antworten und Daten aus dem Index nicht zum Training der zugrunde liegenden Sprachmodelle verwendet, und für Kunden innerhalb der EU-Datengrenze wird der Index in einem Rechenzentrum in der EU oder EFTA gespeichert (Microsoft Learn). Wer ohnehin in Microsoft 365 arbeitet, startet hier oft am einfachsten.

2. Fertige Cloud-Bausteine

Soll die KI Kunden auf der Website antworten oder Daten aus mehreren Systemen verbinden, baut man die Lösung mit den Bausteinen der großen Anbieter. OpenAI bietet eine fertige Dateisuche: Sie laden Dateien in einen Vektorspeicher, und das Modell durchsucht ihn selbstständig, bevor es antwortet (OpenAI). AWS bietet vergleichbare Dienste (AWS). Prüfen Sie dabei, wo die Daten verarbeitet werden, und schließen Sie einen Auftragsverarbeitungsvertrag ab.

3. Eigene RAG-Lösung, auch on-premise

Die DSK hebt hervor, dass RAG es oft ermöglicht, ein kleineres Sprachmodell einzusetzen, weil das Faktenwissen aus Ihren Dokumenten kommt. Das erweitert die Auswahl an Modellen, und unter Umständen kann das gesamte System on-premise betrieben werden, sodass keine personenbezogenen Daten an Online-Anbieter großer Sprachmodelle gehen (DSK). Häufig wird eine solche Lösung mit einem Automatisierungswerkzeug wie n8n verknüpft oder zu einem KI-Agenten ausgebaut, der auf Basis der Antworten auch handelt.

RAG und DSGVO: was die Aufsichtsbehörden sagen

Das Wichtigste bei KI mit eigenen Daten ist, zu steuern, was die KI sehen darf und wer welche Antworten bekommt. Das ist in Deutschland auch der größte Bremsklotz: 2025 nutzten 26 % der Unternehmen ab zehn Beschäftigten KI (Destatis). Von den Unternehmen, die KI erwogen, aber nicht eingeführt haben, nannten 60 % Bedenken beim Datenschutz und 44 % Probleme mit Verfügbarkeit oder Qualität der nötigen Daten (Destatis).

Die Datenschutzkonferenz hat im Oktober 2025 die „Orientierungshilfe zu datenschutzrechtlichen Besonderheiten generativer KI-Systeme mit RAG-Methode“ veröffentlicht (DSK). Die Kernaussagen für Unternehmen:

  • Richtigkeit: RAG kann falsche Ausgaben verringern, weil veraltete oder fehlerhafte Referenzdokumente gelöscht oder korrigiert werden können. Ganz ausschließen lassen sich falsche Antworten aber nicht.
  • Zugriffsrechte: In der Vektordatenbank und den Referenzdokumenten lassen sich bewährte Maßnahmen wie Mandantentrennung und ein Rechte- und Rollenkonzept umsetzen. Im Sprachmodell selbst geht das nicht.
  • Löschung: Einträge in der Vektordatenbank sind direkt adressierbar und damit gezielt löschbar. Das Problem der Löschung im Sprachmodell selbst bleibt bestehen.
  • Rechtsgrundlage: Auch ein RAG-System braucht eine Rechtsgrundlage, denn personenbezogene Daten aus den Dokumenten werden verarbeitet und gespeichert. Ein rechtswidrig trainiertes Modell wird durch RAG nicht rechtmäßig.

Dazu kommt die KI-Verordnung der EU: Wer einen Chatbot einsetzt, muss Menschen darüber informieren, dass sie mit einer Maschine sprechen. Die Transparenzpflichten gelten seit August 2026 (Europäische Kommission). Praktisch heißt das: Auftragsverarbeitungsvertrag mit dem Anbieter, klare Regeln, welche Daten in den Index dürfen, und ein sichtbarer Hinweis im Chatfenster.

Typische Fehler bei RAG-Projekten

Die meisten RAG-Projekte, die enttäuschen, scheitern an Daten und Tests, nicht am Modell.

  • Unaufgeräumte Daten. Alte Versionen, Dubletten und widersprüchliche Dokumente führen zu widersprüchlichen Antworten. Räumen Sie auf, bevor Sie indexieren.
  • Ungünstige Chunks. Zu große oder zu kleine Textabschnitte entscheiden darüber, ob die richtigen Passagen gefunden werden.
  • Keine Tests. Legen Sie 30 bis 50 echte Fragen mit den richtigen Antworten fest und testen Sie die Lösung bei jeder Änderung dagegen.
  • Keine Quellen in der Antwort. Zeigen Sie immer, auf welchem Dokument die Antwort beruht, damit Nutzer sie prüfen können.
  • Niemand verantwortet die Inhalte. Jemand muss dafür sorgen, dass die Dokumente aktuell bleiben, sonst veralten die Antworten schnell.

Was ein solches Projekt kostet, hängt vor allem von Datenmenge und Anzahl der angebundenen Systeme ab. Einen Überblick gibt unsere Seite zu den Kosten von KI-Automatisierung.

Soll Ihre KI mit Ihren eigenen Daten antworten?

Wir finden heraus, wo RAG bei Ihnen den größten Nutzen bringt, und bauen die Lösung so, dass sie Ihre Zugriffsrechte respektiert und aktuell bleibt.

Mehr zur KI-Automatisierung

Häufige Fragen

Was ist RAG?

RAG steht für Retrieval-Augmented Generation. Eine KI durchsucht zuerst eine Wissensbasis, etwa die Dokumente eines Unternehmens, und formuliert die Antwort dann auf Basis der Fundstellen. Das liefert genauere Antworten mit Quellenangabe, ohne dass ein eigenes Modell trainiert werden muss.

Wie funktioniert RAG?

In drei Schritten: Dokumente werden in Abschnitte zerlegt und als Embeddings in einer Vektordatenbank gespeichert. Bei einer Frage werden die inhaltlich passendsten Abschnitte abgerufen. Das Sprachmodell formuliert daraus die Antwort und kann die Quelle nennen.

Was ist der Unterschied zwischen RAG und Fine-Tuning?

RAG ruft Wissen bei jeder Frage aus Ihren Dokumenten ab, sodass Inhalte ohne neues Training aktualisiert werden können. Fine-Tuning verändert das Modell selbst und eignet sich eher für einen bestimmten Stil oder ein festes Format als für Wissen, das sich ändert.

Ist RAG DSGVO-konform?

RAG kann DSGVO-konform betrieben werden, wenn es eine Rechtsgrundlage gibt, die Lösung nur Daten zeigt, auf die Nutzer Zugriff haben, und ein Auftragsverarbeitungsvertrag mit dem Anbieter besteht. Die Datenschutzkonferenz hat dazu im Oktober 2025 eine eigene Orientierungshilfe veröffentlicht.

Kann man RAG on-premise betreiben?

Ja. Weil das Faktenwissen aus den eigenen Dokumenten kommt, reicht oft ein kleineres Sprachmodell. Laut Datenschutzkonferenz kann ein RAG-System dadurch unter Umständen vollständig on-premise laufen, ohne personenbezogene Daten an Online-Anbieter zu übertragen.

Wofür nutzen Unternehmen RAG?

Typisch sind Chatbots im Kundenservice, interne Wissensdatenbanken, Unterstützung im Vertrieb bei Angeboten, Nachschlagen in technischen Handbüchern und Fragen an Daten aus ERP- oder CRM-Systemen.

Quellen

  1. Orientierungshilfe zu datenschutzrechtlichen Besonderheiten generativer KI-Systeme mit RAG-Methode, Datenschutzkonferenz (DSK)
  2. Unternehmen mit Nutzung von Technologien der künstlichen Intelligenz, Statistisches Bundesamt (Destatis)
  3. Gründe gegen die Nutzung von Technologien der künstlichen Intelligenz, Statistisches Bundesamt (Destatis)
  4. Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks, Lewis u. a., arXiv
  5. What is RAG (Retrieval-Augmented Generation)?, AWS
  6. Retrieval Augmented Generation (RAG), Fraunhofer IESE
  7. File search, OpenAI
  8. Semantische Indizierung für Microsoft Copilot, Microsoft Learn
  9. AI Act, Europäische Kommission
ZurückERP-Schnittstelle: So verbinden Sie SAP, DATEV, Shop und CRM

Ähnliche Beiträge

  • Blog lesen

    Was ist n8n? Und n8n, Make oder Zapier für Ihr Unternehmen?

    8. Oktober 20266 Min. Lesezeit
    Mehr lesen
  • Blog lesen

    ERP-Schnittstelle: So verbinden Sie SAP, DATEV, Shop und CRM

    8. Oktober 20266 Min. Lesezeit
    Mehr lesen
  • Blog lesen

    Wie KI Unternehmen auswählt: So entscheiden ChatGPT, Gemini und Copilot, wen sie nennen

    8. Oktober 20266 Min. Lesezeit
    Mehr lesen
Lassen Sie uns startenLassen Sie uns starten

Bereit zu wachsen?

Sprechen wir über Ihr Projekt.

Über 110 Unternehmen vertrauen uns beim Online-Wachstum.

  • Mercer Consulting, Co.
  • Mercer Consulting, Co.