Hvad er RAG (Retrieval-Augmented Generation)?
RAG (Retrieval-Augmented Generation) er en metode, hvor en sprogmodel først henter relevant information fra jeres egne kilder (dokumenter, database, CRM, sagssystem) og derefter formulerer svaret ud fra det fundne. Modellen gætter altså ikke ud fra generel træningsviden alene; den bygger svaret på det materiale, I har givet den adgang til. Det er grundlaget for de fleste seriøse AI-assistenter og chatbots i virksomheder.
RAG løser to problemer på én gang
Uden RAG har I enten en model, der lyder klog men kan finde på fakta, eller en statisk FAQ, der aldrig er opdateret. RAG kombinerer sprogforståelse med jeres aktuelle viden: brugeren stiller et spørgsmål, systemet finder de relevante passager, modellen sammenfatter og svarer med reference til kilden.
Vi ser ofte RAG-projekter fejle på det, der sker før modellen: dokumenterne ligger spredt, er forældede, eller er skrevet i et sprog og et format, som søgningen ikke rammer. Teknikken er moden; forberedelsen af kildematerialet er det langsomme.
De tre lag, der skal fungere sammen
- Indhold: hvilke dokumenter og data er tilladt som kilde, og hvem vedligeholder dem?
- Søgning: hvordan findes de rigtige passager (embeddings, semantisk søgning, filtrering på adgang)?
- Svar: hvordan formuleres output, og hvornår eskaleres til et menneske?
Zignifikant byggede et internt AI-værktøj på egne data i stedet for en generisk chatbot uden kobling. Kunden opgjorde selv besparelsen til cirka 50 timers manuelt arbejde hvert kvartal, fordi svarene kom fra deres faktiske grundlag, ikke fra modellens gæt. Det er RAG i praksis: ikke magi, men søgning plus formulering på jeres materiale.
Start med ét domæne og mål fejlprocenten
Vælg én dokumenttype eller én afdeling, hvor folk i dag leder og læser manuelt. Indlæs de vigtigste kilder, test 50 rigtige spørgsmål, og mål hvor ofte svaret er korrekt og kan verificeres. Udvid først, når hallucinationskontrollen holder. Se hvordan vi bygger dokumenthåndtering og RAG i drift.