Ga naar de inhoud

Vergelijking

RAG en fine tuning: wat is het verschil?

Het korte antwoord: bij RAG zoekt het systeem bij elke vraag eerst de relevante stukken uit je eigen documenten en geeft die mee aan het taalmodel. Het model zelf verandert niet. Bij fine tuning train je het model bij met honderden of duizenden voorbeelden, zodat het zich anders gaat gedragen. RAG is voor kennis: actuele informatie, productgegevens, handboeken. Fine tuning is voor gedrag: een vaste vorm, een eigen stijl of een heel specifieke taak. Voor bijna elk mkb-bedrijf is RAG de eerste en vaak de enige stap.

In het kort

  • RAG geeft het model bij elke vraag de juiste stukken uit je eigen documenten mee. Fine tuning verandert het model zelf.
  • Wil je dat AI jouw informatie gebruikt, kies RAG. Wil je dat AI zich op een vaste manier gedraagt, overweeg fine tuning.
  • RAG is sneller op te zetten, makkelijk bij te werken en laat zien waar een antwoord vandaan komt.
  • Fine tuning vraagt veel goede voorbeelden en is bij de grote aanbieders steeds minder beschikbaar.

RAG vs fine tuning in het kort

Vergelijk het met een nieuwe medewerker.

RAG is die medewerker een goed geordende kast met handboeken geven. Bij elke vraag pakt hij eerst de juiste map, leest de relevante pagina en antwoordt daarop. Verandert er iets, dan vervang je de pagina. RAG staat voor retrieval augmented generation: ophalen, en dan pas schrijven. De techniek werd in 2020 beschreven in een onderzoeksartikel van Patrick Lewis en collega's. Hoe het precies werkt, lees je in wat is RAG.

Fine tuning is die medewerker een cursus laten volgen tot hij het werk op een bepaalde manier gewend is. Hij weet het daarna uit zijn hoofd, maar als er iets verandert moet hij opnieuw op cursus. Je traint het model bij met voorbeelden van de vraag en het goede antwoord.

Het belangrijkste verschil: RAG verandert wat het model weet op het moment van de vraag, fine tuning verandert hoe het model zich gedraagt. Een model dat je bijtraint op je productcatalogus onthoudt die catalogus slecht en verzint er met stelligheid dingen bij. Kennis stop je daarom beter in RAG.

De verschillen naast elkaar

RAGFine tuning
Wat het doetZoekt relevante stukken en geeft ze mee bij de vraagTraint het model bij met voorbeelden
Goed voorKennis: producten, beleid, handboeken, dossiersGedrag: vaste vorm, toon, een specifieke taak
Wat je nodig hebtJe documenten, redelijk op ordeHonderden tot duizenden goede voorbeelden van vraag en antwoord
BijwerkenDocument vervangen, direct actueelOpnieuw trainen
BronvermeldingJa, het systeem weet uit welk document het antwoord komtNee
Verzinnen van feitenMinder, omdat het model de tekst voor zich heeftBlijft een risico
OpzettenDagen tot wekenWeken, vooral door het maken van de voorbeelden
Kosten per vraagIets hoger, want de gevonden tekst gaat mee als invoerKan lager, omdat de instructies korter worden
Toegang regelenPer gebruiker in te stellen welke documenten meedoenAlles wat in het model zit, is voor iedereen

*Laatst gecontroleerd: september 2026.*

Wanneer kies je RAG en wanneer fine tuning?

Voorbeeld uit het mkb: een technische groothandel

Een technische groothandel met 20.000 artikelen wil dat de binnendienst sneller antwoord geeft op vragen als welke pomp past bij deze installatie en wat de levertijd is. De informatie staat in productbladen, handleidingen en het voorraadsysteem.

De eerste gedachte is een eigen AI-model trainen op alle productbladen. Dat blijkt de verkeerde keuze:

De groothandel kiest RAG. De productbladen en handleidingen worden doorzoekbaar gemaakt, levertijden en voorraad komen live uit het voorraadsysteem. Bij elke vraag zoekt het systeem de relevante stukken, het taalmodel schrijft een antwoord met een verwijzing naar het productblad en een medewerker controleert het voor het naar de klant gaat.

Wel wil de groothandel dat elk antwoord dezelfde opbouw heeft. Dat lossen ze op met een instructie en drie voorbeelden, zonder fine tuning. Dit voorbeeld is samengesteld om de keuze uit te leggen en beschrijft geen bestaande klant.

Fine tuning in 2026: minder beschikbaar dan je denkt

Wie wil fine tunen, heeft minder keus dan een paar jaar geleden.

Wat bijtrainen kost, hangt af van het model en de hoeveelheid voorbeelden. De actuele tarieven staan op de prijspagina van Google Cloud.

De grote aanbieders zetten dus vooral in op betere modellen die je met instructies en je eigen documenten stuurt. Dat is precies waar RAG voor bedoeld is.

Wat kost RAG en wat kost fine tuning?

RAG kost vooral opzetwerk: documenten verzamelen, opschonen en doorzoekbaar maken, en de koppeling met je systemen. Daarna betaal je per vraag voor de extra invoertokens. Een rekenvoorbeeld: bij elke vraag gaan vijf stukken tekst van 500 tokens mee, samen 2.500 tokens. Met Claude Sonnet 5 à $2 per miljoen invoertokens is dat een halve cent per vraag, of ongeveer $50 per 10.000 vragen. Prijspeil september 2026. Rekenen met je eigen aantallen doe je met de token calculator.

Fine tuning kost vooral mensenwerk: het verzamelen, schrijven en controleren van honderden tot duizenden goede voorbeelden. Daar komen de trainingskosten bij, en bij de meeste aanbieders een hogere prijs per vraag voor het bijgetrainde model. Bij elke verandering begin je deels opnieuw.

Voor een mkb-bedrijf is RAG daardoor bijna altijd goedkoper, ook omdat je documenten toch al hebt en voorbeelden meestal niet.

Je eigen kennis veilig in een AI

Bij RAG gaan je eigen documenten door een AI. Dan wil je weten waar ze staan en wie erbij kan. Wij bouwen RAG-toepassingen die je documenten binnen Europa of op je eigen server houden en per gebruiker bepalen welke documenten meedoen. Dat doen we onder private AI. Een toepassing die klanten of medewerkers vragen laat stellen, is een AI-chatbot met RAG erachter.

Wil je eerst zien welke kant-en-klare tools er zijn, lees dan AI-tools voor bedrijven. Twijfel je of RAG of iets anders bij je vraag past, plan dan een strategiegesprek.

Veelgestelde vragen

Wat is het verschil tussen RAG en fine tuning?

Bij RAG zoekt het systeem bij elke vraag de relevante stukken uit je documenten en geeft die mee aan het model. Bij fine tuning train je het model zelf bij met voorbeelden. RAG is voor kennis, fine tuning voor gedrag.

Kan ik ChatGPT trainen op mijn eigen documenten?

Wat mensen daarmee meestal bedoelen, is RAG: het model krijgt je documenten mee bij de vraag. Dat werkt beter dan bijtrainen, want het model blijft actueel en kan laten zien waar een antwoord vandaan komt.

Is RAG veilig voor vertrouwelijke documenten?

Dat hangt af van de opzet. Met een zakelijk account, opslag in de EU of op een eigen server en toegangsrechten per gebruiker kan het veilig. Regel dit voordat de eerste documenten erin gaan.

Hoeveel voorbeelden heb ik nodig voor fine tuning?

Meestal honderden tot duizenden goede voorbeelden van vraag en antwoord. Het maken en controleren daarvan is vaak het meeste werk.

Verder lezen

Meer vergelijkingen

Bronnen

Geraadpleegd in september 2026.

  1. Lewis e.a., Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks (2020). arxiv.org
  2. OpenAI, Model optimization. developers.openai.com
  3. Google Cloud, Tune Gemini models. docs.cloud.google.com
  4. Amazon Bedrock, Supported models and Regions for fine-tuning. docs.aws.amazon.com
  5. Google Cloud, prijzen generatieve AI (ook voor bijtrainen). cloud.google.com
Terug naar de kennisbank

Je eigen kennis in een AI zetten?

In een strategiegesprek kijken we naar je documenten en je vragen en kiezen we de eenvoudigste aanpak die betrouwbaar werkt.