No. 07 · Manuscript compleet · AI & agents · GRAIN
De RAG-Engineer
Retrieval-systemen waar agents in productie echt op kunnen vertrouwen
Je RAG-demo werkt. In productie breekt het.
Een PDF embedden is een demo; productie overleven is engineering. De RAG-Engineer brengt je voorbij de tutorials naar de faalmodi die retrieval echt breken — chunking, versheid, reranking, grounding en stille drift — met een protocol voor pijplijnen waar agents op kunnen bouwen.
- pagina's
- 490
- hoofdstukken
- 15
- uur lezen
- ± 6
- edities
- EN · NL
- Ontwerp
- Schrijven
- Manuscript
- Productie
- Verschenen
Het boek
Retrieval-systemen waar agents in productie echt op kunnen vertrouwen
In de demo werkte het ophalen perfect. Toen kwam productie: de gebruiker stelde dezelfde vraag op drie manieren, de embeddings haalden hun schouders op, en je agent citeerde een passage die met volle overtuiging het tegendeel van de waarheid beweerde. Nu debug je een black box, één fout antwoord tegelijk, en het deel van de stack dat je het minst vertrouwt is precies het deel waarop het hele product steunt.
De reflex is: wissel het embeddingmodel, verhoog top-k, hak in kleinere stukken. Dat sleutelt aan het symptoom en levert de ziekte op: één gelijkenisscore ging je nooit vertellen of een passage relevant, recent of juist is.
The RAG Engineer behandelt retrieval als een engineeringdiscipline, niet als gevoel. Het reikt je GRAIN aan (Grounding, Retrieval, Augmentation, Indexing en Negative-feedback response), vijf fasen die een broze vectorzoekopdracht veranderen in een pijplijn die je kunt meten, verdedigen en die je een agent durft te laten aanroepen zonder dat een mens elk resultaat naleest.
Wat je leert
Wat je met dit boek kunt
- Het GRAIN-protocol: Gather, Rank, Assemble, Inspect, Navigate
- Los chunking, versheid, hybride zoeken, reranking en grounding op
- Retrieval-pijplijnen die agents in productie vertrouwen
Het raamwerk
GRAIN, stap voor stap
Gather, Rank, Assemble, Inspect, Navigate
-
Gather
Bronkeuze, rechten, versionering en het corpuscontract dat bepaalt wat in de index hoort.
-
Rank
Eerste-fase retrieval (dense, sparse of hybride), daarna een reranker die kandidaten ordent vóór assemblage.
-
Assemble
Tokenbudget, chunkvolgorde, deduplicatie, instructielayout en citaties die bewijs bruikbaar houden.
-
Inspect
Failure traces, bad-chunk workflows en eval-suites die een fout antwoord koppelen aan een retrievalbeslissing.
-
Navigate
TTL-beleid, re-ingest jobs, change detection en signalen die tonen hoe oud een antwoord kan zijn.
De inhoud
Hoofdstuk voor hoofdstuk
Elk hoofdstuk van De RAG-Engineer met het motto uit de gedrukte editie, wat je erna kunt, en wanneer je het nodig hebt.
Introductie
RAG voorbij de demo
De demo is het makkelijke deel. Die slaagt omdat jij de vragen bepaalt.
Hoofdstuk 1
Waar RAG stukgaat in productie
Het systeem deed het prima in de demo. De fout kwam van een grens die je nog niet had geïnspecteerd.
Hoofdstuk 2
GRAIN-overzicht
Vijf vaardigheden. Één pipeline. Elke retrieval-fout landt ergens daarbinnen.
Hoofdstuk 3
Corpora samenstellen
De index is niet de database die je bevraagt; het is een contract over wat je hebt besloten te vertrouwen.
Hoofdstuk 4
Chunking en normalisatie
De bibliotheek geeft niet om hoe je de boeken snijdt. De catalogus wel. Elke kaart verwijst naar een pagina, en als de pagina's niet kloppen, redt geen enkel referentiesysteem je.
Hoofdstuk 5
Hybride retrieval
De query die je dense-only pipeline breekt is niet exotisch. Je gebruikers typten hem op de derde dag in.
Hoofdstuk 6
Rerankers
First-stage retrieval is een net. De reranker is de hand die de vissen uitkiest.
Hoofdstuk 7
Context samenstellen
Het context-venster is vastgoed. De meeste teams gooien er meubilair in en hopen dat het model zijn weg vindt.
Hoofdstuk 8
Grounding en citaties
Een antwoord zonder bron is een bewering zonder getuige. De gebruiker kan het niet verifiëren. Jij kunt het niet verdedigen. Het model weet niet dat het fout zat.
Hoofdstuk 9
Inspecteer fouten
Elk slecht antwoord is een vraag aan je retrieval-subsysteem, en de failure-trace kent het antwoord al.
Hoofdstuk 10
Eval-suites voor RAG
Als je eval vijf vragen is die goed aanvoelen, meet je je vertrouwen, niet je systeem.
Hoofdstuk 11
Versheid navigeren
Een perfect geïndexeerd corpus veroudert al terwijl je leest. De enige vraag is of jij het ontdekt vóór je gebruikers dat doen.
Hoofdstuk 12
Agent- en RAG-architectuur
De agent bepaalt wanneer retrieval wordt aangeroepen. Hij bepaalt niet de SLA die hij daarmee erft.
Hoofdstuk 13
Casestudies
Het framework bewijst zijn waarde pas als het de specifieke situatie ontmoet. Drie archetypen, één discipline.
Conclusie
Conclusie: Retrieval die je kunt vertrouwen
De loop is nooit klaar. Dat is geen probleem om op te lossen. Het is een discipline om te handhaven.
Voor wie
Voor wie dit boek is geschreven
Dit is geen rondleiding door een vectordatabase of een cursus in de binnenkant van transformers. Het is retrieval van operatorklasse: protocollen die je draait wanneer het corpus rommelig is, het latentiebudget echt knijpt, en een agent handelt op wat je pijplijn ook teruggeeft.
Het resultaat is concreet. Je stopt met het uitleveren van zelfverzekerde foute antwoorden en begint met het uitleveren van een retrievallaag die je kunt testen, monitoren en aan een agent kunt overdragen zonder je vingers te kruisen.
Bouw je de retrieval waar een agent op leunt, en weiger je "goed genoeg" te noemen wat je niet kunt meten, dan begin je hier.
Edities
Edities en specificaties
| Editie | Formaten | Hoofdstukken | Pagina's | Leestijd | ISBN (paperback) |
|---|---|---|---|---|---|
| Nederlands De RAG-Engineer | In productie | 15 | 490 | ± 6 uur | — |
| Engels The RAG Engineer | In productie | 15 | 452 | ± 6 uur | — |
Beide edities zijn zelfstandig geschreven. De Nederlandse tekst is geen machinevertaling van de Engelse. · Formaat: 6x9″
Veelgestelde vragen
Wat lezers meestal willen weten
Waar gaat De RAG-Engineer over?
GRAIN brengt retrieval-augmented generation voorbij demo’s: chunking, hybride search, reranking, grounding, actualiteit, evaluatie en drift. De ondertitel luidt: Retrieval-systemen waar agents in productie echt op kunnen vertrouwen.
Wat houdt het GRAIN-raamwerk in?
GRAIN: Gather, Rank, Assemble, Inspect en Navigate. Gather, Rank, Assemble, Inspect, Navigate
Is er ook een Engelse editie?
Ja. De Engelse editie heet The RAG Engineer en is een zelfstandig geschreven editie, geen machinevertaling. Die verschijnt in dezelfde productielijn.
Hoe lang is De RAG-Engineer?
Deze editie telt 15 hoofdstukken, 490 pagina's in druk en ongeveer 6 uur lezen.
Voor wie is De RAG-Engineer geschreven?
Bouw je de retrieval waar een agent op leunt, en weiger je "goed genoeg" te noemen wat je niet kunt meten, dan begin je hier.
Het productiesysteem
Hoe dit boek is gemaakt
Elke titel doorloopt dezelfde gecontroleerde productielijn: onderzoek met bronregistratie, een bewijzenregister per claim, structuurreview, feitencontrole, red-team-kritiek en een tweetalige eindredactie. AI-agents doen specialistisch werk binnen die poorten; het oordeel, de stem en de verantwoordelijkheid blijven menselijk.
- Claims staan in een bewijzenregister met bron en gradatie voordat ze in de tekst komen
- Nederlands en Engels zijn twee zelfstandige edities, geen vertaling van elkaar
- Elk hoofdstuk passeert leesbaarheids-, ritme- en stijlpoorten voordat het gezet wordt