De RAG-Engineer — voorkant
De RAG-Engineer — achterkant

No. 07 · Manuscript compleet · AI & agents · GRAIN

De RAG-Engineer

Retrieval-systemen waar agents in productie echt op kunnen vertrouwen

Je RAG-demo werkt. In productie breekt het.

Een PDF embedden is een demo; productie overleven is engineering. De RAG-Engineer brengt je voorbij de tutorials naar de faalmodi die retrieval echt breken — chunking, versheid, reranking, grounding en stille drift — met een protocol voor pijplijnen waar agents op kunnen bouwen.

pagina's
490
hoofdstukken
15
uur lezen
± 6
edities
EN · NL

Het boek

Retrieval-systemen waar agents in productie echt op kunnen vertrouwen

In de demo werkte het ophalen perfect. Toen kwam productie: de gebruiker stelde dezelfde vraag op drie manieren, de embeddings haalden hun schouders op, en je agent citeerde een passage die met volle overtuiging het tegendeel van de waarheid beweerde. Nu debug je een black box, één fout antwoord tegelijk, en het deel van de stack dat je het minst vertrouwt is precies het deel waarop het hele product steunt.

De reflex is: wissel het embeddingmodel, verhoog top-k, hak in kleinere stukken. Dat sleutelt aan het symptoom en levert de ziekte op: één gelijkenisscore ging je nooit vertellen of een passage relevant, recent of juist is.

The RAG Engineer behandelt retrieval als een engineeringdiscipline, niet als gevoel. Het reikt je GRAIN aan (Grounding, Retrieval, Augmentation, Indexing en Negative-feedback response), vijf fasen die een broze vectorzoekopdracht veranderen in een pijplijn die je kunt meten, verdedigen en die je een agent durft te laten aanroepen zonder dat een mens elk resultaat naleest.

Wat je leert

Wat je met dit boek kunt

  • Het GRAIN-protocol: Gather, Rank, Assemble, Inspect, Navigate
  • Los chunking, versheid, hybride zoeken, reranking en grounding op
  • Retrieval-pijplijnen die agents in productie vertrouwen

Het raamwerk

GRAIN, stap voor stap

Gather, Rank, Assemble, Inspect, Navigate

  1. Gather

    Bronkeuze, rechten, versionering en het corpuscontract dat bepaalt wat in de index hoort.

  2. Rank

    Eerste-fase retrieval (dense, sparse of hybride), daarna een reranker die kandidaten ordent vóór assemblage.

  3. Assemble

    Tokenbudget, chunkvolgorde, deduplicatie, instructielayout en citaties die bewijs bruikbaar houden.

  4. Inspect

    Failure traces, bad-chunk workflows en eval-suites die een fout antwoord koppelen aan een retrievalbeslissing.

  5. Navigate

    TTL-beleid, re-ingest jobs, change detection en signalen die tonen hoe oud een antwoord kan zijn.

De inhoud

Hoofdstuk voor hoofdstuk

15 hoofdstukken

Elk hoofdstuk van De RAG-Engineer met het motto uit de gedrukte editie, wat je erna kunt, en wanneer je het nodig hebt.

  1. Introductie

    RAG voorbij de demo

    De demo is het makkelijke deel. Die slaagt omdat jij de vragen bepaalt.

  2. Hoofdstuk 1

    Waar RAG stukgaat in productie

    Het systeem deed het prima in de demo. De fout kwam van een grens die je nog niet had geïnspecteerd.

  3. Hoofdstuk 2

    GRAIN-overzicht

    Vijf vaardigheden. Één pipeline. Elke retrieval-fout landt ergens daarbinnen.

  4. Hoofdstuk 3

    Corpora samenstellen

    De index is niet de database die je bevraagt; het is een contract over wat je hebt besloten te vertrouwen.

  5. Hoofdstuk 4

    Chunking en normalisatie

    De bibliotheek geeft niet om hoe je de boeken snijdt. De catalogus wel. Elke kaart verwijst naar een pagina, en als de pagina's niet kloppen, redt geen enkel referentiesysteem je.

  6. Hoofdstuk 5

    Hybride retrieval

    De query die je dense-only pipeline breekt is niet exotisch. Je gebruikers typten hem op de derde dag in.

  7. Hoofdstuk 6

    Rerankers

    First-stage retrieval is een net. De reranker is de hand die de vissen uitkiest.

  8. Hoofdstuk 7

    Context samenstellen

    Het context-venster is vastgoed. De meeste teams gooien er meubilair in en hopen dat het model zijn weg vindt.

  9. Hoofdstuk 8

    Grounding en citaties

    Een antwoord zonder bron is een bewering zonder getuige. De gebruiker kan het niet verifiëren. Jij kunt het niet verdedigen. Het model weet niet dat het fout zat.

  10. Hoofdstuk 9

    Inspecteer fouten

    Elk slecht antwoord is een vraag aan je retrieval-subsysteem, en de failure-trace kent het antwoord al.

  11. Hoofdstuk 10

    Eval-suites voor RAG

    Als je eval vijf vragen is die goed aanvoelen, meet je je vertrouwen, niet je systeem.

  12. Hoofdstuk 11

    Versheid navigeren

    Een perfect geïndexeerd corpus veroudert al terwijl je leest. De enige vraag is of jij het ontdekt vóór je gebruikers dat doen.

  13. Hoofdstuk 12

    Agent- en RAG-architectuur

    De agent bepaalt wanneer retrieval wordt aangeroepen. Hij bepaalt niet de SLA die hij daarmee erft.

  14. Hoofdstuk 13

    Casestudies

    Het framework bewijst zijn waarde pas als het de specifieke situatie ontmoet. Drie archetypen, één discipline.

  15. Conclusie

    Conclusie: Retrieval die je kunt vertrouwen

    De loop is nooit klaar. Dat is geen probleem om op te lossen. Het is een discipline om te handhaven.

Voor wie

Voor wie dit boek is geschreven

Dit is geen rondleiding door een vectordatabase of een cursus in de binnenkant van transformers. Het is retrieval van operatorklasse: protocollen die je draait wanneer het corpus rommelig is, het latentiebudget echt knijpt, en een agent handelt op wat je pijplijn ook teruggeeft.

Het resultaat is concreet. Je stopt met het uitleveren van zelfverzekerde foute antwoorden en begint met het uitleveren van een retrievallaag die je kunt testen, monitoren en aan een agent kunt overdragen zonder je vingers te kruisen.

Bouw je de retrieval waar een agent op leunt, en weiger je "goed genoeg" te noemen wat je niet kunt meten, dan begin je hier.

Edities

Edities en specificaties

Editie Formaten Hoofdstukken Pagina's Leestijd ISBN (paperback)
Nederlands De RAG-Engineer In productie 15 490 ± 6 uur
Engels The RAG Engineer In productie 15 452 ± 6 uur

Beide edities zijn zelfstandig geschreven. De Nederlandse tekst is geen machinevertaling van de Engelse. · Formaat: 6x9″

Veelgestelde vragen

Wat lezers meestal willen weten

Waar gaat De RAG-Engineer over?

GRAIN brengt retrieval-augmented generation voorbij demo’s: chunking, hybride search, reranking, grounding, actualiteit, evaluatie en drift. De ondertitel luidt: Retrieval-systemen waar agents in productie echt op kunnen vertrouwen.

Wat houdt het GRAIN-raamwerk in?

GRAIN: Gather, Rank, Assemble, Inspect en Navigate. Gather, Rank, Assemble, Inspect, Navigate

Is er ook een Engelse editie?

Ja. De Engelse editie heet The RAG Engineer en is een zelfstandig geschreven editie, geen machinevertaling. Die verschijnt in dezelfde productielijn.

Hoe lang is De RAG-Engineer?

Deze editie telt 15 hoofdstukken, 490 pagina's in druk en ongeveer 6 uur lezen.

Voor wie is De RAG-Engineer geschreven?

Bouw je de retrieval waar een agent op leunt, en weiger je "goed genoeg" te noemen wat je niet kunt meten, dan begin je hier.

Het productiesysteem

Hoe dit boek is gemaakt

Elke titel doorloopt dezelfde gecontroleerde productielijn: onderzoek met bronregistratie, een bewijzenregister per claim, structuurreview, feitencontrole, red-team-kritiek en een tweetalige eindredactie. AI-agents doen specialistisch werk binnen die poorten; het oordeel, de stem en de verantwoordelijkheid blijven menselijk.

  • Claims staan in een bewijzenregister met bron en gradatie voordat ze in de tekst komen
  • Nederlands en Engels zijn twee zelfstandige edities, geen vertaling van elkaar
  • Elk hoofdstuk passeert leesbaarheids-, ritme- en stijlpoorten voordat het gezet wordt
Lees het systeem in De Agentische Auteur

Begrippen