SEO, GEO en AEO Onderzoeksartikel

Wat is llms.txt? Een manifest, geen rankingknop

Een vrijwillige wegwijzer helpt het systeem dat hem opent. Over een systeem dat nooit vraagt, heeft hij geen macht.

Crèmekleurig vel papier, vastgeprikt aan een verandapaal in de regen, terwijl voorbijgangers doorlopen en binnen een bureaulamp brandt
Het briefje helpt alleen wie besluit te stoppen.

Direct antwoord

llms.txt is een voorgesteld Markdown-bestand met de naam llms.txt, gepubliceerd in de root van een site of op een pad daaronder. Het geeft agents en zoeksystemen een korte beschrijving van de site of sectie plus uitgekozen links naar uitgebreidere, liefst machineleesbare pagina's. Lezen is vrijwillig. Het enige verplichte onderdeel is een H1. Het is geen robots.txt, geen toegangscontrole en geen vervanging van een sitemap. De gids van Google voor generatieve AI-functies in Search, voor het laatst bijgewerkt op 2026-07-10 en opnieuw gelezen op 2026-09-04, zegt dat Google Search zulke bestanden niet gebruikt en dat het aanmaken ervan zichtbaarheid of ranking niet helpt en niet schaadt, ook niet in generatieve functies zoals AI Overviews en AI Mode.

llms.txt is een vrijwillige wegwijzer voor machines. Je publiceert een klein Markdown-bestand. Een agent of zoeksysteem dat ervoor kiest het te lezen, krijgt een korte beschrijving van je site en de links die jij hebt uitgekozen. Niets verplicht een systeem om het te openen, en over een systeem dat dat nooit doet, heeft het bestand geen enkele macht.

Het voorstel, inmiddels versie 2, vraagt om een bestand met de naam llms.txt in de root van de site of op elk pad daaronder; het dekt dan de pagina’s onder dat pad. Het enige verplichte onderdeel is een H1 met de naam van de site of het project. Al het andere is optioneel: een samenvatting van één alinea in een blockquote, korte toelichting, H2-lijsten met links en een beschrijving van één regel, en een sectie “Optional” voor bijzaken. Het voorstel verscheen in september 2024 en werd in augustus 2026 herzien. Het is een voorstel, geen standaard. Het is ook geen well-known URI: de auteurs bleven bewust weg uit /.well-known/, omdat zo’n adres alleen in de root van een origin kan bestaan en dit bestand juist een pad moet kunnen dekken.

Google is ongewoon duidelijk. De gids voor generatieve AI-functies in Search zegt dat Google Search zulke bestanden niet gebruikt, en dat het aanmaken ervan je zichtbaarheid of ranking in Google Search niet helpt en niet schaadt. Dat geldt ook voor de generatieve functies, AI Overviews en AI Mode inbegrepen.

Op “helpt llms.txt bij Google?” is het antwoord dus nee, en het schaadt ook niet. Of een ander systeem het bestand nuttig vindt, is een aparte vraag. Alleen je logs kunnen die beantwoorden.

llms.txt, robots.txt en sitemap.xml

De drie bestanden beantwoorden elk een andere vraag:

BestandTaakWat het niet kan beloven
llms.txtBiedt vrijwillige context en een uitgekozen route door je content aan systemen die het lezenNaleving door crawlers, indexering, ranking, een citaat of adoptie door welk systeem dan ook
robots.txtLegt per user-agent en pad vast wat crawlers mogenVertrouwelijkheid, authenticatie of een rankingresultaat
sitemap.xmlHelpt zoekmachines canonieke URL’s en hun metadata te ontdekkenDat elke vermelde URL wordt gecrawld of geïndexeerd

Google zegt dat een kleine, goed gelinkte site misschien geen sitemap nodig heeft, dat grotere, nieuwe of mediarijke sites er baat bij kunnen hebben, en dat een sitemap een hint is. llms.txt neemt die ontdekkingstaak niet over. Een sitemap neemt de toelichtende taak niet over.

Ook de knoppen voor training en Search zitten ergens anders. Wil je OpenAI laten weten dat gecrawlde content niet voor het trainen van basismodellen gebruikt mag worden, dan stel je GPTBot in. De vergelijking van de OpenAI-crawlers houdt die schakelaar apart van ChatGPT Search en van pagina’s die op verzoek van een mens worden opgehaald. llms.txt kan geen van beide toestemmingen geven of intrekken.

Wat in het bestand thuishoort

Begin bij de lezer, niet bij het formaat. Welke agent, assistent of zoekproces help je, en wat moet die sneller vinden dan via een gewone crawl?

Een bruikbaar bestand blijft klein:

  • de naam van de site of sectie en één eerlijke alinea over wat het is;
  • een paar notities die voorspelbare verwarring voorkomen, zoals twee producten met bijna dezelfde naam of een API die niet meer bestaat;
  • canonieke openbare URL’s, elk met een beschrijving van één regel;
  • links naar schone tekst- of Markdown-versies als je die onderhoudt;
  • een sectie Optional voor bijzaken die anders de hoofdroute verstoppen.

Deze site publiceert /llms.txt en een langere /llms-full.txt. Beide gaven HTTP 200 met text/plain terug toen dit artikel op 2026-09-04 werd gecontroleerd. Dat is een keuze voor systemen die zulke bestanden lezen. Het is geen bewijs dat een zoekmachine ze beloont.

Waar het bestand faalt

De eerste fout is een doelgroep zonder naam. Een bestand dat is aangemaakt omdat een audittool een leeg vinkje toonde, heeft geen operationeel doel en geen eigenaar.

De tweede is verouderde sturing. Verwijst de wegwijzer naar geschrapte producten, omgeleide pagina’s of ongepubliceerde concepten, dan volgt een gehoorzaam systeem feilloos de verkeerde route. Werk het bestand bij zodra canonieke URL’s, toegangsregels of publicatiestatus veranderen. Beheer weegt zwaarder dan aanmaken.

De derde is dupliceren zonder te kiezen. Elke URL in Markdown storten herschept het navigatieprobleem dat het bestand moest verkleinen. Kies. Beschrijf. Laat het detail achter de link.

De vierde is een citaat aanzien voor een oorzaak. Een antwoord kan je pagina citeren na een gewone webzoekopdracht, via een index van derden, via een geplakte URL of langs een andere weg. Dat citaat bewijst niet dat llms.txt is gelezen. Wil je het echt weten, kijk dan in je logs naar verzoeken om het bestand, of doe een gecontroleerde test met het systeem waar het je om gaat.

De beslissing

Publiceer llms.txt als drie voorwaarden gelden:

  1. Je kunt minstens één systeem of proces noemen dat het mogelijk gebruikt.
  2. Het gelinkte materiaal is openbaar, canoniek en bruikbaar in machineleesbare vorm.
  3. Iemand is eigenaar van de actualiteit van elke link en beschrijving.

Verbeter anders de pagina’s zelf. De citatiegereedheid-audit vraagt of een URL een helder antwoord, een naam en onderbouwing toont die een controle overleeft. Wat GEO betekent behandelt het bredere werk om bron te worden. The Findability Engine bezit de langere uitwerking; het boek is in productie en niet te koop.

Google leest de gewone pagina’s. Elke andere zoekmachine ook. Een manifest in de root redt geen lege pagina.

Citeer deze pagina:Wat is llms.txt? Een manifest, geen rankingknop.Len P. van der Hof. https://lenvanderhof.com/nl/blog/wat-is-llms-txt/ ·

Begrippen

Bronnen

  1. Citatiegereedheid-audit
  2. GPTBot versus OAI-SearchBot versus ChatGPT-User
  3. Wat GEO betekent
  4. The Findability Engine
  5. llms.txt op deze site
  6. The /llms.txt file, v2 · llms-txt
  7. Optimizing your website for generative AI features on Google Search · Google Search Central
  8. Learn about sitemaps · Google Search Central

Verder lezen

Markdown voor LLMs