ChatGPT, Perplexity en de AI-overzichten van Google (AI Overviews) bereiken je pagina elk via een andere deur, en elke deur heeft een eigen sleutel. Voor zoeken in ChatGPT moet je de zoekcrawler van OpenAI, OAI-SearchBot, toelaten. Perplexity heeft zijn crawler PerplexityBot nodig. De AI-overzichten en de AI-modus van Google gebruiken de gewone zoekindex van Google. Daar gaat het dus om Googlebot, een pagina die geïndexeerd kan worden en toestemming voor een snippet. Wie één deur opent, heeft de andere twee nog niet open.
Eerst een paar begrippen, want de rest bouwt erop voort. Een antwoordmachine is een dienst die een antwoord op een vraag schrijft en daarbij bronnen noemt, in plaats van alleen een lijst links te tonen. Een crawler is het programma waarmee een bedrijf webpagina’s ophaalt. robots.txt is het tekstbestand in de hoofdmap van je site dat crawlers bij naam vertelt wat ze mogen ophalen. Een index is de opgeslagen kopie van pagina’s waarin een zoekmachine dingen opzoekt.
De drie deuren in één tabel
Alles in deze tabel komt uit de eigen documentatie van de leveranciers, gelezen op 24 september 2026.
| ChatGPT | Perplexity | AI-overzichten en AI-modus van Google | |
|---|---|---|---|
| Waar het antwoord uit put | Pagina’s die OAI-SearchBot ophaalde, plus andere zoekaanbieders waarmee OpenAI soms samenwerkt | Pagina’s die PerplexityBot ophaalde | De eigen zoekindex van Google |
| Naam in robots.txt die de deur regelt | OAI-SearchBot | PerplexityBot | Googlebot |
| Andere schakelaars die je tegenkomt | GPTBot (training), ChatGPT-User (haalt op als een mens erom vraagt) | Perplexity-User (haalt op als een mens erom vraagt) | Snippetregels, de instelling voor generatieve AI in Search Console, Google-Extended (geen schakelaar voor Zoeken) |
| Wat de documentatie over links zegt | Antwoorden kunnen citaties bevatten; een citatie opent de bron | PerplexityBot bestaat om websites te tonen en ernaar te linken | Geschikte pagina’s kunnen verschijnen als ondersteunende link |
| Hoe je je toegang controleert | Zoek in je serverlogs naar verzoeken van OAI-SearchBot vanaf de IP-reeksen die OpenAI publiceert | Zoek in je logs naar verzoeken van PerplexityBot vanaf de gepubliceerde IP-reeksen van Perplexity | URL-inspectie in Search Console; het prestatierapport over generatieve AI |
| Hoe lang een wijziging duurt | Ongeveer 24 uur na een wijziging in robots.txt | Hooguit 24 uur | Enkele dagen tot enkele maanden bij gewijzigde snippetregels |
Die laatste cel voor Google komt van de pagina over AI-functies: opnieuw crawlen kan volgens Google enkele dagen tot enkele maanden duren nadat je weergave-instellingen zoals snippetregels hebt gewijzigd.
Deur één: ChatGPT
De FAQ van OpenAI voor uitgevers begint ruimhartig: “Any public website can appear in ChatGPT search.” Elke openbare website kan dus in de zoekresultaten van ChatGPT verschijnen. Volgens de crawlerpagina van OpenAI gebruikt ChatGPT OAI-SearchBot om websites in zijn zoekfuncties te tonen. Sites die hem blokkeren, verschijnen niet in zoekantwoorden van ChatGPT, al kunnen ze nog als navigatielink opduiken. De helppagina voegt de tweede helft van de sleutel toe: laat de crawler toe en controleer of je hostingpartij of CDN (content delivery network, de dienst waar veel sites achter staan voor snelheid en filtering) de gepubliceerde IP-adressen van de zoekbot van OpenAI doorlaat.
Let op twee details. Ten eerste schrijft OpenAI dat ChatGPT soms samenwerkt met andere zoekaanbieders en de vraag dan omzet in gerichte zoekopdrachten. In dat deel van de helppagina staan links naar de privacyverklaringen van Microsoft en Shopify. Je eigen crawltoegang is dus één ingang, niet de enige. Ten tweede is GPTBot een andere deur: die bot verzamelt content die gebruikt kan worden om de modellen van OpenAI te trainen. Hem blokkeren haalt je niet uit de zoekresultaten van ChatGPT. GPTBot versus OAI-SearchBot versus ChatGPT-User loopt alle drie de namen van OpenAI door.
Deur twee: Perplexity
Volgens de crawlerpagina van Perplexity is PerplexityBot bedoeld om websites te tonen en ernaar te linken in de zoekresultaten van Perplexity, en wordt hij niet gebruikt om content voor AI-basismodellen te verzamelen. Perplexity raadt aan om de bot in robots.txt toe te laten en verzoeken vanaf de gepubliceerde IP-reeksen door te laten. Voor Cloudflare en AWS staan er stapsgewijze instructies voor de firewall bij.
De tweede bot, Perplexity-User, bezoekt een pagina als iemand een vraag stelt, en kan een link naar die pagina in het antwoord opnemen. Omdat een mens om het ophalen vroeg, negeert Perplexity-User robots.txt volgens Perplexity over het algemeen. Een blokkade voor Perplexity-User in robots.txt is dus geen betrouwbare manier om een pagina af te schermen. Moet een pagina echt privé blijven, zet die dan achter een login.
Deur drie: de AI-overzichten en de AI-modus van Google
Google heeft voor deze functies geen aparte AI-crawler. Op de pagina over AI-functies schrijft Google dat de regels in robots.txt voor Googlebot dé knop zijn waarmee je bepaalt hoe je site voor Zoeken wordt gecrawld. Om als ondersteunende link in aanmerking te komen, moet een pagina geïndexeerd zijn en met een snippet in Google Zoeken kunnen verschijnen. Extra technische eisen zijn er volgens Google niet.
Rond die deur zitten drie extra schakelaars. De snippetregels nosnippet, max-snippet en data-nosnippet, plus de indexeringsregel noindex, beperken wat Google mag tonen of gebruiken. Search Console heeft een instelling voor generatieve AI waarbij opnemen de standaard is; die instelling is volgens Google per 31 augustus 2026 voor alle websites beschikbaar. En Google-Extended, een robots.txt-token voor training en grounding van Gemini, heeft volgens Google geen invloed op opname in Google Zoeken en is geen rankingsignaal.
Ook als alles goed staat, zie je misschien niets. Google zegt dat AI-overzichten vaak niet verschijnen, omdat ze alleen worden getoond als het systeem ze een nuttige aanvulling op de gewone resultaten vindt.
Wat vertelt geen enkele leverancier?
Hoe hij kiest. De helppagina van OpenAI is het meest direct: ChatGPT rangschikt zoekresultaten op basis van meerdere factoren die gebruikers moeten helpen relevante, betrouwbare informatie te vinden, en “Placement is not guaranteed.” Een plek is dus niet gegarandeerd. Google zegt dat zijn AI-functies wortelen in de kernsystemen voor ranking van Zoeken, en dat indexering en vertoning niet gegarandeerd zijn. De crawlerpagina van Perplexity zegt helemaal niets over selectie.
Wie je “de citatieformule van ChatGPT” aanbiedt, verkoopt dus een gok. Wat je wel in de hand hebt, staat in Hoe zoek- en antwoordmachines bronnen kiezen, en het werk aan de pagina zelf in Hoe je geciteerd wordt door ChatGPT. De deuren openzetten is het deel van AEO (answer engine optimization) dat je met zekerheid kunt controleren.
Vier mythes en de feiten
| Mythe | Feit, volgens de eigen pagina van de leverancier |
|---|---|
| ”Als ik GPTBot blokkeer, kom ik niet in ChatGPT.” | GPTBot is de trainingscrawler. Zoeken in ChatGPT loopt via OAI-SearchBot. |
| ”Als ik Google-Extended blokkeer, kom ik niet in de AI-overzichten.” | Google-Extended heeft volgens Google geen invloed op opname in Google Zoeken. De AI-overzichten volgen Googlebot, de snippetregels en de instelling in Search Console. |
| ”Een regel voor Perplexity-User in robots.txt houdt Perplexity weg.” | Volgens Perplexity negeert Perplexity-User robots.txt meestal, omdat een mens erom vroeg. |
| ”Als ik alle bots binnenlaat, word ik geciteerd.” | Toegang maakt je geschikt. OpenAI: “Placement is not guaranteed.” |
Een voorbeeld (hypothetisch)
Stel je een Nederlands bedrijf voor dat boekhoudsoftware verkoopt. Op een voorjaarsdag zet de hostingpartij een strengere botbeveiliging aan. Het verkeer uit Google loopt gewoon door, en de pagina over factuureisen blijft in de AI-overzichten verschijnen, want Googlebot komt er nog in.
Maar de serverlogs tonen wekenlang geen bezoek van OAI-SearchBot of PerplexityBot, alleen geweigerde verzoeken. robots.txt laat beide bots toe. De firewall niet. De oplossing is een regel die de IP-reeksen doorlaat die OpenAI en Perplexity publiceren. Een citatie is daarmee niet beloofd. Twee van de drie deuren hangen alleen weer in hun scharnieren.
De toegangscheck van vijftien minuten
- Minuut 0 tot 3. Open
https://jouw-site/robots.txt. Zoek de groepen voor OAI-SearchBot, PerplexityBot en Googlebot, en de groepUser-agent: *. Noteer per bot open of dicht. - Minuut 3 tot 6. Open de instellingen van je firewall of CDN. Zoek naar botbeveiliging, controlepagina’s of landenblokkades die de crawlers kunnen tegenhouden voordat ze robots.txt lezen.
- Minuut 6 tot 10. Doorzoek de serverlogs van de afgelopen zeven dagen op
OAI-SearchBot,PerplexityBotenGooglebot. Noteer de statuscodes: 200 betekent geleverd, 403 betekent geweigerd. Vergelijk een paar adressen met de IP-lijsten die OpenAI en Perplexity publiceren, want iedereen kan de naam van een bot nadoen. - Minuut 10 tot 13. Doe in Search Console een URL-inspectie op je belangrijkste pagina. Open daarna de instelling voor generatieve AI en controleer of die op opnemen staat.
- Minuut 13 tot 15. Schrijf drie regels: deur ChatGPT, deur Perplexity, deur Google. Zet achter elke regel: open, dicht of onbekend.
Staat er ergens onbekend, dan weet je wat je volgende klus is. Het boek dat dit als één systeem behandelt, The findability engine, is in productie en nog niet te koop. Voor de check hierboven heb je geen boek nodig, alleen een tekstbestand, een firewallscherm en een logbestand.
Citeer deze pagina:ChatGPT, Perplexity en de AI-overzichten van Google: drie machines, drie deuren naar je pagina.Len P. van der Hof. https://lenvanderhof.com/nl/blog/drie-antwoordmachines-drie-deuren/ ·