ChatGPT, Gemini, Perplexity, Claude en de AI Overviews van Google werken volgens hun eigen documentatie op dezelfde manier: het model beslist of het moet zoeken, maakt een of meer zoekopdrachten, leest de resultaten en schrijft een antwoord met bronvermeldingen. Welke pagina's daarbij in beeld komen, hangt eerst af van de zoekcrawler van die engine: mag die je site niet lezen, dan kom je in die zoekantwoorden niet voor. Hoe een engine daarna tussen bronnen kiest, maakt geen van de makers openbaar. Een meting in de Nederlandse markt laat wel zien waar de bronnen vandaan komen: bij aanbevelingen van GEO-bureaus is 69,8% de eigen website van een bureau.
Deze gids zet per engine op een rij wat de makers zelf publiceren, met een link naar elke bron. Wat we niet konden herleiden tot een eigen document van de maker, staat er niet in. De achtergrond van het vak lees je in wat is GEO; hoe wij dit voor klanten toepassen op onze pagina over het GEO-bureau.
1. Het patroon bij alle engines
- Zoeken of niet. Het model kijkt of de vraag om actuele informatie vraagt. Zo niet, dan antwoordt het uit wat het tijdens de training leerde, zonder bronnen.
- Zoekopdrachten maken. Het model zet de vraag om in een of meer zoekopdrachten. Bij lastige vragen worden het er meer.
- Lezen en schrijven. Het leest de gevonden pagina's of fragmenten daarvan en schrijft een antwoord.
- Bronnen tonen. Bij de zinnen die op een bron leunen, komt een verwijzing met URL en titel.
Twee dingen volgen daaruit. Je moet vindbaar zijn voor de zoekfunctie van die engine, want wat niet gevonden wordt, wordt niet gelezen. En je tekst moet per passage bruikbaar zijn, want er wordt een stuk tekst geciteerd, niet je hele pagina. Hieronder per engine de details.
2. ChatGPT (OpenAI)
Wanneer er gezocht wordt
In de documentatie over web search schrijft OpenAI dat het model, net als bij andere hulpmiddelen, zelf kan kiezen of het op het web zoekt, op basis van de vraag. Ontwikkelaars kunnen zoeken ook verplicht maken.
Hoe bronnen in het antwoord komen
- Bij het antwoord komen citaties mee met de URL, de titel en de plek in de tekst waar de bron bij hoort.
- OpenAI eist van ontwikkelaars dat die citaties zichtbaar en klikbaar zijn als ze het antwoord aan gebruikers tonen.
- Naast de citaties is er een lijst met alle bronnen die het model raadpleegde. Volgens OpenAI is het aantal geraadpleegde bronnen vaak groter dan het aantal citaties. Gelezen worden is dus nog niet geciteerd worden.
De crawlers
OpenAI beschrijft drie crawlers:
- OAI-SearchBot zorgt dat websites in de zoekresultaten van ChatGPT verschijnen. Sites die deze crawler weren, verschijnen volgens OpenAI niet in de zoekantwoorden van ChatGPT, al kunnen ze nog als navigatielink getoond worden.
- GPTBot haalt inhoud op die gebruikt kan worden voor de training van de modellen. Weren betekent dat je inhoud niet voor training gebruikt moet worden.
- ChatGPT-User bezoekt pagina's als een gebruiker daar in een gesprek om vraagt. Omdat een gebruiker het verzoek doet, gelden de regels in robots.txt daar volgens OpenAI mogelijk niet.
Let op: deze documentatie gaat over de API. Wat de ChatGPT-app laat zien kan afwijken. In de GEO Agency Index Nederland delen de ChatGPT-app en ChatGPT via de API maar 2 van hun top 3.
3. Gemini, AI Overviews en AI Mode (Google)
Gemini
In de documentatie over grounding met Google Search beschrijft Google het zo: het model bekijkt de vraag en bepaalt of een zoekopdracht in Google het antwoord beter maakt. Zo ja, dan maakt het zelf een of meer zoekopdrachten, voert die uit, verwerkt de resultaten en geeft een antwoord dat op die resultaten steunt. Bij het antwoord komen citaties die stukken tekst koppelen aan de URL van de bron. Gemini zoekt dus in de index van Google.
AI Overviews en AI Mode
Voor de AI-functies in Google Search heeft Google een eigen pagina voor website-eigenaren: AI features and your website. De belangrijkste punten:
- Query fan-out. AI Overviews en AI Mode kunnen meerdere verwante zoekopdrachten over deelonderwerpen en gegevensbronnen tegelijk doen. Tijdens het schrijven zoeken ze extra pagina's die het antwoord onderbouwen, waardoor er volgens Google een bredere en gevarieerdere set links getoond wordt dan bij een gewoon zoekresultaat.
- Eisen. Een pagina moet geïndexeerd zijn en met een fragment in Google getoond kunnen worden. Er zijn geen extra technische eisen.
- Geen speciale bestanden. Je hoeft geen nieuwe machineleesbare bestanden, AI-tekstbestanden of markup te maken, en er is geen speciale schema.org-markup nodig.
- Wel de basis. Google noemt onder meer: crawlen toestaan, interne links, belangrijke inhoud als tekst, goede afbeeldingen en video's, structured data die klopt met de zichtbare tekst en een actueel bedrijfsprofiel.
- Zelf beperken. Met
nosnippet,data-nosnippet,max-snippetofnoindexbeperk je wat er van je pagina's getoond wordt. Google-Extended is voor training en grounding in andere systemen van Google. - Meten. Bezoeken via AI Overviews en AI Mode tellen in Search Console mee in het prestatierapport onder het zoektype Web.
Kort gezegd: voor Gemini en de AI-functies van Google is goede SEO de toegangsprijs. Cijfers over het effect van AI Overviews op klikken staan op onze pagina AI Overviews statistieken.
4. Perplexity
Perplexity heeft twee crawlers:
- PerplexityBot is gemaakt om websites in de zoekresultaten van Perplexity te tonen en te linken. Perplexity schrijft dat deze crawler niet wordt gebruikt voor het trainen van AI-modellen. Wie in Perplexity wil verschijnen, moet PerplexityBot toelaten in robots.txt en verzoeken vanaf de gepubliceerde IP-adressen van Perplexity niet blokkeren.
- Perplexity-User bezoekt een pagina als een gebruiker een vraag stelt, om een juist antwoord te geven en de pagina te linken. Deze crawler negeert robots.txt over het algemeen, omdat een gebruiker het verzoek doet.
Hoe antwoorden aan bronnen gekoppeld worden, beschrijft Perplexity in de documentatie van de Agent API. Het model maakt zelf zoekopdrachten, krijgt resultaten met titel, URL, datum en een fragment, en zet direct na elke zin die op een bron leunt een genummerde verwijzing. Het werkt dus op fragmentniveau: de zin in jouw tekst die het antwoord geeft, is wat telt.
5. Claude (Anthropic)
Anthropic beschrijft in de documentatie van de zoekfunctie het duidelijkst wanneer er gezocht wordt. Claude zoekt bij:
- recent nieuws en aankondigingen;
- actuele prijzen, tarieven en statistieken;
- informatie over organisaties, mensen of producten die veranderd kan zijn;
- een expliciete vraag om iets op te zoeken.
Bij vaste kennis, rekenwerk, creatief schrijven of tekst die al in het gesprek staat, antwoordt Claude direct. Eenvoudige feitenvragen kosten volgens Anthropic meestal 1 tot 3 zoekopdrachten, vergelijkend onderzoek naar meerdere partijen 10 of meer. Bronvermeldingen staan bij zoeken altijd aan. Elke citatie bevat de URL, de titel en tot 150 tekens geciteerde tekst; bij de zoekresultaten staat ook wanneer de pagina voor het laatst is bijgewerkt.
Anthropic heeft drie crawlers: ClaudeBot verzamelt inhoud die kan bijdragen aan training, Claude-User haalt pagina's op als een gebruiker een vraag stelt en Claude-SearchBot verbetert de zoekresultaten. Volgens Anthropic kan het weren van Claude-User of Claude-SearchBot je zichtbaarheid in de zoekantwoorden van Claude verminderen.
6. Overzicht per engine
| Engine | Crawler voor zoeken | Crawler voor training | Hoe bronnen getoond worden |
|---|---|---|---|
| ChatGPT | OAI-SearchBot (plus ChatGPT-User op verzoek) | GPTBot | Citaties met URL en titel; vaak meer geraadpleegd dan geciteerd |
| Gemini | Index van Google | Google-Extended als keuze | Citaties die tekst aan een URL koppelen |
| AI Overviews en AI Mode | Googlebot | Google-Extended als keuze | Links bij het antwoord, via query fan-out |
| Perplexity | PerplexityBot (plus Perplexity-User op verzoek) | Niet gebruikt voor training, volgens Perplexity | Genummerde verwijzing na elke zin |
| Claude | Claude-SearchBot (plus Claude-User op verzoek) | ClaudeBot | Citaties met URL, titel en tot 150 tekens tekst |
Bronnen: de documentatie van OpenAI, Google, Perplexity en Anthropic die hierboven per engine gelinkt staat, geraadpleegd in oktober 2026. Aanbieders passen hun documentatie regelmatig aan; controleer de actuele versie voordat je je robots.txt wijzigt.
7. Wat de documentatie niet zegt
Geen van deze documenten beschrijft hoe een engine tussen twee bruikbare bronnen kiest: welke pagina geciteerd wordt en welke alleen gelezen. Google zegt het meest, en dat komt neer op de gewone SEO-basis. Voor de rest geldt: wat je hoort over vaste rankingfactoren in ChatGPT of Perplexity is een interpretatie, geen documentatie. Dat geldt ook voor wat wij zeggen.
Wat wel onderzocht is, staat in het artikel waar de term GEO vandaan komt. In een testopstelling van Aggarwal en anderen werden pagina's vaker en prominenter gebruikt als ze citaten, statistieken en verwijzingen naar bronnen bevatten. Zoekwoorden herhalen hielp weinig tot niets. Dat was een testsysteem, geen van de engines hierboven, maar het wijst dezelfde kant op als de citaties op fragmentniveau die de engines tonen.
8. Wat een meting in de Nederlandse markt laat zien
De GEO Agency Index Nederland van Gold Lemon stelt elke maand 87 vragen over GEO-bureaus aan 7 AI-engines, zonder merknamen in de vragen. De editie van oktober 2026 telde 1.298 antwoorden. Volgens de methode zijn de bronnen onder antwoorden die een bureau noemen zo verdeeld:
- 69,8% is de website van een bureau zelf;
- 3,6% is een gids;
- 2,9% is vakmedia of een platform.
In deze markt is de eigen site dus verreweg de belangrijkste bron. Een tweede uitkomst: elke engine kiest anders. Zelfs de ChatGPT-app en ChatGPT via de API delen maar 2 van hun top 3. De cijfers mag je vrij gebruiken onder CC BY 4.0, met bronvermelding: GEO Agency Index Nederland van Gold Lemon, editie oktober 2026.
Twee kanttekeningen. Het gaat om één markt, de markt voor GEO-diensten zelf, waar bureaus veel over hun eigen vak publiceren. In een markt waar weinig bedrijven goede pagina's hebben, kunnen gidsen en vergelijkingssites zwaarder wegen; dat is in deze index niet gemeten. En Searchlab staat zelf in deze index; dat lees je op onze pagina over het GEO-bureau. Meer cijfers over welke bronnen AI citeert staan op AI-verwijzingsverkeer en GEO statistieken.
9. Wat je ermee doet
- Laat de zoekcrawlers toe. Controleer in je robots.txt Googlebot, OAI-SearchBot, PerplexityBot en Claude-SearchBot. De crawlers voor training zijn een aparte keuze.
- Zorg dat je in Google staat. Gemini en de AI-functies van Google gebruiken de index van Google, en een pagina moet met een fragment getoond kunnen worden.
- Schrijf per passage. Engines citeren zinnen en fragmenten. Zet het antwoord bovenaan, met het feit en de bron in dezelfde zin. Hoe, staat in citeerbare content schrijven.
- Houd pagina's actueel. Claude zoekt juist bij prijzen, statistieken en gegevens over bedrijven die veranderd kunnen zijn, en ziet wanneer een pagina is bijgewerkt.
- Meet per engine. Omdat elke engine anders kiest, meet je ze apart. De methode staat in je merk in ChatGPT meten.
Wil je dat iemand dit voor je meet en uitvoert, dan doen wij dat als GEO-bureau.
10. Veelgestelde vragen
Welke bronnen gebruikt ChatGPT?
Als ChatGPT op het web zoekt, citeert het pagina's met URL en titel. Om in de zoekantwoorden van ChatGPT te verschijnen moet je site toegankelijk zijn voor OAI-SearchBot, de zoekcrawler van OpenAI. OpenAI publiceert niet hoe het tussen pagina's kiest. In de GEO Agency Index Nederland (oktober 2026) was 69,8% van de bronnen onder aanbevelingen de eigen site van een bureau.
Moet ik GPTBot blokkeren of toelaten?
Dat is een aparte keuze van de zoekcrawler. GPTBot haalt volgens OpenAI inhoud op die voor training van modellen kan worden gebruikt; OAI-SearchBot bepaalt of je in de zoekresultaten van ChatGPT verschijnt. Je kunt training weren en zoeken toestaan.
Heb ik speciale schema-markup nodig voor AI Overviews?
Nee. Google schrijft dat er geen speciale schema.org structured data nodig is en geen AI-tekstbestanden. Een pagina moet geïndexeerd zijn en met een fragment in Google getoond kunnen worden. Structured data die klopt met de zichtbare tekst raadt Google wel aan als goede gewoonte.
Waarom noemt Perplexity mij wel en ChatGPT niet?
Elke engine zoekt met een eigen crawler en een eigen manier van kiezen. In de GEO Agency Index Nederland delen zelfs de ChatGPT-app en ChatGPT via de API maar 2 van hun top 3. Controleer per engine of de zoekcrawler je site mag lezen en meet per engine apart.