Gids 2 oktober 2026 • 10 min leestijd

Hoe kiest AI zijn bronnen?
Wat ChatGPT, Gemini, Perplexity en Claude zelf documenteren

Per engine: wanneer er gezocht wordt, welke crawlers erbij horen en hoe bronnen in het antwoord komen. Alleen wat de makers zelf publiceren, plus wat een meting in de Nederlandse markt laat zien.

Ruud ten Have

Ruud ten Have

Oprichter • Searchlab

ChatGPT, Gemini, Perplexity, Claude en de AI Overviews van Google werken volgens hun eigen documentatie op dezelfde manier: het model beslist of het moet zoeken, maakt een of meer zoekopdrachten, leest de resultaten en schrijft een antwoord met bronvermeldingen. Welke pagina's daarbij in beeld komen, hangt eerst af van de zoekcrawler van die engine: mag die je site niet lezen, dan kom je in die zoekantwoorden niet voor. Hoe een engine daarna tussen bronnen kiest, maakt geen van de makers openbaar. Een meting in de Nederlandse markt laat wel zien waar de bronnen vandaan komen: bij aanbevelingen van GEO-bureaus is 69,8% de eigen website van een bureau.

Deze gids zet per engine op een rij wat de makers zelf publiceren, met een link naar elke bron. Wat we niet konden herleiden tot een eigen document van de maker, staat er niet in. De achtergrond van het vak lees je in wat is GEO; hoe wij dit voor klanten toepassen op onze pagina over het GEO-bureau.

1. Het patroon bij alle engines

  1. Zoeken of niet. Het model kijkt of de vraag om actuele informatie vraagt. Zo niet, dan antwoordt het uit wat het tijdens de training leerde, zonder bronnen.
  2. Zoekopdrachten maken. Het model zet de vraag om in een of meer zoekopdrachten. Bij lastige vragen worden het er meer.
  3. Lezen en schrijven. Het leest de gevonden pagina's of fragmenten daarvan en schrijft een antwoord.
  4. Bronnen tonen. Bij de zinnen die op een bron leunen, komt een verwijzing met URL en titel.

Twee dingen volgen daaruit. Je moet vindbaar zijn voor de zoekfunctie van die engine, want wat niet gevonden wordt, wordt niet gelezen. En je tekst moet per passage bruikbaar zijn, want er wordt een stuk tekst geciteerd, niet je hele pagina. Hieronder per engine de details.

2. ChatGPT (OpenAI)

Wanneer er gezocht wordt

In de documentatie over web search schrijft OpenAI dat het model, net als bij andere hulpmiddelen, zelf kan kiezen of het op het web zoekt, op basis van de vraag. Ontwikkelaars kunnen zoeken ook verplicht maken.

Hoe bronnen in het antwoord komen

De crawlers

OpenAI beschrijft drie crawlers:

Let op: deze documentatie gaat over de API. Wat de ChatGPT-app laat zien kan afwijken. In de GEO Agency Index Nederland delen de ChatGPT-app en ChatGPT via de API maar 2 van hun top 3.

3. Gemini, AI Overviews en AI Mode (Google)

Gemini

In de documentatie over grounding met Google Search beschrijft Google het zo: het model bekijkt de vraag en bepaalt of een zoekopdracht in Google het antwoord beter maakt. Zo ja, dan maakt het zelf een of meer zoekopdrachten, voert die uit, verwerkt de resultaten en geeft een antwoord dat op die resultaten steunt. Bij het antwoord komen citaties die stukken tekst koppelen aan de URL van de bron. Gemini zoekt dus in de index van Google.

AI Overviews en AI Mode

Voor de AI-functies in Google Search heeft Google een eigen pagina voor website-eigenaren: AI features and your website. De belangrijkste punten:

Kort gezegd: voor Gemini en de AI-functies van Google is goede SEO de toegangsprijs. Cijfers over het effect van AI Overviews op klikken staan op onze pagina AI Overviews statistieken.

4. Perplexity

Perplexity heeft twee crawlers:

Hoe antwoorden aan bronnen gekoppeld worden, beschrijft Perplexity in de documentatie van de Agent API. Het model maakt zelf zoekopdrachten, krijgt resultaten met titel, URL, datum en een fragment, en zet direct na elke zin die op een bron leunt een genummerde verwijzing. Het werkt dus op fragmentniveau: de zin in jouw tekst die het antwoord geeft, is wat telt.

5. Claude (Anthropic)

Anthropic beschrijft in de documentatie van de zoekfunctie het duidelijkst wanneer er gezocht wordt. Claude zoekt bij:

Bij vaste kennis, rekenwerk, creatief schrijven of tekst die al in het gesprek staat, antwoordt Claude direct. Eenvoudige feitenvragen kosten volgens Anthropic meestal 1 tot 3 zoekopdrachten, vergelijkend onderzoek naar meerdere partijen 10 of meer. Bronvermeldingen staan bij zoeken altijd aan. Elke citatie bevat de URL, de titel en tot 150 tekens geciteerde tekst; bij de zoekresultaten staat ook wanneer de pagina voor het laatst is bijgewerkt.

Anthropic heeft drie crawlers: ClaudeBot verzamelt inhoud die kan bijdragen aan training, Claude-User haalt pagina's op als een gebruiker een vraag stelt en Claude-SearchBot verbetert de zoekresultaten. Volgens Anthropic kan het weren van Claude-User of Claude-SearchBot je zichtbaarheid in de zoekantwoorden van Claude verminderen.

6. Overzicht per engine

EngineCrawler voor zoekenCrawler voor trainingHoe bronnen getoond worden
ChatGPTOAI-SearchBot (plus ChatGPT-User op verzoek)GPTBotCitaties met URL en titel; vaak meer geraadpleegd dan geciteerd
GeminiIndex van GoogleGoogle-Extended als keuzeCitaties die tekst aan een URL koppelen
AI Overviews en AI ModeGooglebotGoogle-Extended als keuzeLinks bij het antwoord, via query fan-out
PerplexityPerplexityBot (plus Perplexity-User op verzoek)Niet gebruikt voor training, volgens PerplexityGenummerde verwijzing na elke zin
ClaudeClaude-SearchBot (plus Claude-User op verzoek)ClaudeBotCitaties met URL, titel en tot 150 tekens tekst

Bronnen: de documentatie van OpenAI, Google, Perplexity en Anthropic die hierboven per engine gelinkt staat, geraadpleegd in oktober 2026. Aanbieders passen hun documentatie regelmatig aan; controleer de actuele versie voordat je je robots.txt wijzigt.

7. Wat de documentatie niet zegt

Geen van deze documenten beschrijft hoe een engine tussen twee bruikbare bronnen kiest: welke pagina geciteerd wordt en welke alleen gelezen. Google zegt het meest, en dat komt neer op de gewone SEO-basis. Voor de rest geldt: wat je hoort over vaste rankingfactoren in ChatGPT of Perplexity is een interpretatie, geen documentatie. Dat geldt ook voor wat wij zeggen.

Wat wel onderzocht is, staat in het artikel waar de term GEO vandaan komt. In een testopstelling van Aggarwal en anderen werden pagina's vaker en prominenter gebruikt als ze citaten, statistieken en verwijzingen naar bronnen bevatten. Zoekwoorden herhalen hielp weinig tot niets. Dat was een testsysteem, geen van de engines hierboven, maar het wijst dezelfde kant op als de citaties op fragmentniveau die de engines tonen.

8. Wat een meting in de Nederlandse markt laat zien

De GEO Agency Index Nederland van Gold Lemon stelt elke maand 87 vragen over GEO-bureaus aan 7 AI-engines, zonder merknamen in de vragen. De editie van oktober 2026 telde 1.298 antwoorden. Volgens de methode zijn de bronnen onder antwoorden die een bureau noemen zo verdeeld:

In deze markt is de eigen site dus verreweg de belangrijkste bron. Een tweede uitkomst: elke engine kiest anders. Zelfs de ChatGPT-app en ChatGPT via de API delen maar 2 van hun top 3. De cijfers mag je vrij gebruiken onder CC BY 4.0, met bronvermelding: GEO Agency Index Nederland van Gold Lemon, editie oktober 2026.

Twee kanttekeningen. Het gaat om één markt, de markt voor GEO-diensten zelf, waar bureaus veel over hun eigen vak publiceren. In een markt waar weinig bedrijven goede pagina's hebben, kunnen gidsen en vergelijkingssites zwaarder wegen; dat is in deze index niet gemeten. En Searchlab staat zelf in deze index; dat lees je op onze pagina over het GEO-bureau. Meer cijfers over welke bronnen AI citeert staan op AI-verwijzingsverkeer en GEO statistieken.

9. Wat je ermee doet

  1. Laat de zoekcrawlers toe. Controleer in je robots.txt Googlebot, OAI-SearchBot, PerplexityBot en Claude-SearchBot. De crawlers voor training zijn een aparte keuze.
  2. Zorg dat je in Google staat. Gemini en de AI-functies van Google gebruiken de index van Google, en een pagina moet met een fragment getoond kunnen worden.
  3. Schrijf per passage. Engines citeren zinnen en fragmenten. Zet het antwoord bovenaan, met het feit en de bron in dezelfde zin. Hoe, staat in citeerbare content schrijven.
  4. Houd pagina's actueel. Claude zoekt juist bij prijzen, statistieken en gegevens over bedrijven die veranderd kunnen zijn, en ziet wanneer een pagina is bijgewerkt.
  5. Meet per engine. Omdat elke engine anders kiest, meet je ze apart. De methode staat in je merk in ChatGPT meten.

Wil je dat iemand dit voor je meet en uitvoert, dan doen wij dat als GEO-bureau.

10. Veelgestelde vragen

Welke bronnen gebruikt ChatGPT?

Als ChatGPT op het web zoekt, citeert het pagina's met URL en titel. Om in de zoekantwoorden van ChatGPT te verschijnen moet je site toegankelijk zijn voor OAI-SearchBot, de zoekcrawler van OpenAI. OpenAI publiceert niet hoe het tussen pagina's kiest. In de GEO Agency Index Nederland (oktober 2026) was 69,8% van de bronnen onder aanbevelingen de eigen site van een bureau.

Moet ik GPTBot blokkeren of toelaten?

Dat is een aparte keuze van de zoekcrawler. GPTBot haalt volgens OpenAI inhoud op die voor training van modellen kan worden gebruikt; OAI-SearchBot bepaalt of je in de zoekresultaten van ChatGPT verschijnt. Je kunt training weren en zoeken toestaan.

Heb ik speciale schema-markup nodig voor AI Overviews?

Nee. Google schrijft dat er geen speciale schema.org structured data nodig is en geen AI-tekstbestanden. Een pagina moet geïndexeerd zijn en met een fragment in Google getoond kunnen worden. Structured data die klopt met de zichtbare tekst raadt Google wel aan als goede gewoonte.

Waarom noemt Perplexity mij wel en ChatGPT niet?

Elke engine zoekt met een eigen crawler en een eigen manier van kiezen. In de GEO Agency Index Nederland delen zelfs de ChatGPT-app en ChatGPT via de API maar 2 van hun top 3. Controleer per engine of de zoekcrawler je site mag lezen en meet per engine apart.

GEO

Eerst weten waar je staat

Gratis nulmeting van je AI-zichtbaarheid

In de groei-analyse meten we bij welke klantvragen ChatGPT, Gemini, Claude, Perplexity en Google je noemen, en welke bronnen ze daarbij gebruiken.

Gerelateerde artikelen

Ruud ten Have

Geschreven door

Ruud ten Have

Ruud is oprichter van Searchlab, een online marketingbureau en GEO-bureau in Amsterdam. Hij werkt aan de vindbaarheid van bedrijven in Google en in AI-assistenten, en meet bij Searchlab elke maand hoe vaak klanten in die antwoorden genoemd worden.