Wat is AI-bot-toegang?
AI-bot-toegang meet of AI-crawlers — GPTBot, ClaudeBot, PerplexityBot, Google-Extended, OAI-SearchBot, ChatGPT-User en andere — je pagina's daadwerkelijk kunnen bereiken en lezen. De check kijkt naar vier lagen: robots.txt-directives, server response codes, IP-gebaseerde blokkades vanuit CDN's en WAF's, en of content vergrendeld zit achter JavaScript of paywalls. Elke laag kan AI-zichtbaarheid stilletjes om zeep helpen, en veel sites worden op één of meer lagen geblokkeerd zonder het te beseffen.
Deze metric is de poortwachter voor de gehele GEO-Score. Een perfecte 100/100 op schema, vermeldingen, versheid en structuur levert exact nul AI-vermeldingen op als één Disallow-regel in robots.txt of een standaard WAF-regel crawlers wegstuurt. Cloudflare meldde in juli 2025 dat zijn netwerk AI-crawlers nu standaard blokkeert voor nieuwe klanten — wat betekent dat een aanzienlijk deel van het web van de ene op de andere dag onzichtbaar werd voor AI.
Waarom AI-bot-toegang belangrijk is
AI-zoeken is inmiddels een meetbaar deel van het totale webverkeer, maar het is ook de meest fragiele verkeersbron — één verkeerd geconfigureerde regel kan je aanwezigheid in ChatGPT, Claude en Perplexity tegelijk wegvagen. Drie krachten verklaren waarom bot-toegang aandacht verdient vóór elk ander GEO-werk.
Bot-toegang is een binaire poortwachter
AI-crawlers indexeren een geblokkeerde site niet gedeeltelijk — ze slaan hem helemaal over. Als GPTBot, ClaudeBot of PerplexityBot een 403, een robots.txt Disallow of een WAF-challenge krijgt, wordt de pagina voor AI-antwoorden behandeld alsof ze niet bestaat. Er is geen "verminderde zichtbaarheid"-uitkomst: het is volledige citatie-eligibility of helemaal geen.
De meeste blokkades zijn per ongeluk
Originality.ai vond dat GPTBot inmiddels door 35,7% van de top 1.000 websites wordt geblokkeerd, maar uit gesprekken met site-eigenaren blijkt dat veel van die blokkades zijn overgenomen uit standaard WAF-regelsets, gekopieerde robots.txt-templates of CDN-bot-fight-modes die GPTBot als een generieke scraper classificeren. Weinig van deze eigenaren wilden AI bewust blokkeren; ze vergaten het simpelweg toe te staan.
AI-crawlers zijn agressief — maar selectief
Cloudflare meldde dat GPTBot in ruwe requests 305% groeide tussen mei 2024 en mei 2025, terwijl PerplexityBot vanaf een kleine basis met 157.490% groeide. Dat volume komt met een budget: bots geven prioriteit aan sites die snel reageren, 200's teruggeven en content in de initiële HTML serveren. Sites die af en toe een 5xx geven, content achter JavaScript verbergen of AI-bots rate-limiten zien vermeldingen dalen, zelfs zonder expliciete blokkade.
Wat het onderzoek zegt
Het aandeel van GPTBot in al het crawlerverkeer steeg van 2,2% naar 7,7%, met een stijging van 305% in het aantal requests over 12 maanden — een sprong van plek #9 naar plek #3 onder alle webcrawlers. PerplexityBot liet de meest explosieve groei zien: 157.490% vanaf een minimale basis. Toch had slechts 14% van de geanalyseerde domeinen specifieke robots.txt-richtlijnen voor AI-bots — de overige 86% liet AI-verkeer stilzwijgend toe of blokkeerde het per ongeluk.
João Tomé, Jorge Pacheco, Carlos Azevedo — From Googlebot to GPTBot: Who's Crawling Your Site in 2025, Cloudflare Blog, juli 2025 — analyse van 3.816 topdomeinen
GPTBot wordt nu geblokkeerd door 35,7% van de top 1.000 websites, tegenover slechts 5% toen de bot in augustus 2023 werd geïntroduceerd. Het percentage sites dat GPTBot blokkeerde, steeg in de beginfase met ongeveer 5% per week na de aankondiging van de bot. Veel van deze blokkades kwamen voort uit standaardtemplates en CDN-regels, niet uit bewuste beleidskeuzes.
Originality.ai — GPTBot Blocking Tracker, update augustus 2024 — kwartaalonderzoek onder de Quantcast top 1.000 websites sinds de lancering van GPTBot
De crawl-naar-referral-ratio van Anthropic piekte begin 2025 op bijna 500.000:1 voordat deze zich stabiliseerde tussen 25.000:1 en 100.000:1, terwijl de GPTBot-ratio van OpenAI in maart 2025 opliep tot ongeveer 3.700:1. Deze onbalans — bots nemen veel meer dan ze teruggeven aan menselijke bezoeken — is de belangrijkste reden waarom uitgevers geneigd zijn te blokkeren. Maar voor elke site die geen groot nieuwsmerk is, sluit blokkeren de enige weg naar citaties in AI-zoekresultaten volledig af.
Cloudflare Radar — The crawl-to-click gap: AI bots, training, and referrals, 2025 — meermaandelijkse analyse van crawler-naar-mens-referral-ratio's binnen het Cloudflare-netwerk
Snelle tips voor AI-bot-toegang
Gebruik altijd expliciete Allow-regels per AI-bot — "User-agent: * / Allow: /" lijkt permissief maar signaleert geen intentie en veel WAF's overschrijven het
Check je CDN-dashboard vóór robots.txt — de wijziging van Cloudflare in juli 2025 blokkeert AI-crawlers standaard voor nieuwe klanten, ongeacht wat je robots.txt zegt
Sta zowel training-bots (GPTBot, ClaudeBot) als zoekbots tijdens query (OAI-SearchBot, ChatGPT-User, Claude-SearchBot, PerplexityBot) toe — ze bedienen verschillende delen van de AI-antwoord-pipeline
Vertrouw niet op llms.txt als primair toegangsmechanisme — eind 2025 leest geen enkele grote AI-crawler het; robots.txt blijft de enige universeel gehonoreerde standaard
Render kritieke content server-side of via SSG — alleen Googlebot voert betrouwbaar JavaScript uit onder grote crawlers, dus alleen via JS gerenderde content is onzichtbaar voor GPTBot, ClaudeBot en PerplexityBot
Sample je access logs wekelijks op de AI-user-agent strings — een plotselinge daling naar nul is het vroegste signaal van een onbedoelde blokkade door een CDN-update of WAF-regelwijziging
Moet ik GPTBot blokkeren om mijn content tegen AI-training te beschermen?
▼
Wat is de impact van AI-bots toestaan op mijn GEO-Score?
▼
Wat is het verschil tussen GPTBot, ChatGPT-User en OAI-SearchBot?
▼
Beïnvloedt het blokkeren van Google-Extended mijn Google Search-rankings?
▼
Waarom crawlen AI-bots mijn site zo vaak zonder verkeer terug te sturen?
▼
Moet ik een llms.txt-bestand naast robots.txt implementeren?
▼
Gerelateerde metrics om te verkennen
Page Speed
Trage responses zorgen ervoor dat AI-crawlers timeouten — page speed maakt van "toegestaan" pas "echt crawlbaar"
Sitemap & vindbaarheid
Zodra bots je site kunnen bereiken, bepalen je sitemap en linkstructuur welke pagina's ze daadwerkelijk vinden
Schema-validator
Schema markup helpt AI-crawlers toegankelijke pagina's te interpreteren — inclusief paywalledContent-annotaties voor hybride modellen
AI-optimalisatie
De koepelscore die bot-toegang, schema, structuur en versheid combineert tot één AI-readiness-signaal
Bereiken AI-bots je site echt?
Doe een gratis GEO-Score Check om te zien of GPTBot, ClaudeBot en PerplexityBot je pagina's kunnen lezen. De analyser inspecteert robots.txt, server response codes, CDN-gedrag en JavaScript-gerenderde content — en vertelt je precies welke AI-crawlers worden toegelaten en welke stilletjes geblokkeerd zijn.
Check je AI-bot-toegang gratis