Alle gratis tools

Gratis Robots.txt AI-bot Checker: zie welke AI-crawlers je site bereiken

Plak je domein of robots.txt-URL. Wij lezen het bestand, toetsen elke grote AI-crawler aan je Allow- en Disallow-regels en vertellen je bot voor bot welke je site bereiken. Geen registratie nodig.

Gratis, zonder registratie. We lezen je robots.txt en tonen welke AI-crawlers — GPTBot, ClaudeBot, Google-Extended, PerplexityBot en meer — je momenteel toestaat of blokkeert.

Wat de AI-bot checker valideert

  • Verdict per bot (Toegestaan, Gedeeltelijk, Geblokkeerd) voor elke grote AI-user-agent
  • Training-crawlers: GPTBot, ClaudeBot, Google-Extended, CCBot, Bytespider, Meta-ExternalAgent
  • Zoek-crawlers: OAI-SearchBot, Claude-SearchBot, PerplexityBot, Applebot-Extended
  • On-demand fetch-bots: ChatGPT-User, Claude-User, Perplexity-User
  • Locatie van de robots.txt-URL en HTTP-statuscode
  • Conflicten tussen User-agent: * en bot-specifieke regels
  • Verboden paden per bot — zodat je ziet wat verborgen is, niet alleen wat geblokkeerd is

Waarom je robots.txt belangrijker is dan vroeger

Je robots.txt is het eerste wat een crawler leest, en AI-bedrijven draaien nu meerdere crawlers met aparte user-agents. OpenAI alleen al heeft er drie: GPTBot voor training, OAI-SearchBot voor ChatGPT Search en ChatGPT-User voor on-demand opvragingen. Anthropic, Google, Perplexity, Common Crawl en Meta hebben elk hun eigen crawlers.

De keuzes die je in dit bestand maakt, bepalen twee verschillende uitkomsten. Blokkeer de zoek-crawlers en je merk verdwijnt uit de antwoorden van ChatGPT, Claude en Perplexity. Laat de training-crawlers open terwijl je je eigenlijk wilde afmelden, en de modellen van morgen leren gratis van je content.

De meeste sites willen uiteindelijk het één en niet het ander.

Wat de data zegt over het blokkeren van AI-bots

Drie cijfers die de moeite waard zijn voordat je de regels schrijft.

Een studie van Rutgers Business School en Wharton (januari 2026) volgde uitgevers die AI-crawlers via robots.txt blokkeerden en ontdekte dat hun totale verkeer gemiddeld 23% daalde. De blokkade stopt niet alleen de bots; hij snijdt ook door AI verwezen klikken af.
Een BuzzStream-audit van 100 grote nieuwssites vond dat 79% ten minste één AI-training-bot blokkeert — verstandig — maar dat 71% ook ten minste één retrieval- of zoek-bot blokkeert, meestal per ongeluk. De algemene Disallow: / vangt alles.
Cloudflares eigen data toont dat meer dan 1 miljoen klanten de één-klik-schakelaar “Block AI Scrapers” hebben ingeschakeld sinds juli 2024. Sinds 1 juli 2025 wordt elk nieuw domein op Cloudflare geleverd met AI-bots standaard geblokkeerd. Als je robots.txt Allow zegt maar de bots je toch niet kunnen bereiken, is dit meestal de reden.

Hoe je resultaat te lezen

Toegestaan

De crawler heeft toegang tot je site-root. Voor zoek-bots zoals OAI-SearchBot, Claude-SearchBot en PerplexityBot is dit wat je in aanmerking houdt om geciteerd te worden in AI-antwoorden.

Gedeeltelijk

De crawler kan je site bereiken, maar specifieke paden zijn verboden. Meestal prima — controleer even of je geen pagina's verbergt die je in AI-zoekopdrachten wilt laten verschijnen.

Geblokkeerd

Een Disallow: / regel stopt de crawler volledig. Bedoeld voor afmelding bij training, maar een probleem als het een zoek-crawler is voor wie je zichtbaar wilde blijven.

De meest voorkomende robots.txt-fouten (en hoe je ze oplost)

Per ongeluk AI-zoekopdrachten blokkeren.

Een algemene Disallow die OAI-SearchBot, Claude-SearchBot of PerplexityBot raakt, verwijdert je stilletjes uit AI-antwoorden.

Oplossing: Zet de zoek-crawlers in hun eigen User-agent-groepen en sta ze expliciet toe.

User-agent: * gebruiken om AI te blokkeren.

Die groep raakt ook Googlebot, Bingbot en elke gewone zoek-crawler, dus de regel blokkeert veel meer dan je bedoelde.

Oplossing: Noem elke AI-user-agent in zijn eigen groep en laat de wildcard met rust.

Google-Extended verwarren met Googlebot.

Blokkeer de verkeerde en je laat ofwel AI-training aanstaan, of je de-indexeert jezelf per ongeluk uit Google Search.

Oplossing: Gebruik Google-Extended om je af te melden voor training van Gemini en Vertex AI; laat Googlebot ongemoeid voor organische Search.

Robots.txt behandelen als een firewall.

Het is adviserend. Nette crawlers respecteren het; kwaadwillenden en externe scrapers negeren het.

Oplossing: Voeg server-side blokkering toe (Cloudflare AI-regels, WAF, .htaccess) voor bots die je echt moet stoppen.

Cloudflare die je Allow-regel overschrijft.

Sinds juli 2025 blokkeert Cloudflare AI-bots standaard op nieuwe domeinen, ongeacht wat je robots.txt zegt.

Oplossing: Open het Cloudflare-dashboard, ga naar Security → Bots → AI Scrapers and Crawlers en schakel het uit als je wilt dat AI-zoek-bots je site bereiken.

Wil je zien of AI je echt citeert?

Een robots.txt-audit vertelt je welke AI-crawlers je site kunnen bereiken. De SEOcrawl AI Tracker vertelt je wat ze doen zodra ze er zijn. Ontdek hoe vaak ChatGPT, Claude, Gemini en Perplexity je merk vermelden en citeren, welke prompts je triggeren en hoe je het doet ten opzichte van de concurrenten die je kiest te monitoren — gekoppeld aan je Google Search Console-data op hetzelfde dashboard.

Veelgestelde vragen

Wat is een AI-bot checker?

Een tool die je robots.txt leest en je vertelt welke AI-crawlers je toestaat of blokkeert, bot voor bot. Hij vergelijkt je Allow- en Disallow-regels met de user-agenttokens van de grote AI-bedrijven: OpenAI (GPTBot, OAI-SearchBot, ChatGPT-User), Anthropic (ClaudeBot, Claude-SearchBot, Claude-User), Google (Google-Extended), Perplexity (PerplexityBot), Meta, Common Crawl en anderen.

Wat is GPTBot?

GPTBot is de webcrawler van OpenAI, gelanceerd in augustus 2023, gebruikt om openbaar beschikbare content te verzamelen voor het trainen van toekomstige GPT-modellen. Het is niet dezelfde bot als OAI-SearchBot, die ChatGPT Search aandrijft, of ChatGPT-User, die een pagina ophaalt wanneer iemand een assistent vraagt deze te lezen. Alle drie gehoorzamen ze robots.txt onafhankelijk van elkaar, dus je kunt de ene toestaan en de andere blokkeren.

Wat is het verschil tussen training-, zoek- en on-demand AI-bots?

Training-bots (GPTBot, CCBot, Google-Extended, Bytespider) scrapen content om de onderliggende modellen te trainen. Zoek-bots (OAI-SearchBot, Claude-SearchBot, PerplexityBot) indexeren je site zodat deze geciteerd kan worden in AI-zoekantwoorden. On-demand fetch-bots (ChatGPT-User, Claude-User, Perplexity-User) halen in real time één pagina op wanneer een gebruiker de assistent ernaar vraagt. Elk kan afzonderlijk worden beheerd in robots.txt.

Hoe blokkeer ik AI-crawlers in robots.txt?

Voeg een groep per crawler toe met een Disallow-regel. Bijvoorbeeld: "User-agent: GPTBot" gevolgd door "Disallow: /" op de volgende regel. Om er meerdere te blokkeren, plaats je elke user-agent in zijn eigen groep. Onthoud dat robots.txt adviserend is: goedaardige crawlers zoals GPTBot en ClaudeBot respecteren het, maar het houdt een bot die het kiest te negeren niet tegen.

Moet ik AI-bots blokkeren of toestaan?

Dat hangt af van je doel. Sta de zoek-bots (OAI-SearchBot, Claude-SearchBot, PerplexityBot) toe zodat je merk geciteerd kan worden in AI-antwoorden. Blokkeer de training-bots (GPTBot, CCBot, Google-Extended, Bytespider) alleen als je een specifieke reden hebt om je af te melden. Uit het Rutgers/Wharton-onderzoek bleek dat uitgevers die AI-crawlers massaal blokkeerden 23% van hun totale verkeer verloren, dus algehele verboden lonen zelden.

Respecteert ClaudeBot robots.txt?

Ja. De officiële documentatie van Anthropic bevestigt dat ClaudeBot, Claude-User en Claude-SearchBot allemaal de standaard robots.txt-richtlijnen respecteren, inclusief de niet-standaard Crawl-delay-uitbreiding. Elke user-agent kan onafhankelijk worden toegestaan of geblokkeerd, dus je kunt je afmelden voor training terwijl je citeerbaar blijft in de zoekantwoorden van Claude.

Schaadt het blokkeren van Google-Extended mijn Google-ranking?

Nee. Google-Extended bepaalt alleen of je content wordt gebruikt om Gemini en Vertex AI te trainen en te onderbouwen. Het is een apart token van Googlebot, dus het blokkeren van Google-Extended heeft geen effect op hoe je rankt in Google Search. Het is de schone manier om je af te melden voor AI-training zonder de organische zoekopdrachten aan te raken.

Overschrijft de standaard AI-botblokkering van Cloudflare mijn Allow-regel in robots.txt?

Ja, blokkering op netwerkniveau wint. Sinds 1 juli 2025 blokkeert Cloudflare AI-bots standaard op elk nieuw domein via zijn beheerde regel "AI Scrapers and Crawlers", zelfs als je robots.txt Allow zegt. Als een bot in deze checker als Toegestaan verschijnt maar je pagina's niet daadwerkelijk kan ophalen, controleer dan je Cloudflare-instellingen bij Security → Bots.