Skip to main content
Blog
Blog Attacks

Hoe Blokkeer Je ClaudeBot op Je Website

ClaudeBot crawlt je site om Anthropics Claude-modellen te trainen. Zo blokkeer je het met robots.txt en IP-ranges, en wat de blokkering nog steeds mist.

Jun 16, 2026 Bijgewerkt Jul 20, 2026 6 min read
Hoe Blokkeer Je ClaudeBot op Je Website
Inhoudsopgave

Kort samengevat: ClaudeBot blokkeren zonder Claude-agents te stoppen die je site bezoeken

  • Crawler versus agent: Teams blokkeren ClaudeBot in de verwachting dat Claude van hun site verdwijnt, en de volgende dag stapt Claude Computer Use binnen. ClaudeBot is Anthropics trainingcrawler; door Claude aangedreven agents die het web bezoeken gebruiken andere infrastructuur en andere user-agents.
  • De robots.txt-blokkade: ClaudeBot identificeert zich als Claude-Web/1.0, is gedocumenteerd in Anthropics crawlerpagina's en respecteert robots.txt betrouwbaar; een Disallow: / plus Anthropics gepubliceerde IP-ranges bij de firewall dekt in één handhavingslaag zowel robots.txt-lezen als niet-conform gedrag.
  • De beslissing: Wil je uit Claudes trainingdata, dan doet deze wijziging in één bestand het werk. Wil je Claude Computer Use ook uit je checkout houden, dan is dat een apart detectieprobleem dat browserlaag-signalen nodig heeft.

Weinig tijd? Bekijk cside's AI-agentdetectie. Dit dekt alles hieronder in één deployment.

ClaudeBot is de webcrawler die door Anthropic wordt beheerd om trainingsgegevens voor Claude te verzamelen. Het is een gedeclareerde, HTTP-gebaseerde crawler: het identificeert zichzelf, werkt vanuit gepubliceerde IP-ranges en is ontworpen om robots.txt-richtlijnen te respecteren. Het blokkeren ervan is technisch eenvoudig.

De belangrijkere context: het blokkeren van ClaudeBot pakt Anthropics pijplijn voor trainingsgegevens aan. Het heeft geen effect op door Claude aangedreven agenten, tools of producten die namens gebruikers het web doorzoeken. Dat zijn aparte systemen die detectie op browserniveau vereisen. Voor het bredere patroon over AI-scrapers heen, zie onze gids voor het blokkeren van AI-agent content-scraping-bots.


Wat Is ClaudeBot?

Snel antwoord: ClaudeBot is Anthropics trainingscrawler. Het verzamelt publiek beschikbare webcontent om Claude-modellen te trainen en te verbeteren. Het gebruikt een gedeclareerde user-agent-string en staat vermeld in Anthropics openbare documentatie samen met zijn IP-ranges. Het is een HTTP-crawler, geen interactieve browseragent.

De primaire user-agent-identifier van ClaudeBot is Claude-Web/1.0, met een verwijzing naar Anthropics crawlerdocumentatiepagina. Anthropic onderhoudt documentatie die het doel, het gedrag en de manier waarop je de crawler blokkeert beschrijft.

Net als GPTBot voert ClaudeBot geen JavaScript uit en interageert het niet met interfaces van webapplicaties. Het doet HTTP GET-verzoeken aan publiek toegankelijke URL's, leest de respons en gaat verder. Het logt niet in, vult geen formulieren in en navigeert niet door interactieve elementen.


Hoe Blokkeer Je ClaudeBot met robots.txt

Snel antwoord: Voeg ClaudeBot toe aan je robots.txt om de crawler volledig te blokkeren. Anthropics documentatie stelt dat ClaudeBot deze richtlijnen respecteert. Gebruik regels op padniveau als je alleen gevoelige secties wilt beperken terwijl je de crawler op publieke content toestaat.

Om ClaudeBot van je hele site te blokkeren:

User-agent: ClaudeBot
Disallow: /

Om de crawler op publieke content toe te staan maar gevoelige paden te beperken:

User-agent: ClaudeBot
Disallow: /account/
Disallow: /checkout/
Disallow: /admin/
Allow: /blog/
Allow: /products/

Anthropic heeft een goede reputatie op het gebied van naleving wat betreft het respecteren van robots.txt-regels door zijn crawlers. Dit is de eenvoudigste en breedst effectieve aanpak om de toegang van ClaudeBot te beheren zonder wijzigingen op infrastructuurniveau. Dezelfde robots.txt-aanpak werkt voor andere gedeclareerde crawlers, waaronder CCBot en Bytespider.


Blokkeren op IP-Niveau voor ClaudeBot

Snel antwoord: Anthropic publiceert de IP-ranges van ClaudeBot in zijn crawlerdocumentatie. Het weigeren van deze ranges op je firewall of CDN biedt handhaving die niet afhankelijk is van de crawler die robots.txt leest. Controleer de documentatie periodiek, want IP-ranges kunnen uitbreiden wanneer Anthropic zijn crawlinfrastructuur opschaalt.

Blokkeren op IP-niveau is de robuustere handhavingsoptie:

  1. Het vangt elke versie van de crawler die robots.txt mogelijk niet correct verwerkt
  2. Het creëert een log op serverniveau van geblokkeerde verzoeken die je kunt controleren
  3. Het is niet afhankelijk van zelfidentificatie via de user-agent-string

De afweging: Anthropics gepubliceerde IP-ranges vereisen onderhoud. Als je ze op firewallniveau blokkeert, stel dan een herinnering in om elk kwartaal op range-updates te controleren of wanneer Anthropic changelog-vermeldingen aan zijn crawlerdocumentatie toevoegt.


ClaudeBot vs. Door Claude Aangedreven Agenten: De Kloof Die Ertoe Doet

Snel antwoord: ClaudeBot is Anthropics crawler. Claude de assistent is een ander product. Wanneer Claude een gebruiker helpt het web te doorzoeken, een onderwerp te onderzoeken of een taak te voltooien, gebruikt het andere infrastructuur dan ClaudeBot. Het blokkeren van ClaudeBot voorkomt niet dat door Claude aangedreven agenten je site bezoeken.

Dit is dezelfde structurele kloof die geldt voor GPTBot en OpenAI Operator. De trainingscrawler en de interactieve agent zijn aparte systemen.

Wanneer een gebruiker Claude vraagt om een product te onderzoeken, prijzen te vergelijken of een webgebaseerde taak te voltooien, gebruikt Claude een browsersessie of webzoektool die niet ClaudeBot is. Die sessie heeft mogelijk helemaal geen identificerende headers die het aan Anthropic koppelen. Vanuit het perspectief van je server ziet het eruit als een standaard browserverzoek.

Het juiste mentale model: robots.txt en IP-blokkering beheren je relatie met Anthropics pijplijn voor gegevensverzameling. Ze beheren niet je relatie met Claude als product dat door echte gebruikers wordt gebruikt om met je site te interageren.


Wat Gebeurt Er Nadat Je ClaudeBot Blokkeert

Snel antwoord: Het blokkeren van ClaudeBot voorkomt dat je content in Anthropics pijplijn voor trainingsgegevens terechtkomt. Het voorkomt niet dat Claude naar je site verwijst in antwoorden op basis van eerder geïndexeerde content. Het voorkomt niet dat door Claude aangedreven agentische systemen je site namens gebruikers doorzoeken.

Na een ClaudeBot-blokkering:

  • Toekomstige trainingsruns bevatten je nieuwe content niet
  • Eerder verzamelde content blijft in de gewichten van bestaande Claude-modellen
  • Claude-gebruikers die Claude vragen je site te bezoeken, worden niet beïnvloed
  • Elke door Claude aangedreven agent (Claude.ai computer use, Claude API-agenten) die je site bezoekt, wordt niet beïnvloed

De reikwijdte van een robots.txt-blokkering is smaller dan de meeste site-eigenaren verwachten. Het is een uitspraak over één specifieke crawler, geen beleid dat geldt voor het volledige productportfolio van een AI-bedrijf.


Detectie op Browserniveau Voorbij ClaudeBot

Snel antwoord: Het blokkeren van ClaudeBot is eenvoudig. Het lastigere probleem is het detecteren van door Claude aangedreven agenten die je site doorzoeken in echte browsersessies namens gebruikers, sessies die er op netwerkniveau identiek uitzien als menselijk verkeer. Dat vereist observatie op browserniveau.

Bedenk wat een door Claude aangedreven computer use-agent feitelijk doet wanneer een gebruiker het vraagt een SaaS-product te onderzoeken. Het opent een echte Chromium-sessie, laadt de prijzenpagina en scrollt door de functietabel. Op netwerkniveau ziet het verzoek er identiek uit als een menselijk bezoek: een standaard Chrome user-agent, een residentieel IP, een TLS-vingerafdruk binnen het bereik. Geen ClaudeBot-header. Geen Anthropic-IP-range. De agent navigeert in 11 seconden door vier pagina's zonder ook maar één variatie in muisbeweging, scrollt nooit terug en pauzeert nooit bij een formulierveld tenzij de taak invoer vereist. Die timingsignalen en interactiepatronen zijn alleen binnen de browsersessie detecteerbaar. cside's instrumentatie legt ze vast op de JavaScript-uitvoeringslaag voordat enige tool op netwerkniveau ze kan zien. In cside's gecontroleerde tests misten traditionele tools AI-agenten die binnen echte browsersessies opereerden in 81 van de 100 scenario's: netwerktools kijken simpelweg niet naar de juiste laag.

cside AI-agent detectiedashboard

cside werkt binnen de browsersessie en legt de gedragssignalen bloot die door agenten uitgevoerd browsen onderscheiden van menselijk gedrag. Interactietiming, navigatiepatronen, consistentie van vingerafdrukken en kenmerken van JavaScript-uitvoering zijn allemaal observeerbaar binnen een browsersessie, maar onzichtbaar voor tools op netwerkniveau. ClaudeBot zelf valt niet in die categorie: het is eenvoudig te blokkeren. De agenten die via browsersessies opereren, zijn precies wat die tests identificeerden als de onzichtbare dreiging.

Mike Kutlu
Client-Side Security Consultant

Client-side security consultant at cside. 10+ years of experience implementing technology solutions for enterprises (previously at Oracle, Cloudflare, and Splunk). Now helping teams use client-side intelligence to catch & reduce fraud.

FAQ

Frequently Asked Questions

ClaudeBot is Anthropics webcrawler, gebruikt om trainingsgegevens voor Claude-modellen te verzamelen. Het doet HTTP GET-verzoeken aan publiek toegankelijke URL's, identificeert zichzelf met een gedeclareerde user-agent-string en werkt vanuit gepubliceerde IP-ranges. Het is een HTTP-crawler die geen JavaScript uitvoert en niet interageert met dynamische webapplicaties.

Voeg `User-agent: ClaudeBot` toe, gevolgd door `Disallow: /` in je `robots.txt`-bestand. Anthropics documentatie stelt dat ClaudeBot deze richtlijnen respecteert. Voor controle op padniveau gebruik je specifieke `Disallow`-regels om de toegang tot gevoelige secties te beperken terwijl je de crawler op publieke content toestaat.

Nee. ClaudeBot is Anthropics trainingscrawler. Claude de assistent is een apart product. Wanneer Claude-gebruikers Claude vragen om het web te doorzoeken of webgebaseerde taken te voltooien, gebruiken die sessies andere infrastructuur. Het blokkeren van ClaudeBot voorkomt niet dat door Claude aangedreven agenten je site bezoeken.

Ja. Anthropic publiceert de IP-ranges van ClaudeBot in zijn crawlerdocumentatie. Het weigeren van deze ranges op je firewall of CDN biedt handhaving die niet afhankelijk is van de crawler die `robots.txt` leest. IP-ranges vereisen periodieke updates naarmate Anthropic zijn crawlinfrastructuur opschaalt.

Dat hangt ervan af of je wilt dat je content in Anthropics trainingsgegevens terechtkomt. Blokkeren voorkomt dat nieuwe content in toekomstige trainingsruns terechtkomt, maar verwijdert eerder verzamelde content niet uit bestaande Claude-modellen. Weeg de afweging tussen gegevensbescherming en het potentiële voordeel van goed vertegenwoordigd zijn in Claudes kennisbank.

ClaudeBot identificeert zich als Claude-Web/1.0, samen met een verwijzing naar de documentatiepagina van Anthropics crawler. Het is een aangemelde crawler die werkt vanuit gepubliceerde IP-reeksen en eenvoudige HTTP GET-verzoeken doet, dus je kunt hem in serverlogs, in robots.txt of in firewallregels herkennen aan die user-agent. Hij voert geen JavaScript uit en heeft geen interactie met formulieren, dus een user-agent-overeenkomst is genoeg om hem te identificeren.

Het blokkeren van robots.txt en IP-reeksen stopt alleen ClaudeBot, de trainingscrawler. Het Claude-verkeer waar de meeste teams zich echt zorgen over maken, komt van door Claude aangedreven agents die in echte Chromium-sessies browsen, met een normale Chrome-user-agent en een residentieel IP. Om die te stoppen is detectie op browserlaagniveau nodig die de timing van interacties, navigatiepatronen en de consistentie van de vingerafdruk binnen de sessie leest, geen extra netwerkregel. cside is voor die laag gebouwd.

Tools op netwerklaagniveau, zoals firewalls, WAF's en IP-blokkeerlijsten, kunnen dat niet, omdat een agentsessie er identiek uitziet als een menselijk bezoek: standaard Chrome-user-agent, residentieel IP, TLS-vingerafdruk binnen bereik en geen Anthropic-header. Detectie moet binnen de browsersessie plaatsvinden, waar de timing van interacties en de uitvoering van JavaScript de agent verraden. In de gecontroleerde tests van cside misten traditionele tools AI-agents in 81 van de 100 scenario's; cside observeert de browserlaag die zij niet kunnen zien.

Stem de methode af op het doel. Gebruik robots.txt om je beleefd af te melden voor Anthropics trainingsdata, en IP-blokkering op de firewall wanneer je handhaving wilt die niet afhankelijk is van het lezen van robots.txt door de crawler. Beide gaan alleen over ClaudeBot. Kies detectie op browserlaagniveau wanneer je zorg de Claude-agents betreft die taken op je live site voltooien, zoals de kassa of accountpagina's, want die sessies raken nooit de user-agent of IP-reeksen van ClaudeBot.

cside draait binnen de browsersessie en leest signalen die het netwerk nooit ziet. Een Claude Computer Use-agent zou vier pagina's in elf seconden kunnen doorlopen zonder variatie in muisbeweging, nooit terugscrollen en alleen pauzeren waar een taak invoer vereist. cside legt die signalen van interactietiming, navigatie en vingerafdrukconsistentie vast op de JavaScript-uitvoeringslaag en verzamelt meer dan 250 signalen per sessie om door agents uitgevoerd browsen van menselijk gedrag te scheiden.

Ja. Menselijk browsen kent natuurlijke variatie in muisbeweging, scrollgedrag en verblijftijd; een agentsessie is mechanisch consistent en taakgestuurd. cside evalueert meer dan 250 signalen per sessie binnen de browser, waaronder interactietiming en vingerafdrukconsistentie, om door agents uitgevoerde sessies te markeren. In de gecontroleerde tests van cside misten tools op netwerklaagniveau AI-agents in 81 van de 100 scenario's, precies de sessies die geen ClaudeBot-header of IP dragen.

cside wordt geïmplementeerd als één first-party JavaScript-scripttag, zonder DNS-wijzigingen en zonder je siteverkeer om te leiden. Zodra het draait, observeert het elke browsersessie en brengt het de gedragssignalen naar voren die door Claude aangedreven agents onderscheiden van menselijke bezoekers, de laag die robots.txt en firewallregels niet kunnen bereiken. Er is ook een agentloze Scan Method beschikbaar. Behoud je ClaudeBot-blokkering in robots.txt voor het afmelden van training en voeg cside toe voor live agentdetectie.

Monitor en beveilig je third-party scripts

Gain full visibility and control over every script delivered to your users to enhance site security and performance.

Start gratis, of probeer Business met een proefperiode van 14 dagen.

cside-dashboardinterface met scriptmonitoring en beveiligingsanalyses
Related Articles
Boek een demo

Wil je dit doornemen met een engineer?

Dertig minuten, op je eigen site. Geen slides.

Boek een persoonlijke demo om te zien:

Hoe je in 1 dag voldoet aan PCI DSS-vereisten 6.4.3 en 11.6.1
Waarom scripts van derden een beveiligingsrisico zijn voor jou en je bezoekers
Hoe je privacy- en toestemmingslekken (AVG, CCPA) bij elke derde partij monitort
Hoe je misbruik van aanmeldingen, account sharing en chargeback-fraude stopt met device intelligence
Hoe je AI-agents en bots die je site bereiken in realtime detecteert en beheerst

Liever gewoon een vraag stellen?

Vrije momenten zoeken…

Alleen echte mensen. Wij merken het.

Lukt het boeken niet? Agenda in een nieuw tabblad openen

Wat wil je oplossen?

Vertel het ons in één zin, dan komen we terug met iets bruikbaars in plaats van een standaardverhaal.

Waar we meestal mee helpen:

Zien welke scripts van derden op je site draaien
Bewijs voor PCI DSS 6.4.3 en 11.6.1
Bots, AI-agents en accountovername

Liever meteen een moment inplannen? Kies een tijdstip