CodeKitHub
Webmastertools

Robots.txt Generator

Laatst bijgewerkt:

Bouw in enkele seconden een geldige robots.txt: begin met een preset (alles toestaan, alles blokkeren, of specifiek AI-trainingscrawlers blokkeren terwijl Google/Bing kunnen blijven indexeren), voeg je eigen disallow-paden en sitemap-URL toe, en kopieer of download het bestand.

Download robots.txt

Wat is deze tool?

robots.txt is een platte-tekstbestand in de root van je site dat webcrawlers vertelt welke delen van de site ze wel of niet mogen bezoeken. Zoekmachines zoals Google en Bing respecteren het voor indexering; in 2026 is het ook de standaardmanier waarop sites aangeven dat ze niet willen dat hun content wordt gebruikt om AI-modellen te trainen, via specifieke botnamen zoals GPTBot, CCBot en Google-Extended.

De syntax exact goed krijgen is belangrijk — een verkeerd Disallow-pad kan per ongeluk zoekmachines van je hele site blokkeren, of een AI-blokkeerregel die verkeerd is geplaatst blokkeert in werkelijkheid helemaal niets. Deze generator produceert syntactisch correcte output voor elk scenario.

Na bijna drie decennia als informele conventie die teruggaat tot 1994, werd het Robots Exclusion Protocol in 2022 eindelijk gestandaardiseerd als RFC 9309 — de regels die deze generator produceert (User-agent, Disallow, Allow, plus de Sitemap-extensie) volgen die specificatie.

Waarom gebruiken?

  • Een speciale AI-crawler-blokkeerpreset die GPTBot, ChatGPT-User, CCBot, Google-Extended, ClaudeBot, Bytespider en anthropic-ai dekt — terwijl zoekmachinetoegang expliciet behouden blijft.
  • Eigen disallow-paden voor content die je voor alle crawlers verborgen wilt houden.
  • Sitemap-URL-veld — een kleine toevoeging die zoekmachines helpt je pagina's sneller te vinden.
  • Elke keer correcte syntax — geen risico dat een typefout per ongeluk je hele site blokkeert.
  • Gratis, direct, download het bestand rechtstreeks of kopieer de tekst.

Hoe te gebruiken

  1. Kies een preset: alles toestaan, alles blokkeren, of alleen AI-crawlers blokkeren.
  2. Voeg eventueel eigen disallow-paden toe, één per regel (bijv. /admin/).
  3. Voeg eventueel je sitemap-URL toe.
  4. Klik op Kopiëren of Downloaden en upload het bestand naar de root van je site als /robots.txt.

Voorbeeld

Invoer

Preset: AI-crawlers blokkeren, zoekmachines behouden. Sitemap: https://example.com/sitemap.xml

Uitvoer

User-agent: GPTBot
Disallow: /

User-agent: CCBot
Disallow: /

...

User-agent: *
Allow: /

Sitemap: https://example.com/sitemap.xml

Elke AI-crawler krijgt zijn eigen expliciete blokkade, terwijl de wildcard-regel aan het eind normale zoekmachinetoegang openhoudt.

Moet je deze crawler blokkeren?

Niet alle bots dienen hetzelfde doel — de verkeerde blokkeren kan zoekverkeer wegnemen in plaats van alleen AI-training te weigeren.

CrawlerWat het doetBlokkeer als…
Googlebot, BingbotIndexeert je site voor zoekresultatenNooit — deze blokkeren verwijdert je volledig uit Google/Bing-zoekresultaten.
GPTBot, ChatGPT-UserOpenAI's crawlers — GPTBot traint modellen, ChatGPT-User haalt pagina's op die een gebruiker ChatGPT vroeg te bekijkenJe wilt niet dat je content wordt gebruikt voor AI-training, maar let op: ChatGPT-User die een door een gebruiker gelinkte pagina bezoekt, is een ander geval dat sommige sites wel toestaan.
Google-ExtendedBepaalt of Google je content gebruikt voor Gemini/AI-training — los van Googlebots zoekindexeringJe wilt in Google Zoeken blijven staan maar je afmelden voor Google's AI-training — deze richtlijn doet precies dat zonder je ranking te schaden.
CCBot, Bytespider, anthropic-ai, ClaudeBotCommon Crawl (voedt veel AI-datasets), ByteDance, de crawlers van AnthropicZelfde redenering als GPTBot — blokkeer als je geen content in AI-trainingsdatasets wilt.

Veelgestelde vragen

Stopt robots.txt AI daadwerkelijk om mijn content te gebruiken?

Het werkt op basis van vertrouwen — gerenommeerde AI-bedrijven respecteren het met hun crawlers (daarom bestaan GPTBot, CCBot enzovoort als aparte, gedocumenteerde user-agents, speciaal zodat sites zich kunnen afmelden). Het stopt geen crawlers die de standaard negeren, en het heeft geen effect op content die al gescrapet is voordat je de blokkade toevoegde.

Schaadt het blokkeren van AI-crawlers mijn Google/Bing-ranking?

Nee — de AI-crawler-preset blokkeert specifiek alleen de genoemde AI-bots en laat een wildcard "Allow: /" staan voor iedereen anders, dus Googlebot en Bingbot ondervinden geen invloed.

Waar plaats ik het robots.txt-bestand?

In de root van je domein, zodat het exact bereikbaar is op jouwdomein.com/robots.txt — niet in een submap. De meeste websitehosts en statische site-generators hebben hiervoor een aangewezen public/root-map.

Waar dient de sitemapregel voor?

Die verwijst crawlers naar je sitemap.xml, waarin al je indexeerbare pagina's staan. Het is optioneel maar wordt vaak aanbevolen — één extra regel die kan versnellen hoe snel nieuwe pagina's worden ontdekt.

Kan ik eigen disallow-paden combineren met de AI-blokkeerpreset?

Ja — de AI-blokkeerpreset voegt eerst de AI-botblokkades toe, en past daarna je eigen disallow-paden (indien aanwezig) toe onder de algemene wildcard-regel die zoekmachines nog steeds toelaat.

Gerelateerde tools