Wat is de Robots Exclusion Standard?
De Robots Exclusion Standard (RES) is het protocol dat vastlegt hoe robots.txt-bestanden worden geschreven en geïnterpreteerd. Live syntax-checker — plak je robots.txt en zie direct welke regels geldig, onbekend of fout zijn.
01 — checkerLive robots.txt syntax-checker
De Robots Exclusion Standard werd in 1994 geïntroduceerd door Martijn Koster als informeel protocol. In 2022 publiceerde Google een formele RFC (RFC 9309) die de standaard codificeert. Het protocol definieert hoe robots.txt-bestanden worden opgebouwd: user-agent-blokken, directives, commentaarregels en de volgorde van interpretatie. Plak hier jouw robots.txt voor directe validatie.
De Robots Exclusion Standard is een aanbeveling, geen technisch afdwingbaar protocol. Goedwillende crawlers (Google, Bing, yandex) respecteren het. Kwaadwillende bots negeren het volledig. Gebruik robots.txt voor crawl-budget-beheer, niet als beveiligingsmaatregel.
02 — directives4 directives uitgelegd
* betekent alle crawlers. Specifieke crawlers (Googlebot, Bingbot) overschrijven de *-regels.User-agent: Googlebot
Disallow:) betekent niets geblokkeerd — volledige toegang. Zie ook disallow.Disallow: /intern/
03 — regelsSyntaxregels en interpretatie
Vijf regels die bepalen hoe robots.txt wordt geïnterpreteerd:
Allow: /admin/ajax.php wint van Disallow: /admin/ voor dat specifieke bestand.Disallow: /Admin/ blokkeert niet /admin/. Altijd het exacte pad gebruiken zoals het in de URL staat.* matcht alles. $ ankert aan het einde van de URL. Disallow: /*.pdf$ blokkeert alle URLs die eindigen op .pdf. Niet alle crawlers ondersteunen wildcards volledig.*). Specifieke crawler-regels overschrijven de *-regels volledig.04 — faqVeelgestelde vragen
User-agent: GPTBot + Disallow: / — blokkeert ChatGPT-datacollectie. (2) Google Bard/Gemini: User-agent: Google-Extended + Disallow: /. (3) Common Crawl: User-agent: CCBot + Disallow: /. (4) Anthropic: User-agent: ClaudeBot + Disallow: /. Plaatsen voor elke blokkering is een zakelijke keuze — het beïnvloedt of jouw content wordt meegenomen in AI-trainingsdata. Voor SEO-crawlers (Googlebot, Bingbot) is blokkering schadelijk voor rankings. Zie ook disallow.Robots.txt-configuratie controleren?
Via een technische SEO-audit controleer ik jouw robots.txt op fouten, onnodige blokkeringen en crawl-budget-verspilling.
Plan een gesprek met Ralf →