Wat is robots.txt?
Robots.txt uitleg: live URL-tester met rule-builder, 6 preset-templates, syntax-validation en de SEO-impact.
01 — testerRobots.txt — live URL-tester
Robots.txt is een tekstbestand op de root van je domein (example.com/robots.txt) dat crawlers vertelt welke URLs ze WEL of NIET mogen crawlen. Het is het oudste + bekendste protocol voor crawler-control (sinds 1994). Belangrijk: robots.txt blokkeert CRAWLING, niet INDEXING. Voor indexing-block gebruik je meta robots noindex. Bouw hieronder je robots.txt + test elke URL. Voor breder context op crawling zie zoekmachine.
Belangrijke nuance: dit is een EDUCATIEVE tester. Voor productie-validation gebruik Google's officiële Robots.txt Tester in Search Console (Settings → Crawling → robots.txt). Google's parser kent edge-cases die educatieve tools niet altijd correct simuleren.
02 — directives5 robots.txt directives
User-agent: *
Disallow: /*.pdf$
Allow: /wp-content/uploads/
Wildcard-patterns: * match elke char-sequence, $ match URL-end. Bv: Disallow: /*.pdf$ blokkeert alle PDF-URLs. Disallow: /*? blokkeert alle URLs met query-parameters.
03 — bp5 best-practices voor robots.txt
04 — faqVeelgestelde vragen
Robots.txt + crawl-optimization audit?
Volledig crawl-control-traject: audit van huidige robots.txt-setup, identification van mis-blocked URLs via Search Console, AI-crawler-policy-implementation, crawl-budget-optimization voor enterprise-sites, plus monthly rapportage op crawl-coverage.
Plan een gesprek met Ralf →