Crawlerdocumentatie
De DiscoverBot.
Vindt nieuwe paden. WebAtlasDiscoverBot verkent het web om onze globale indexeringswachtrij te voeden.
Crawlerdocumentatie
Vindt nieuwe paden. WebAtlasDiscoverBot verkent het web om onze globale indexeringswachtrij te voeden.
WebAtlasDiscoverBot identificeert zich met de volgende User-Agent.
WebAtlasDiscoverBot/2.1 (+https://webatlasindex.pl/discover-bot.php)
Een lichtgewicht crawler die zich puur richt op het ontdekken van links. Hij respecteert robots.txt-regels onder zijn eigen naam, downloadt maximaal 512 KB per verbinding, en houdt rekening met Crawl-delay om de belasting van je server laag te houden.
Elke gevonden link doorloopt drie filters voordat deze in de wachtrij komt:
/admin, /wp-login, /api).gclid, utm_source, clickid).Om WebAtlasDiscoverBot volledig te blokkeren, voeg dit toe aan je robots.txt:
User-agent: WebAtlasDiscoverBot
Disallow: /