Dokumentacja crawlera
DiscoverBot.
Odkrywa nowe ścieżki. WebAtlasDiscoverBot eksploruje sieć, zasilając naszą globalną kolejkę indeksowania.
Dokumentacja crawlera
Odkrywa nowe ścieżki. WebAtlasDiscoverBot eksploruje sieć, zasilając naszą globalną kolejkę indeksowania.
WebAtlasDiscoverBot identyfikuje się następującym nagłówkiem User-Agent.
WebAtlasDiscoverBot/2.1 (+https://webatlasindex.pl/discover-bot.php)
Lekki crawler skupiony wyłącznie na odkrywaniu linków. Respektuje reguły robots.txt pod swoją nazwą, pobiera maksymalnie 512 KB na połączenie i honoruje Crawl-delay, żeby minimalnie obciążać Twój serwer.
Każdy znaleziony link przechodzi przez trzy filtry, zanim trafi do kolejki:
/admin, /wp-login, /api).gclid, utm_source, clickid).Aby całkowicie zablokować WebAtlasDiscoverBota, dodaj to do robots.txt:
User-agent: WebAtlasDiscoverBot
Disallow: /