Crawler-Dokumentation
Der DiscoverBot.
Findet neue Pfade. WebAtlasDiscoverBot durchforstet das Web, um unsere globale Indexierungswarteschlange zu füllen.
Crawler-Dokumentation
Findet neue Pfade. WebAtlasDiscoverBot durchforstet das Web, um unsere globale Indexierungswarteschlange zu füllen.
WebAtlasDiscoverBot identifiziert sich mit folgendem User-Agent.
WebAtlasDiscoverBot/2.1 (+https://webatlasindex.pl/discover-bot.php)
Ein leichtgewichtiger Crawler, der sich ausschließlich auf die Link-Entdeckung konzentriert. Er respektiert robots.txt-Regeln unter seinem eigenen Namen, lädt maximal 512 KB pro Verbindung herunter und beachtet Crawl-delay, um die Serverlast gering zu halten.
Jeder gefundene Link durchläuft drei Filter, bevor er in die Warteschlange kommt:
/admin, /wp-login, /api).gclid, utm_source, clickid).Um WebAtlasDiscoverBot vollständig zu blockieren, füge dies zu deiner robots.txt hinzu:
User-agent: WebAtlasDiscoverBot
Disallow: /