Crawler-Dokumentation
Der RssSitemapBot.
Liest RSS-, Atom- und Sitemap-Dateien, um unsere globale Indexierungswarteschlange zu füllen.
Crawler-Dokumentation
Liest RSS-, Atom- und Sitemap-Dateien, um unsere globale Indexierungswarteschlange zu füllen.
WebAtlasRssSitemapBot identifiziert sich mit folgendem User-Agent.
WebAtlasRssSitemapBot/1.1 (+https://webatlasindex.pl/rsssitemap-bot.php)
Ein leichtgewichtiger Crawler, dessen Aufgabe es ist, eingereichte RSS-/Atom-Feeds und Sitemap-Dateien zu lesen und die darin enthaltenen URLs zu extrahieren.
Extrahierte URLs werden automatisch durch drei Ebenen gefiltert:
/admin, /wp-login, /api).gclid, utm_source, clickid).Um WebAtlasRssSitemapBot vollständig zu blockieren, füge dies zu deiner robots.txt hinzu:
User-agent: WebAtlasRssSitemapBot
Disallow: /