Crawlerdocumentatie
De RssSitemapBot.
Leest RSS-, Atom- en sitemapbestanden om onze globale indexeringswachtrij te voeden.
Crawlerdocumentatie
Leest RSS-, Atom- en sitemapbestanden om onze globale indexeringswachtrij te voeden.
WebAtlasRssSitemapBot identificeert zich met de volgende User-Agent.
WebAtlasRssSitemapBot/1.1 (+https://webatlasindex.pl/rsssitemap-bot.php)
Een lichtgewicht crawler die ingediende RSS-/Atom-feeds en sitemapbestanden leest en de daarin opgenomen URL's extraheert.
Geëxtraheerde URL's worden automatisch gefilterd via drie lagen:
/admin, /wp-login, /api).gclid, utm_source, clickid).Om WebAtlasRssSitemapBot volledig te blokkeren, voeg dit toe aan je robots.txt:
User-agent: WebAtlasRssSitemapBot
Disallow: /