Crawler-dokumentation
RssSitemapBot.
Läser RSS-, Atom- och sitemap-filer för att fylla på vår globala indexeringskö.
Crawler-dokumentation
Läser RSS-, Atom- och sitemap-filer för att fylla på vår globala indexeringskö.
WebAtlasRssSitemapBot identifierar sig med följande User-Agent.
WebAtlasRssSitemapBot/1.1 (+https://webatlasindex.pl/rsssitemap-bot.php)
En lättviktig crawler vars uppgift är att läsa inskickade RSS-/Atom-flöden och sitemap-filer och extrahera de URL:er de innehåller.
Extraherade URL:er filtreras automatiskt genom tre lager:
/admin, /wp-login, /api).gclid, utm_source, clickid).För att blockera WebAtlasRssSitemapBot helt, lägg till detta i din robots.txt:
User-agent: WebAtlasRssSitemapBot
Disallow: /