クローラードキュメント
RssSitemapBot。
RSS、Atom、サイトマップファイルを読み取り、グローバルなインデックス登録キューを補充します。
クローラードキュメント
RSS、Atom、サイトマップファイルを読み取り、グローバルなインデックス登録キューを補充します。
WebAtlasRssSitemapBotは以下のUser-Agentで識別されます。
WebAtlasRssSitemapBot/1.1 (+https://webatlasindex.pl/rsssitemap-bot.php)
送信されたRSS/Atomフィードとサイトマップファイルを読み取り、含まれるURLを抽出する軽量クローラーです。
抽出されたURLは自動的に3つの階層でフィルタリングされます:
/admin、/wp-login、/api)。gclid、utm_source、clickid)。WebAtlasRssSitemapBotを完全にブロックするには、robots.txtに以下を追加してください:
User-agent: WebAtlasRssSitemapBot
Disallow: /