lockファイルはサーバーに送信されません
robots. txt生成ツールは、検索エンジンクローラーのアクセスを制御するrobots. txtファイルを簡単に作成する無料オンラインツールです。 Allow/Disallowルール、サイトマップURL、クロール遅延を設定できます。 ブラウザ内で処理されます。
robots.txt生成の使い方は?
- ユーザーエージェント(クローラー)を選択します。
- AllowとDisallowのパスルールを設定します。
- サイトマップURLを追加して、生成されたrobots.txtをコピーします。
robots.txt生成に関するよくある質問
robots.txtとは何ですか?
robots.txtはWebサイトのルートに配置され、検索エンジンのクローラーにどのページをクロールまたは無視すべきかを伝えるテキストファイルです。
robots.txtでページを検索結果から完全に隠せますか?
いいえ。robots.txtはクロールのみを制御し、他のサイトからリンクされている場合は検索結果に表示される可能性があります。完全な除外にはnoindexメタタグを使用してください。
AIクローラーが自分のサイトを学習に使わないようにするには?
robots.txtでGPTBot、ClaudeBot、PerplexityBotのように各社が公開しているクローラー名を指定してDisallowを設定します。最近ではContent-Signalという方式で、search=yes、ai-train=noのように用途ごとの可否を1行で示す方法も使われます。ただしrobots.txtは規則に従うと宣言したクローラーにだけ有効な「お願い」であって技術的な遮断ではないため、絶対に取られては困る内容はログインの背後に置くべきです。
robots.txtの書き間違いでサイト全体が検索から消えることもありますか?
はい。Disallow: / の1行だけでサイト全体がクロールから除外されます。開発サーバーに設定したこの記述を消さないまま本番へ公開してしまう事故は、実際によく起こります。公開直後にrobots.txtをブラウザで直接開いて確認し、Google Search Consoleのrobots.txtテスターで主要ページが許可されているか点検してください。インデックスから消えたあと元に戻るには数日から数週間かかります。
robots.txt生成を上手に活用するには?
- robots.txtはクロールを止めるだけです。検索結果から消すにはnoindexメタタグを使います。
- GooglebotとBingbotで扱いを変えたい場合はUser-agentごとにルールを分けましょう。
- 最終行にSitemap: https://... と絶対URLを書いておくとクロールが早まります。
Powered by Patrache Studio Tools