robots.txt生成ツール

テンプレート、カスタムルール、AIボットのブロック、サイトマップ行を使って正しいrobots.txtを作成 — すぐにダウンロードできます。

812回閲覧

robots.txtが実際に行うこと

これはルールに従うクローラーに対して、特定のパスを取得しないよう求めるものです — クロール予算を節約し、管理画面・検索・フィルターのURLをキューから除外します。よくある誤解を正すと、これはアクセス制御ではありません(ファイルは公開されており、悪意あるボットは無視します)。また、URLをブロックしてもインデックスから削除されるわけではありません — それにはnoindexを使います。ブロックされたページも外部リンク経由でインデックスされることがあり、その場合コンテンツなしで登録されます。

このツールは今日の実際の判断をカバーします: 標準的なDisallow、WordPress用テンプレート、ボットごとのルール、サイトマップ行、そして現代的な問題 — AI学習用クローラー(GPTBot、CCBot、Google-Extendedなど)をブロックするかどうかです。ブロックすれば将来のモデル学習からコンテンツを守れますが、あなたを引用してくれるかもしれないAIの回答からも除外されます。どちらの選択も正当です。

よくある質問

ファイルはどこに置けばよいですか?

ドメインのルート直下に置きます: example.com/robots.txt。サブディレクトリに置いたコピーは無視されます。各サブドメインにはそれぞれ専用のファイルが必要です。

AIボットはブロックすべきですか?

トレードオフがあります: ブロックする(GPTBotなど)とコンテンツを学習データセットから守れますが、AIアシスタント内での露出を失います。パブリッシャーの対応はほぼ二分されています — AI経由の流入が自分にとって重要かどうかで判断してください。

関連ツール