guides
AIクローラー向けrobots.txt:検索・学習・アクセス制御の違い
AI検索を残しながら学習用クローラーだけ制御するにはrobots.txtをどう設定する?
ガイドを読む →無料のクロール制御ツール
robots.txtを作成し、編集中に一般的なミスを確認して、そのままコピーまたはダウンロードできます。生成処理はブラウザ内で行われ、アカウント登録は不要です。
簡易モードは素早い設定に向いています。詳細エディタではすべてのクローラグループとルールを編集できます。
まず中立設定から始め、方針に合う場合だけAI関連クローラを制限してください。
中立の初期設定です。パスルールで明示的にブロックしない限り、検索、AI検索、AI制御クローラを許可します。
候補パスから選ぶか、独自パスを追加します。互換クローラに意図的に避けてほしいパスだけブロックしてください。
候補パス
任意のサイトパスを追加できます。先頭に / がない場合は自動追加され、完全なHTTP(S) URLはパスとクエリだけに変換されます。
検索
初期状態で許可
AI検索
初期状態で許可
AI制御 / 学習
初期状態で許可
リアルタイム出力です。生成と検証はブラウザ内で処理されます。
User-agent: * 構文または互換性の警告は検出されませんでした。
User-agent、Allow、Disallow、Sitemapを1行ずつ手作業で整形せずに作成できます。
サイト全体のブロック、不正なSitemap URL、非標準ディレクティブ、インデックス登録に関するよくある誤解を警告します。
生成から検証、公開中ファイルの確認、URL単位のテストまで同じサイト内で進められます。
標準サイト、WordPress、Blogger、ステージング向けの設定から始め、各ルールを自分のサイトに合わせて確認します。
AllowまたはDisallowのパスを1行ずつ入力し、ルールを適用する主なUser-agentグループを指定します。
詳細設定では、主なルールと異なる動作にしたいクローラ用に別グループを作成できます。
https://example.com/sitemap.xml のような絶対HTTP(S) URLを使用します。
見た目が正しいファイルでも危険なルールを含むことがあります。公開前にエラーを修正し、警告を確認してください。
標準の場所は /robots.txt です。例: https://example.com/robots.txt
robots.txtはクローラのアクセスを制御する仕組みです。認証ではなく、URLのクロールをブロックしても検索結果に表示されないことを保証するものではありません。
詳細設定ではクローラごとのトークンを分けて扱います。提供元によっては、検索用のクローラと、モデル開発やAI製品の制御用トークンを別々に公開しています。主なUser-agentルールと意図的に異なる動作にしたい場合だけ、個別ルールを設定してください。
GooglebotやBingbotのような検索クローラは、検索サービスのためにコンテンツを発見しクロールします。
OAI-SearchBot、Claude-SearchBot、PerplexityBotなどがあります。アクセスを変更する前に提供元の最新ドキュメントを確認してください。
GPTBot、ClaudeBot、Google-Extendedなどは提供元ごとに目的が異なり、同じものとして扱うべきではありません。
各設定は編集可能な出発点であり、すべてのサイトに共通する最適解ではありません。公開前に実際のURL構成を確認してください。
ファイル作成から検証、公開確認、URLテストへ目的が変わったら、専用ツールを使ってください。
ナレッジベース
クロール・インデックス制御、ホストごとの適用範囲、Sitemap、URLパラメータ、キャッシュ、robots.txtのトラブルシューティングを実務向けに解説します。
全許可、パスのブロック、Sitemap、ワイルドカード、クローラー別ルールなど実用的なrobots.txt例を確認できます。
→AIクローラー、noindex、Sitemap、サブドメイン、URLパラメータ、キャッシュ、文字コードなどrobots.txtの実務知識を解説します。
→Shopify、Next.js、Wix、Squarespace、Webflow、Magento / Adobe Commerceのrobots.txt設定と確認手順を解説します。
→guides
AI検索を残しながら学習用クローラーだけ制御するにはrobots.txtをどう設定する?
ガイドを読む →guides
robots.txtだけでGoogleのインデックス登録を防げる?noindexはいつ使う?
ガイドを読む →guides
robots.txtにSitemapをどこへ追加し、複数サイトマップをどう確認する?
ガイドを読む →guides
robots.txtで複数のAllowとDisallowが一致したとき、どのルールが優先される?
ガイドを読む →guides
ルートドメインのrobots.txtはサブドメインや別プロトコルにも適用される?
ガイドを読む →platforms
Next.jsで本番を誤ブロックせずrobots.txtを設定するには?
ガイドを読む →ルールとクローラ固有の情報は、他のSEOツールから転載するのではなく、一次標準と提供元の公式ドキュメントに基づいて確認しています。
Robots Exclusion Protocolの構文、マッチング、グループ化、パーセントエンコードの仕様。
Google固有のrobots.txt動作と対応フィールド。
OAI-SearchBotとGPTBotの目的と制御。
ClaudeBot、Claude-SearchBot、Claude-Userの動作。
PerplexityBotのインデックス動作とrobots.txtへの準拠。
Geminiのトレーニングやグラウンディングに関するGoogle-Extendedの制御。
制御対象ホストのルート、通常は /robots.txt に配置します。
robots.txtの主な役割はクロール制御です。インデックス登録を防ぎたい場合は、Disallowだけに頼らず適切なインデックス制御を使用してください。
GooglebotはCrawl-delayに対応していないため、この検証ツールでは警告を表示します。
一律にブロックする必要はありません。検索、ユーザー要求による取得、モデル開発など用途が異なる場合があります。クローラごとに提供元の最新ドキュメントを確認して判断してください。
はい。主要な生成と検証はブラウザ内で行われ、アカウントは不要です。