【ロボッツテキスト】
robots.txt とは?
最終更新:
💡 クローラーに渡す、巡回ルールの案内
サイトの最上位パスに置く /robots.txt で、クローラーに巡回してよいURLの範囲を伝える仕組み。従うクローラーの巡回を制御する規約であり、認証によるアクセス制限や検索結果からの確実な除外とは異なる。
📌 このページのポイント
robots.txtは何をするファイル?
クローラーに「この範囲は巡回しないで」と伝えるルール表だよ。たとえば https://example.com/robots.txt のように、サイトの最上位パスへ置く。ファイルを見たクローラーが、対象のルールに従って巡回するんだ。
どんな書き方をするの?
例として、1行目に「User-agent: *」、次の行に「Disallow: /admin/」と書くよ。専用グループのないクローラーに、/admin/ 以下を巡回しないよう伝える。Allowで許可するパスも書ける。各指定は別々の行にするんだ。
これで管理ページを守れる?
検索結果からも消えるの?
AI向けの拒否も全部これで済む?
まとめ:ざっくりこれだけ覚えればOK!
「robots.txt」って出てきたら「クローラーに伝えるサイトの巡回ルール」と思えばだいたいOK!
📖 おまけ:英語の意味
「robots.txt」 = ロボット用テキストファイル
💬 robotsは自動巡回プログラムを指すよ。1994年にMartijn Kosterが定義したRobots Exclusion Protocolをもとに、2022年にRFC 9309として標準化されたんだ。