学ぶ 用語集

robots.txt

robots.txt はサイトのルートに置く小さなファイルで、クローラーがサイトのどの部分を取得してよいかを伝えます。

まずはメールで。robots.txt のURLと気になるページを送ってください。次に見るべき点を具体的に返します。

インデックスのスイッチではなく、クローラーへの案内として使います。

robots.txt はクロールを止められますが、Google がすでに知っているURLを確実にGoogleから消すものではありません。

robots.txt は通常 /robots.txt にあるプレーンテキストのファイルです。クローラーに、取得してよいパスと取得しないでほしいパスを伝えます。

検索エンジンは通常これを尊重しますが、プライバシー対策ではなく、検索結果からページを消す確実な方法でもありません。

インデックスさせたくないページには、状況に応じて noindex、canonical、削除、リダイレクト、パスワード保護、Search Console での削除なども必要です。


robots.txt で制御できること 🧭

  • 特定パスのクロール
  • XMLサイトマップ 行によるサイトマップの発見
  • User-agentAllowDisallow を使ったクローラー別のルール

robots.txt は技術的な SEO の一部です。整ったXMLサイトマップ、canonical、そして順位を取りたいページをクロール可能にする設計と合わせて使うと効果的です。

よくある失敗は、robots.txt でページをブロックしながら、そのページに noindex を置くことです。Google がページをクロールできなければ、noindex を見られない可能性があります。


robots.txt のよくある質問 🙋

robots.txt とは何ですか?

robots.txt は、サイトのクローラー向け指示を書くプレーンテキストファイルです。

robots.txt はどこにありますか?

通常はドメインのルート、たとえば https://example.com/robots.txt にあります。

robots.txt でGoogleからページを消せますか?

確実ではありません。クロールは止められますが、検索から消すには状況に応じて noindex、削除、リダイレクト、パスワード保護、Search Consoleでの削除が必要です。

robots.txt に sitemap を入れるべきですか?

はい。XMLサイトマップ を robots.txt に書いておくと、クローラーが見つけやすくなります。

robots.txt で悪質なボットを止められますか?

従うことを選ぶボットだけです。セキュリティや不正対策には、サーバー、ファイアウォール、アクセス制御のルールが必要です。

用語集に戻る。

robots.txt が役立っているのか、違うものを止めているのか迷っていますか?

robots.txt のURLと気になるページを送ってください。問題がクロール、インデックス、canonical、サイト構造のどこにあるか確認できます。

他の人にも役立ちそうですか?共有: