SEO・集客 UPDATE 2026.10.01

robots.txtとは?SEOでクロールを制御する書き方・noindexとの違い・確認方法

robots.txtとは何か。クロール制御の仕組み、Disallowの書き方、noindexとの違い、WordPressでの注意点、Search Consoleでの確認方法、よくある設定ミスまで実務ベースで解説します。

SEO / ROBOTS.TXT / CRAWLING

Googleは、 Webサイト内のURLを見つけると、 Googlebotなどのクローラを使ってページを取得します。

しかし、 サイト内のすべてのURLを クロールしてほしいとは限りません。

管理画面、 内部検索結果、 不要なパラメータURLなど、 クロールさせる必要がないURLもあります。

そのとき使われるのが、 robots.txtです。

robots.txtは、 検索エンジンのクローラに対して、 どのURLやディレクトリをクロールしないでほしいかを伝えるファイル です。

この記事では、 robots.txtの基本、 書き方、 noindexとの違い、 WordPressでの注意点、 Search Consoleでの確認方法まで整理します。

01
WHAT IS ROBOTS.TXT?

robots.txtとは?

robots.txtは、 検索エンジンのクローラに対して、 クロールしてほしくないURLやディレクトリを伝えるためのテキストファイルです。

通常は、 ドメイン直下に配置されます。

たとえば、 example.comの場合は、 https://example.com/robots.txt というURLになります。

01 CRAWLER

Googlebot

サイトへ クロールに来る。

→
02 ROBOTS.TXT

ルール確認

クロール可能な URLを確認する。

→
03 ALLOW

許可

ページを クロールする。

/
04 DISALLOW

制限

指定URLを クロールしない。

POINT

robots.txtは、 検索順位を直接上げる設定ではなく、 クローラのアクセス範囲を整理するための仕組み です。

02
CRAWL CONTROL

robots.txtは
何を制御する?

robots.txtが制御するのは、 基本的に検索エンジンによるクロールです。

サイト内に、 クロールさせる必要がないURLが大量に存在する場合、 不要なクロールを抑えるために使われます。

一方で、 一般的な小規模サイトでは、 必ずしも複雑なrobots.txtを用意する必要はありません。

robots.txtによるクロール制御とインデックス制御の違いを、Googlebotの動きと検索結果への登録に分けて説明した図解
robots.txtが制御するのは主にクロールです。 検索結果への登録を直接制御するnoindexとは役割が異なります。
01

管理系URL

クロールする必要がない 管理画面など。

02

大量のパラメータ

不要なURLが 大量生成される場合。

03

内部検索

サイト内検索結果など クロール不要なURL。

04

クロール整理

重要なページへ クロールを集中させる。

03
SYNTAX

robots.txtの
基本的な書き方

robots.txtでは、 主にUser-agentとDisallowを使って クロールルールを記述します。

robots.txt BASIC EXAMPLE
User-agent: *
Disallow: /private/
USER-AGENT

対象クローラ

「*」なら 対応するすべてのクローラを対象とします。

DISALLOW

クロール禁止

指定したパスを クロールしないよう伝えます。

01

Disallow: /admin/

02

Disallow: /search/

03

Disallow: /private/

04

Disallow:

04
ROBOTS.TXT / NOINDEX

robots.txtと
noindexは違う

robots.txtとnoindexは、 混同されやすい設定です。

しかし、 役割は明確に異なります。

robots.txtはクロールを止め、noindexは検索インデックスへの登録を止めるという違いを比較した図解
robots.txtはクローラのアクセスを制御し、 noindexは検索結果へのインデックス登録を制御します。
ROBOTS.TXT

クロールを止める

Googlebotが ページ内容を取得しないよう制御します。

NOINDEX

インデックスを止める

Google検索結果へ ページを登録しないよう伝えます。

IMPORTANT

robots.txtでページをブロックすると、 Googleがそのページ内の noindexを読み取れない場合があります。

RELATED Googleにインデックスされない原因を見る →
05
DO NOT BLOCK

CSS・JavaScriptを
むやみに止めない

Googleは、 ページをユーザーに近い状態で理解するために、 HTMLだけでなくCSSやJavaScriptなどのリソースも利用します。

ページの意味や表示に必要なリソースを robots.txtでブロックすると、 Googleがページを正しく理解しにくくなる場合があります。

HTML

本文

ページ内容

+
CSS

表示

レイアウト

+
JS

動作

レンダリング

→
RENDER

ページ理解

Googleが解析

CHECK

「不要そうだから止める」ではなく、 Googleがページを理解するために必要なリソースか を確認してから設定します。

06
WORDPRESS

WordPressで
注意したいポイント

WordPressでは、 サーバー上にrobots.txtファイルを置いていなくても、 仮想的なrobots.txtが表示される場合があります。

また、 サイト公開時に検索エンジンへの表示設定や SEOプラグインの設定が影響することもあります。

robots.txtだけを見るのではなく、 noindexやサイト全体の公開設定もあわせて確認します。

01

/robots.txt を実際に開く

02

WordPressの公開設定を確認

03

SEOプラグインを確認

04

noindexも確認

05

サイトマップも確認

06

Search Consoleで確認

07
SITEMAP

robots.txtから
サイトマップを伝える

robots.txtには、 XMLサイトマップのURLを記述することもできます。

robots.txtとXMLサイトマップは 役割が異なりますが、 どちらもクロール設計の一部として確認します。

robots.txt SITEMAP EXAMPLE
User-agent: *
Disallow:

Sitemap: https://example.com/sitemap.xml
ROBOTS.TXT

クロール範囲

どこをクロールしないかを伝える。

XML SITEMAP

重要URL

見つけてほしいURLを伝える。

RELATED XMLサイトマップの使い方を見る →
08
SEARCH CONSOLE

Search Consoleで
robots.txtを確認する

robots.txtを変更したら、 ブラウザ上で表示できるかを見るだけでなく、 Googleがどのrobots.txtを認識しているかも確認します。

Search Consoleのrobots.txtレポートでは、 Googleが検出したファイルや、 最終クロール日、 警告・エラーなどを確認できます。

Search Consoleでrobots.txtのファイル、取得状態、最終クロール、警告やエラーを確認する方法を整理した図解
Search Consoleでは、 Googleが認識しているrobots.txtの状態や、 最終クロール、警告・エラーを確認します。
01

ファイル

Googleが認識している robots.txtを確認。

02

取得状態

正常に取得 できているか。

03

最終クロール

最後にGoogleが 取得した時点を確認。

04

警告・エラー

構文や取得上の 問題を確認。

09
COMMON MISTAKES

robots.txtで
よくある設定ミス

01

サイト全体をブロック

公開後も Disallow: / が残っている。

02

noindex代わりに使う

検索結果から消す目的で robots.txtを使う。

03

CSS・JSを止める

ページ表示に必要な リソースをブロックする。

04

パスを誤る

意図しない ディレクトリまで止める。

05

本番反映後に未確認

Googleが認識した robots.txtを見ていない。

06

サーバーエラー

robots.txt取得時に 5xxなどを返している。

RULE

robots.txtは、 「止めた方が安全」ではなく、 本当にクロール不要なURLだけを制御する という考え方が基本です。

FAQ
FREQUENTLY ASKED QUESTIONS

robots.txtについて
よくある質問

robots.txtはSEOに必要ですか? +

すべてのサイトで複雑な設定が必要なわけではありません。 小規模サイトでは、 クロールを制御する必要がほとんどない場合もあります。

robots.txtでページを検索結果から消せますか? +

検索結果から除外するための仕組みとしては適していません。 robots.txtは主にクロール制御に使い、 検索結果に表示させたくないページでは noindexなど適切な方法を使います。

robots.txtとnoindexはどちらが強いですか? +

強弱で比べるものではなく、 役割が異なります。 robots.txtはクロール制御、 noindexはインデックス制御です。

robots.txtにサイトマップを書く必要がありますか? +

XMLサイトマップの場所を robots.txt内で伝えることができます。 Search Consoleからサイトマップを送信する方法と併用できます。

robots.txtがないとGoogleはクロールできませんか? +

robots.txtは必須ではありません。 robots.txtが存在しないこと自体が クロールを禁止する意味になるわけではありません。

robots.txtを変更したらすぐ反映されますか? +

Googleがrobots.txtを再取得するまで タイムラグが生じる場合があります。 Search ConsoleでGoogleが認識している状態を確認します。

SUMMARY

検索から消すのではなく、
クロールする範囲を整える。

robots.txtは、 検索エンジンのクローラに対して クロールしてほしくないURLを伝えるためのファイルです。

ただし、 検索結果からページを消すための仕組みではありません。

robots.txt、 noindex、 canonical、 XMLサイトマップには それぞれ異なる役割があります。

何を制御したいのかを整理したうえで、 必要なURLだけを適切に設定し、 Search ConsoleでGoogleの認識まで確認することが重要です。

01

目的確認

02

クロール整理

03

noindexと区別

04

設定確認

05

Googleで確認

RELATED COLUMN

SEO / CRAWLING / TECHNICAL

Googleが読みやすい、
サイト構造へ。

LEONOIRでは、 robots.txt・XMLサイトマップ・canonical・インデックスなどの 技術的なSEOから、 コンテンツ・内部リンク・サイト構造まで Webサイト全体の改善をご相談いただけます。

CONTACT US SEO・サイト改善を相談する ↗

START A PROJECT

何を頼むべきか、
まだ決まっていなくてもいい。

課題を整理するところからご相談ください。
事業に必要な方法を一緒に考えます。

CONTACT US お問い合わせ・ご相談 ↗