「クロール済み - インデックス未登録」とは?意味と修正方法

「クロール済み - インデックス未登録」とは?意味と修正方法

Google はあなたの URL を訪れて内容を読み、検索には載せませんでした。もう一度チャンスを与えるべきページの見分け方と、Google が示すインデックスへの戻し方を解説します。

クロール済み - インデックス未登録は、Googlebot がページを取得したものの、Google のインデックスに追加しないと判断した状態を指し、そのページは検索に表示されません。Google のページのインデックス登録レポートのヘルプでは、ページはクロールされたもののインデックスに登録されておらず、「今後インデックスに登録される場合もあれば、登録されない場合もあります」と説明されています。

原因はたいてい技術的なブロックではなく、ページそのものにあります。この記事では、URL ごとに 修正する、noindex にする、削除する のどれを選ぶべきか、そして Google によれば修正にどのくらい時間がかかるのかを見ていきます。このレポートを初めて使う方は、まず Google Search Console ガイドからどうぞ。

「クロール済み - インデックス未登録」とはどういう意味?

このステータスは、Google が ページをクロールしたうえで、インデックスに登録しないことを選んだ という意味です。Googlebot をブロックしたものは何もなく、Google が今のところそのページを除外すると決めたのです。ステータスを正しく読み解くには、2 つの違いを押さえておくと役立ちます。

クロールとインデックス登録の違い

クロール とは、Googlebot がページをダウンロードすることです。インデックス登録 とは、Google がそのページを保存し、検索結果に表示できるようにすることです。ページは何度クロールされても、一度もインデックスに登録されないことがあります。

URL 検査ツールのヘルプには、ページの品質が「インデックスに登録するに値するほど十分に高い」必要があると書かれており、公開 URL のテストではこのステータスをまったく確認できません。

「検出 - インデックス未登録」との違い

検出 - インデックス未登録 は、その 1 つ手前の段階です。Google は URL を見つけたものの、サイトに負荷をかけすぎないようにクロールを先送りしたため、前回のクロール日は空欄になっています。

検出 - インデックス未登録クロール済み - インデックス未登録
Google がクロールしたかいいえはい
前回のクロール日空欄日付あり
主な理由サイトの過負荷を避けるためクロールを先送りGoogle がページを読み、登録を見送った
まず確認することクロール能力(超大規模サイトの場合)コンテンツの品質、重複、canonical

Google は「インデックス未登録が必ずしも悪いとは限りません」とも述べています。noindex を設定したページ、robots.txt でブロックした URL、重複ページ、代わりのページがない 404 は、インデックスに登録されないのが本来の姿です。

Google がページをクロールしてもインデックスに登録しない理由

インデックス登録には、クロールにはない品質のハードルがあります。 Google のクロール バジェットのガイドによると、クロールの必要性はコンテンツの価値と独自性に応じて高まります。

該当する URL の多くは、次のいずれかの原因に当てはまります。それぞれに最初の確認ポイントを添えています。

  • 内容が薄い、または独自性がないコンテンツ:すでに上位にあるページと同じことを繰り返している。
  • 重複:タグ アーカイブ、並べ替え URL、同じトピックの 2 つの記事など。キーワード カニバリゼーションの見つけ方と直し方も参考にしてください。
  • canonical の競合:自分で宣言した canonical と Google が選択した正規 URL を比べます。Google が別の URL を選ぶと、そのページはたいてい代替ページ(適切な canonical タグあり)か、重複系のステータスに移ります。
  • ソフト 404 とリダイレクト チェーン:Google は、ソフト 404 がクロール バジェットを無駄にすると述べています。
  • クロール バジェット:問題になるのは、毎週更新される 100 万ページ以上 のサイトか、毎日更新される 1 万ページ以上 のサイトです。ほとんどのサイトでは原因になりません。
「クロール済み - インデックス未登録」の原因と、それぞれ最初に確認すること:内容が薄い・独自性がないなら、すでに上位にあるページと比べる。重複なら、同じトピックでより強いページを探す。canonical の競合なら、宣言した canonical と Google が選択した正規 URL を比べる。ソフト 404 とリダイレクト チェーンなら、ステータス コードとすべてのホップを確認する。クロール バジェットは、100 万ページ以上、または毎日 1 万ページ以上が更新されるサイトでのみ関係する
原因ごとに、まず確認すべきこと

このハードルは、日付のはっきりした 2 つの段階を経て引き上げられました。2022 年 8 月 18 日、Google はサイト全体に作用するシグナルであるヘルプフル コンテンツ アップデートを発表し、役に立たないコンテンツを削除するとサイトの他のページにも良い影響がありうると述べました。2024 年 3 月 5 日 には、クリックを集めることだけを目的としたコンテンツの表示を減らすコア アップデートを発表し、あわせて大量生成コンテンツの不正使用に関する新しいスパム ポリシーを導入しました。

Google の有用なコンテンツに関するガイダンスによると、E-E-A-T は特定のランキング要因ではなく、最も重要なのは 信頼性 であり、望ましい文字数というものもありません。ページを水増ししても解決しません。

GSC で該当ページを見つけて診断する方法

「ページのインデックス登録」レポート(旧カバレッジ レポート)を開き、サンプルを検査してから、リストをパターンごとにまとめます。Google は、500 ページ未満 のサイトではおそらくこのレポートは必要ないとしています。

ページ レポートで該当 URL を見つける

  1. Google Search Console で インデックス作成 › ページ に移動します。
  2. 「ページがインデックスに登録されなかった理由」の下にある「クロール済み - インデックス未登録」をクリックします。
  3. エクスポート をクリックしてリストをダウンロードします。

レポートに表示されるのは最大 1,000 件のサンプル URL で、必ずしも全件ではありません。大規模サイトでは、エクスポートはあくまでサンプルです。

URL 検査ツールでページを確認する

エクスポートした URL のうち 5~10 件を検査し、前回のクロール日 と Google が選択した正規 URL を確認します。正規 URL が別のページを指していれば、Google はそのページを重複と見なしています。前回のクロール日が何か月も前なら、Google はめったに戻ってきていないということです。

数百件の URL からパターンを見つける

エクスポートしたリストをフォルダ、テンプレート、URL パラメータで並べ替え、グループごとに件数を数えます。たとえば 300 件の URL が、/tag/ ページ 180 件、?sort= の URL 70 件、記事 50 件に分かれるなら、必要な判断は 300 件ではなく 3 件です。

修正、noindex、削除:各 URL にふさわしい対応を決める

各 URL の結論は、4 つのうちのどれか 1 つです。検索ユーザーがこのページにたどり着いて満足するか、そしてこのページがサイト内でそのクエリに答える唯一のページか、を自問しましょう。

ページの種類例判断方法
有用で独自性はあるが、内容が薄い詳しいトピックについての 300 文字程度のガイド改善深さと実体験に基づく情報を加える
より強いページと重複している同じクエリを狙った 2 つの記事統合コンテンツを移してから 301 リダイレクト
サイト上では有用だが、検索には不要タグ アーカイブ、サイト内検索、サンクス ページnoindexrobots メタタグまたは X-Robots-Tag
価値がなく、代わりのページもない期限切れのキャンペーン、テスト ページ削除404 または 410 を返す

最後の 2 行は、Google のクロール バジェットのガイドでも裏付けられています。削除したページには 404 または 410 を返し、重複は統合するよう勧めています。意図的に削除したページであれば、Search Console の 404 は想定どおりの結果です。

クロールされたもののインデックスに登録されていないページの判断フロー:サイト上でも検索でも価値がなければ 404 か 410 で削除する。検索結果に表示されるべきでなければ noindex にしてクロールは可能なままにする。同じクエリにすでに答えるより強いページがあれば 301 リダイレクト 1 つで統合する。それ以外は深さ、独自データ、実体験に基づく情報で改善する
改善・統合・noindex・削除

仕分けで最も間違えやすいのが noindex です。

悪い例: /tag/ ページに noindex タグを付けながら、robots.txt で /tag/ をブロックしている。Googlebot はページを取得できないので、タグを目にすることがありません。

良い例: /tag/ はクロール可能なままにし、noindex をメタタグか X-Robots-Tag ヘッダーで指定する。

Google の noindex に関するドキュメントによると、このルールは robots.txt の中では機能せず、めったにクロールされないページでは再クロールに何か月もかかることがあります。タグが読み取られると、それらの URL は「noindex タグによって除外されました」に移ります。これらのページにとっては、それが望ましい状態です。

インデックスに登録する価値のあるページを修正する方法

まずページをインデックスに登録する価値のあるものにし、それから Google に伝えます。何も変えていないページのインデックス登録をリクエストするのは、Google がすでに下した判断をもう一度繰り返させるだけです。順序は次のとおりです。

  1. コンテンツを改善する。
  2. 重複を統合し、canonical を修正する。
  3. 内部リンクを追加する。
  4. 絞り込んだサイトマップを送信し、インデックス登録をリクエストする。
インデックスに登録する価値のあるページの修正順序、4 ステップ:独自データと端的な答えでコンテンツを改善する。301 を 1 つにして canonical を一致させ、重複を統合する。トラフィックのあるインデックス済みページから内部リンクを張る。修正した URL だけのサイトマップを送信し、インデックス登録をリクエストして修正を検証する
まずページを直し、それから Google に伝える

コンテンツの深さと独自性を高める

文字数ではなくクエリを基準に書き直します。独自のデータ、スクリーンショット、具体例を加え、冒頭近くに端的な答えを置きましょう。

たとえば 300 文字程度の薄いガイドなら、実体験に基づくデータセットと具体例を加え、すでにトラフィックのある 2 つの記事からリンクを張り、そのうえで初めて絞り込んだサイトマップに追加します。

重複を統合し、canonical を修正する

2 つの URL が同じ内容を扱っているなら、1 つを残して有用なコンテンツをそちらに移し、もう一方をチェーンなしで直接 301 リダイレクト します。そのうえで、canonical、サイトマップ、内部リンクが一致していること、余計な noindex が残っていないことを確認します。

Google がすでに評価しているページから内部リンクを張る

修正した各ページに、トラフィックのあるインデックス済みページから、内容がわかるアンカー テキストでリンクします。どのサイト クローラーでも、被リンク数ゼロで絞り込めば孤立ページ(内部リンクがゼロのページ)を一覧にできます。詳しい方法は、この内部リンク戦略のガイドで解説しています。

あわせて、スマートフォンでの表示と「ウェブに関する主な指標」レポートも確認しましょう。モバイルで崩れているページかどうかは、すぐに判別できます。

絞り込んだサイトマップを送信し、インデックス登録をリクエストする

修正した URL だけを含むサイトマップを作成して送信し、修正を検証 をクリックする前に、そのサイトマップでページ レポートを絞り込みます。Google は、検証を速めるためにこの方法を勧めています。まず現在のファイルが必要なら、サイトのサイトマップを見つける方法を確認してください。

Google は priority と changefreq を無視するため、代わりに lastmod を正確に保ちましょう。そのうえで、優先度の高い URL について URL 検査ツールで インデックス登録をリクエスト をクリックします。Google は上限を設けており、リクエストを繰り返しても速くはならないとしています。

修正後、インデックス登録までどのくらいかかる?

1 日から数週間程度を見込んでください。インデックス登録が保証されることはありません。Google はページによって異なる期間を示しているので、ここで並べて比較します。

行ったことGoogle の説明出典
再クロールを依頼した数日から数週間Google に再クロールを依頼する
インデックス登録をリクエスト通常 1 日ほど、最長 1~2 週間。1 日あたりの上限ありURL 検査ツールのヘルプ
修正を検証最長で約 2 週間、それよりずっと長くかかることもページのインデックス登録のヘルプ

これは Google が示す目安であり、回復事例ではありません。ページ レポートを毎週確認し、これらの期間を過ぎても修正した URL に変化がなければ、コンテンツに立ち返りましょう。

新しいページがこのステータスにならないようにする方法

予防とは習慣のことです。公開前に各ページを確認し、毎月 Search Console を見直しましょう。公開前に、そのページが次の条件を満たしているか確認します。

  • サイト内の他のページが答えていないクエリに答えている。
  • 独自のデータ、例、経験が加わっている。
  • 自己参照の canonical があり、余計な noindex がない。
  • 正確な lastmod とともにサイトマップに含まれている。
  • 著者名が明記され、該当する場合は構造化データがある。
  • 関連するインデックス済みページからリンクされている。

月に 1 回、ページ レポートを前月と比べましょう。問題は、最後の該当例がなくなってから 90 日間 はリストに表示され続けます。1,000 ページを超えるサイトでは、クロールの統計情報レポートも確認しましょう。

SEOcrawl AI は、技術面を大規模に処理します。Crawler はすべてのページをスキャンして Audit Health Score を算出し、問題を Indexability、Crawlability、On-Page などに分けて表示します。Indexation ビューは URL を Search Console のカバレッジ状態ごとにグループ化するので、「クロール済み - インデックス未登録」に何件あるかを確認し、その推移を追跡できます。

クロールとクロールの間は、SEO Monitor が、重要なページに noindex が付いたとき、canonical が変わったとき、404 を返したとき、サイトマップから外れたときにアラートを送ります。同じプラットフォームで ChatGPT、Claude、Gemini、Perplexity、Copilot におけるブランドの可視性も追跡できるので、SEO と GEO を一か所で管理できます。

よくある質問

「クロール済み - インデックス未登録」とはどういう意味ですか?

Googlebot がページを取得したものの、Google のインデックスに追加しないと判断した 状態で、そのページは検索に表示されません。クロールを妨げるものは何もなく、Google はページを読んだうえで、今のところ除外すると決めたのです。手動による対策(ペナルティ)ではなく、このページは今後インデックスに登録される場合もあれば、登録されない場合もあります。

「検出 - インデックス未登録」と同じものですか?

違います。検出は、Google が URL を把握しているもののクロールを先送りした状態 で、前回のクロール日は空欄です。「クロール済み」は Google がすでにページを訪れて読み、そのうえでインデックスに登録しないと判断した状態です。「検出」なら超大規模サイトのクロール能力を、「クロール済み」ならコンテンツの品質、重複、canonical を確認します。

「クロール済み - インデックス未登録」は SEO に悪影響がありますか?

それ自体は問題ありません。このステータスはペナルティではなく、該当ページが失うのはそのページ自身の検索トラフィックだけです。リスクは量にあります。Google は役に立たないコンテンツの割合が大きいことを、サイト全体のシグナルとして扱うからです。タグ アーカイブがインデックスから外れても損失はありませんが、商品ページなら損失になります。公開するたびに件数が増えるなら、個別 URL のリストではなく、サイト全体のコンテンツの問題として扱いましょう。

修正後、ページがインデックスに登録されるまでどのくらいかかりますか?

1 日から数週間程度 を見込んでください。また、インデックス登録が保証されることはありません。Google によると、再クロールには数日から数週間、インデックス登録のリクエストは通常 1 日ほどで処理されますが 1~2 週間かかることもあり、修正の検証は通常最長で約 2 週間かかります。

インデックス登録をリクエストすれば効果がありますか?

ページを変更した後に限ります。何も変えていないページのインデックス登録をリクエストするのは、Google がすでに下した判断をもう一度繰り返させるだけです。リクエストには 1 日あたりの上限があり、Google は同じ URL を何度送信しても処理は速くならないとしています。

ページを XML サイトマップに追加すると効果がありますか?

Google が URL を見つける助けにはなりますが、インデックス登録の助けにはなりません。Google は送信されたサイトマップを「ヒントにすぎない」としており、これらのページはすでに発見され、読まれています。修正後のサイトマップの役割は、再確認してほしい URL をまとめることです。サイトマップ 1 ファイルに含められるのは最大 50,000 件の URL、または 50 MB までです。

「クロール済み - インデックス未登録」の検証が失敗したのはなぜですか?

検証は、グループ内にまだ修正されていない URL を Google が 1 件でも見つけた時点で停止します。そのため、修正漏れのページが 1 つあるだけでバッチ全体が失敗することがあります。グループ内のすべての URL を修正するか、修正した URL だけのサイトマップでレポートを絞り込んでグループを小さくしてから、もう一度検証しましょう。

Google がクロールしてもインデックスに登録しないページに、SEOcrawl AI はどう役立ちますか?

SEOcrawl AI は、このステータスの背後にあるサイト内の原因を見つけます。Crawler は各 URL の ヘルススコア、HTTP ステータス コード、クロールの深さ を表示するので、Google がたどり着きにくいページを見つけられます。Indexation ビューは URL を Search Console のカバレッジ状態ごとにグループ化し、SEO Monitor は、重要なページに noindex が付いたとき、canonical が変わったとき、404 を返したとき、サイトマップから外れたときにアラートを送ります。

著者: David Kaufmann

David Kaufmann

私はこの10年以上、SEOに完全に夢中になって過ごしてきました。正直なところ、他の生き方は考えられません。

私のキャリアが新たな次元に到達したのは、Chess.com でシニアSEOスペシャリストとして働いたときでした。Chess.com はインターネット全体で最も訪問数の多い上位100サイトの1つです。数百万ページ、数十言語、そして最も競争の激しい SERPs の1つという規模で仕事をした経験は、どんなコースや資格でも得られないことを教えてくれました。あの経験は、本当に優れたSEOとは何かという私の視点を一変させ、それ以降に私が築いてきたすべての土台となりました。

その経験から、私は SEO Alive を創業しました。オーガニック成長に本気で取り組むブランドのためのエージェンシーです。私たちは dashboards や月次レポートを売るためにここにいるのではありません。本当に成果を動かす戦略を構築するためにここにいます。クラシカルなSEOの最良の部分と、Generative Engine Optimization (GEO) というエキサイティングな新しい世界を組み合わせ、あなたのブランドが Google の青いリンクだけでなく、ChatGPT、Perplexity、Google AI Overviews が毎日何百万人もの人々に届けている AI 生成の回答の中にも確実に表示されるようにします。

そして、この両方の世界をきちんと扱えるツールが見つからなかったので、自分で作りました。それが SEOcrawl AI です。rankings、テクニカル監査、backlinks モニタリング、crawl ヘルス、そして AI ブランド可視性トラッキングを1つの場所に統合した、エンタープライズ向けのSEOインテリジェンスプラットフォームです。まさに、ずっと存在してほしいと願っていたプラットフォームです。

→ David のすべての記事を読む
著者の他の記事: David Kaufmann

この著者の他のコンテンツをご覧ください