本文にスキップ
weballin

weballin DIGIWIKI

検索エンジンの仕組み

検索エンジンはWebページを見つけて収集した後、内容をインデックス登録し、ユーザーの検索語に合った結果を選択して表示します。

weballin

ページを作成しただけで、すべての段階を必ず通過するわけではありません。発見、収集、インデックス、結果の表示を区別することで、検索表示の問題が発生した場所をより正確に判断できます。

発見とクロール

検索エンジンは既に知っているページのリンクやサイトマップなどを通じてURLを発見します。見つかったアドレスの内容を取得する操作はクロールです。アドレスを知っていても、サーバーエラー、アクセス制限、または収集ポリシーのために実際のコンテンツを取得できない可能性があります。

Webブラウザで見える内容と、検索エンジンのクローラが受け取る内容が同じかどうかは別途確認する必要があります。ログイン後にのみ表示される内容、実行に問題があるJavaScript、CDNのブロックなどが影響を与える可能性があるためです。内部で行ったクロール結果と検索エンジンが記録した収集結果も区別します。

インデックス登録と代表ページの選択

インデックスは、取得した情報を分析して検索に使用できるように保存する手順です。検索エンジンは同様のページのうち代表URLを判断することもあります。このプロセスでは、運営者が指定した正規URLと検索エンジンが選択したアドレスが異なる場合があります。

したがって、サイトマップにあるという事実をインデックス完了の証拠としません。 robots.txt、noindex、およびcanonicalは異なる目的を持つ設定なので、1つのブロック方法のように扱うべきではありません。問題のURLがそもそも公開し、検索結果に出すべきページかどうかから確認します。

検索結果を表示

検索語が入力されると、検索エンジンは関連性、品質、場所、デバイスなどのコンテキストを考慮して結果を提供します。 Google の公式動作原理ガイドは、クロール、インデックス、検索結果の提供を区別し、指針を遵守してもインデックスと検索表示は保証されないと説明します。

検索表示がない場合の診断質問

  • そのページへのパブリックリンクと正しいURLがありますか?
  • 検索エンジンはサーバーから正常な応答と必要な本文を受け取ることができますか?
  • インデックス登録を除外する指示や、別の正規URLの選択がありませんか。
  • インデックス登録されている場合、どの検索意図に答える必要があるページですか?

これは確認の順序を決める方法です。インデックス登録の問題を解決する必要がある状況では、文章の長さだけを増やしたり、コンテンツが不足しているページにサイトマップを繰り返し送信するといった対応を減らすことができます。

参考資料