Googlebotのクロールについて
Googlebotには実際に何が見えているのでしょうか?
Googlebotは、Googleがページをインデックス登録できるようにページを取得するプログラムです。Googlebotは訪問者と同じようにページを体験するわけではありません。レイアウトも、色も、文字体裁も、誰かがスクロールしたりクリックしたりしたときにだけ起こることもありません。
Googlebotが保持するのは、テキストとその周りにある構造です。タイトル、説明、見出し、読み取り可能な単語、たどることのできるリンクなどです。それ以外はすべて、そこへ至る途中で破棄される足場にすぎません。
その差を埋めるためにあるのが、Googlebotシミュレーターです。デザインを取り除くとほとんど空っぽに近い状態でも、ページ自体は完成しているように見えることがあり、見た目だけではそれに気づく方法がありません。
レンダリングと、ここでそれが重要な理由
Googlebotは、何年も前から単なるテキスト取得ツールではありません。まず実際のブラウザエンジンでページを実行するため、JavaScriptによって構築されたコンテンツは通常、認識されます。つまり、現在の問題は「ボットがJavaScriptを読み取れない」という単純なものではなく、より巧妙になっています。
このツールは、ページから何かを抽出する前に、ページを同じ方法でレンダリングします。そのため、以下に表示されているのは、ページ上のスクリプトが実行された後の状態です。ここに何かが表示されない場合、それはレンダリングの遅延ではなく、実際にドキュメント内に存在しないということです。
それでも表示されないものについても、把握しておく価値があります。クリックしないと表示されないコンテンツ、画像に埋め込まれたテキスト、要素が画面内にスクロールされて初めて読み込まれるもの、そして同意バナーを閉じるまでブロックされるものです。
出力の読み方
以下のパネルで確認すべき重要な点は5つあります。
- タイトルとディスクリプションが、テンプレートのデフォルトではなく、意図した内容になっているか。
- 見出し構成だけを読んでも、そのページの内容を適切に要約できているか。
- プレーンテキストに実際の主張が含まれているか、それともナビゲーションや定型文が大部分を占めているか。
- 最も頻繁に登場する単語がページの主題に関するものか、それともメニュー内の単語か。
- ページを見たときに予想されるおおよその文字数になっているか。
その4つ目は、他のどれよりも多くの人が見落としがちです。コンテンツの薄いページでは、ナビゲーションがページ内で最も多く繰り返されるテキストになっていることがよくあります。そして、クローラーが重視するのはまさにその点です。
2026年にこのビューが重要な理由
インデックス登録以降のすべての処理は、このビューを基盤に構築されます。ランキング、スニペット、そしてAIアシスタントが参照する情報源はすべて、クローラーが抽出できたテキストから始まります。つまり、ここに存在しないものは、それらすべてにも存在しません。
AIによる回答の登場により、求められる水準は一段と高くなっています。AIは、検索順位の一覧がかつてそうしていた以上に、機械が読み取れる構造に大きく依存しているからです。見出しの構成が明確で、内容が自己完結した段落は、同じ内容がインタラクティブなレイアウト全体に分散している場合よりも引用しやすくなります。
だからといって、装飾のないシンプルなページにすべきだという意味ではありません。人が読むバージョンをどのように表示する場合でも、機械が読み取るバージョンに内容の本質が含まれていることを確認すべきだ、ということです。
このツールがチェックする項目
URLを入力すると、ツールがページを取得してレンダリングし、クローラーが取得できる内容をレポートします。タイトル、メタディスクリプション、正規URL、指定された言語、見出し構造、読みやすいテキスト、最も頻繁に使用されている単語、検出された内部リンクと外部リンクの数が含まれます。
非常に長いページではテキストパネルが省略されます。また、これはサイト全体のクロールではなく、1つのURLのみを対象とします。Googlebotが抽出する内容のシミュレーションであり、Googleが実際にインデックス登録した内容の記録ではありません。
次に行うこと
ページが見えることは一方の側面にすぎません。もう一方は、ページの閲覧が許可されていることです。
クロール可能性テストでクローラーを妨げるものがないことを確認し、
レンダリング後のコンテンツチェッカーでレンダリング後にページのどれだけのコンテンツが残るかを確認し、
titleタグが役割を果たしていることを確かめましょう。