内部リンクチェッカー
URLを入力すると、クローラーが最大200ページの内部リンクグラフを描き出します: 各URLに何ページがリンクしているか、各ページがいくつリンクを出しているか、各ページが開始地点から何クリック離れているか、そして誰もリンクしていないページはどれか — サイトマップだけが知っている孤立ページ。表は被リンク数順に並ぶので、あなたのサイト自身が重要でないと扱っているページが最下部に来ます。CSVでダウンロード。24時間を超えて保存されるものはありません。
クロールは当社サーバーで実行されます: 1秒に1リクエスト、robots.txt を遵守、JavaScript は実行しません。保持するのは開始URLとこの要約のみで、24時間後に削除されます。
仕組み
1. 当社のクローラー(InsighthackerzBot、1秒に1リクエスト、JavaScriptなし)はまず robots.txt とそこに宣言されたサイトマップを取得し、指定したURLから内部リンクを幅優先でたどります — 同一ホストのみ、www ありなしは同じサイトとして扱います 2. 上限: 1回あたり50・100・200ページ、1ページ2 MB、1リクエスト15秒、1URLあたりリダイレクト5回。robots.txt が当クローラーのUAに禁止するURLはスキップして計数し、nofollow 指定のページは取得しますがそのリンクはたどりません 3. すべてのHTMLページは on-page SEOチェッカーと同じエンジンを通ります: title、description、H1、canonical、robots ディレクティブ、語数、alt のない画像 — 警告と失敗はページごとに保持し、HTMLは保持しません 4. クロール中に切れていると判明した内部リンク(4xx、5xx、タイムアウト)はリンク元ページとともに一覧化。外部リンクは HEAD のみで確認(サーバーが HEAD を拒否した場合は GET を1回)、1回あたり最大100件、nofollow リンクは除外 5. 結果は当社サーバー上の1ジョブです: 開始URLと要約のみを保持し、24時間後に失効し、他の用途には一切使いません 6. 被リンク数はあるURLにリンクしている異なるクロール済みページを数えます(3回リンクしている1ページは1と数える)。深度は開始URLからの最短リンク経路で、サイトマップ起点のページは深度1から始まります。孤立ページは開始ページ以外からの被リンクがゼロのクロール済みページです
内部リンク、クリック深度、孤立ページについて
内部リンクは、完全にあなたのコントロール下にある唯一のランキングシグナルです。クローラーにどのページが存在するかを、検索エンジンにどのページを重要と考えているかを伝え、リンク元ページが持つ権威を受け渡します。関連ページから多くの内部リンクを受けるページは見つけやすく上位表示されやすい一方、内部リンクのないページは外部から誰かがリンクするまで見えません。チェッカーはページごとの被リンク数を数えてその数で並べるので、表の下部が放置されたページの位置です。
クリック深度とは、訪問者 — または Googlebot — がトップページからあるページに到達するためにたどるリンクの数です。深度1はトップページからリンクされたページで、深度3以上はほとんどのサイトでクロール頻度と重要度の認識が落ちる領域です。深いページが間違いというわけではありませんが、深度4にある商品ページやサービスページは通常、コンテンツではなくナビゲーションの問題です。分布グラフはサイトの形を示します: 広くて浅いサイトと狭くて深いサイトでは、クロールのされ方が大きく異なります。
孤立ページは、クロールが見つけた — サイトマップ経由か、開始URLのリダイレクト先だったため — が、どのクロール済みページからもリンクされていないページです。存在し、インデックスされてすらいるかもしれませんが、サイト自身はそれを指していません。よくある原因: ナビゲーションから外したが削除していないページ、キャンペーン用に作ったランディングページ、リニューアル後の旧バージョン。それぞれリンクに値するか、削除に値するかのどちらかです。サイトマップにだけ残しておくと、発見はされるが決して推奨されない中途半端な状態に置かれます。
200ページのクロールは小さなサイトなら全体を、大きなサイトなら一部を見ます。部分クロールでの被リンク数は下限値で — クロール外のページもリンクしているかもしれません — 部分クロールでの孤立ページは、リンク元ページに到達しなかっただけのページかもしれません。数字は相互に比較して読み、あるセクションが不自然に薄く見える場合は別の開始URLから再実行してください。
よくある質問
- 1ページに内部リンクはいくつあるべきですか?
- 決まった数はありません。Google は古い「1ページ100リンク」のガイドラインはもう適用しないと述べており、チェッカーもしきい値を設けません。重要なのは、重要なページが重要でないページより多くの被リンクを持ち、あなたが大切にするページがゼロにならないことです。並び替えた表を目標数のためではなく、その順序を確認するために使ってください。
- 孤立ページとは何ですか?
- 他のどのクロール済みページからもリンクされていないページです。クローラーはサイトマップに載っているか、URLがそこへリダイレクトしたためにのみ見つけます。孤立ページは発見が遅く、クロールされにくく、内部の権威を持ちません。関連ページからリンクするか、古くなっているなら削除して404かリダイレクトにしてください。
- トップページが深度0で、ブログ記事が深度3なのはなぜですか?
- 深度は開始URLからの最短リンク経路です。トップ → ブログ一覧 → 一覧の2ページ目 → 記事で3クリックです。通常の原因はページネーションで、すべての記事に直接リンクするカテゴリページや、トップページの「最新記事」ブロックがあれば、新しいコンテンツなしにほとんどの記事が深度2になります。
- チェッカーはナビゲーションリンクも数えますか?
- はい — ヘッダー、フッター、サイドバーを含むHTML内のすべての <a href> を、リンク元ページごとに1回数えます。nofollow リンクはリンク元ページの発リンク合計には数えますが、リンク先の被リンク数には加えません。JavaScript で挿入されたリンクは見えません。
- 被リンク数がSEOツールの数値と違うのはなぜですか?
- よくある理由は3つ: 他のツールがより多くのページをクロールした(こちらは200で停止)、リンク元ページではなくリンク数を数えている(ヘッダーとフッターに同じリンクがあるページはここでは1と数える)、JavaScript をレンダリングしてこのクローラーには見えないリンクを見ている。いずれもページ同士の相対的な順位を大きく変えるものではありません。
- サブフォルダだけをクロールできますか?
- サブフォルダのインデックスページから開始してください。クローラーは同一ホスト上のどこへでもリンクをたどるので、ページが外へリンクしていればフォルダを出ますが、深度の数値は開始URL基準になります — セクションを監査する際はそれが望ましいことがよくあります。