内部リンクチェッカー

URLを入力すると、クローラーが最大200ページの内部リンクグラフを描き出します: 各URLに何ページがリンクしているか、各ページがいくつリンクを出しているか、各ページが開始地点から何クリック離れているか、そして誰もリンクしていないページはどれか — サイトマップだけが知っている孤立ページ。表は被リンク数順に並ぶので、あなたのサイト自身が重要でないと扱っているページが最下部に来ます。CSVでダウンロード。24時間を超えて保存されるものはありません。

一意の外部URLごとにHEADリクエストを1回、最大100件。チェックを外すとクロールが速くなります。

クロールは当社サーバーで実行されます: 1秒に1リクエスト、robots.txt を遵守、JavaScript は実行しません。保持するのは開始URLとこの要約のみで、24時間後に削除されます。

仕組み

1. 当社のクローラー(InsighthackerzBot、1秒に1リクエスト、JavaScriptなし)はまず robots.txt とそこに宣言されたサイトマップを取得し、指定したURLから内部リンクを幅優先でたどります — 同一ホストのみ、www ありなしは同じサイトとして扱います
2. 上限: 1回あたり50・100・200ページ、1ページ2 MB、1リクエスト15秒、1URLあたりリダイレクト5回。robots.txt が当クローラーのUAに禁止するURLはスキップして計数し、nofollow 指定のページは取得しますがそのリンクはたどりません
3. すべてのHTMLページは on-page SEOチェッカーと同じエンジンを通ります: title、description、H1、canonical、robots ディレクティブ、語数、alt のない画像 — 警告と失敗はページごとに保持し、HTMLは保持しません
4. クロール中に切れていると判明した内部リンク(4xx、5xx、タイムアウト)はリンク元ページとともに一覧化。外部リンクは HEAD のみで確認(サーバーが HEAD を拒否した場合は GET を1回)、1回あたり最大100件、nofollow リンクは除外
5. 結果は当社サーバー上の1ジョブです: 開始URLと要約のみを保持し、24時間後に失効し、他の用途には一切使いません
6. 被リンク数はあるURLにリンクしている異なるクロール済みページを数えます(3回リンクしている1ページは1と数える)。深度は開始URLからの最短リンク経路で、サイトマップ起点のページは深度1から始まります。孤立ページは開始ページ以外からの被リンクがゼロのクロール済みページです

内部リンク、クリック深度、孤立ページについて

内部リンクは、完全にあなたのコントロール下にある唯一のランキングシグナルです。クローラーにどのページが存在するかを、検索エンジンにどのページを重要と考えているかを伝え、リンク元ページが持つ権威を受け渡します。関連ページから多くの内部リンクを受けるページは見つけやすく上位表示されやすい一方、内部リンクのないページは外部から誰かがリンクするまで見えません。チェッカーはページごとの被リンク数を数えてその数で並べるので、表の下部が放置されたページの位置です。

クリック深度とは、訪問者 — または Googlebot — がトップページからあるページに到達するためにたどるリンクの数です。深度1はトップページからリンクされたページで、深度3以上はほとんどのサイトでクロール頻度と重要度の認識が落ちる領域です。深いページが間違いというわけではありませんが、深度4にある商品ページやサービスページは通常、コンテンツではなくナビゲーションの問題です。分布グラフはサイトの形を示します: 広くて浅いサイトと狭くて深いサイトでは、クロールのされ方が大きく異なります。

孤立ページは、クロールが見つけた — サイトマップ経由か、開始URLのリダイレクト先だったため — が、どのクロール済みページからもリンクされていないページです。存在し、インデックスされてすらいるかもしれませんが、サイト自身はそれを指していません。よくある原因: ナビゲーションから外したが削除していないページ、キャンペーン用に作ったランディングページ、リニューアル後の旧バージョン。それぞれリンクに値するか、削除に値するかのどちらかです。サイトマップにだけ残しておくと、発見はされるが決して推奨されない中途半端な状態に置かれます。

200ページのクロールは小さなサイトなら全体を、大きなサイトなら一部を見ます。部分クロールでの被リンク数は下限値で — クロール外のページもリンクしているかもしれません — 部分クロールでの孤立ページは、リンク元ページに到達しなかっただけのページかもしれません。数字は相互に比較して読み、あるセクションが不自然に薄く見える場合は別の開始URLから再実行してください。

よくある質問

1ページに内部リンクはいくつあるべきですか?
決まった数はありません。Google は古い「1ページ100リンク」のガイドラインはもう適用しないと述べており、チェッカーもしきい値を設けません。重要なのは、重要なページが重要でないページより多くの被リンクを持ち、あなたが大切にするページがゼロにならないことです。並び替えた表を目標数のためではなく、その順序を確認するために使ってください。
孤立ページとは何ですか?
他のどのクロール済みページからもリンクされていないページです。クローラーはサイトマップに載っているか、URLがそこへリダイレクトしたためにのみ見つけます。孤立ページは発見が遅く、クロールされにくく、内部の権威を持ちません。関連ページからリンクするか、古くなっているなら削除して404かリダイレクトにしてください。
トップページが深度0で、ブログ記事が深度3なのはなぜですか?
深度は開始URLからの最短リンク経路です。トップ → ブログ一覧 → 一覧の2ページ目 → 記事で3クリックです。通常の原因はページネーションで、すべての記事に直接リンクするカテゴリページや、トップページの「最新記事」ブロックがあれば、新しいコンテンツなしにほとんどの記事が深度2になります。
チェッカーはナビゲーションリンクも数えますか?
はい — ヘッダー、フッター、サイドバーを含むHTML内のすべての <a href> を、リンク元ページごとに1回数えます。nofollow リンクはリンク元ページの発リンク合計には数えますが、リンク先の被リンク数には加えません。JavaScript で挿入されたリンクは見えません。
被リンク数がSEOツールの数値と違うのはなぜですか?
よくある理由は3つ: 他のツールがより多くのページをクロールした(こちらは200で停止)、リンク元ページではなくリンク数を数えている(ヘッダーとフッターに同じリンクがあるページはここでは1と数える)、JavaScript をレンダリングしてこのクローラーには見えないリンクを見ている。いずれもページ同士の相対的な順位を大きく変えるものではありません。
サブフォルダだけをクロールできますか?
サブフォルダのインデックスページから開始してください。クローラーは同一ホスト上のどこへでもリンクをたどるので、ページが外へリンクしていればフォルダを出ますが、深度の数値は開始URL基準になります — セクションを監査する際はそれが望ましいことがよくあります。
SEO監査URLを入力すると、クローラーが検索エンジンの最初の巡回と同じように最大200ページを確認します: ステータスコード、noindex と canonical のディレクティブ、欠落や重複した title と description、H1 の欠落、薄いページ、alt のない画像、リダイレクトチェーン、リンク切れ、孤立ページ、robots.txt とサイトマップのカバレッジ。すべてのページは単一ページ用チェッカーと同じオンページ検査を受け、レポートは問題別とページ別にまとめます。スコアなし、捏造された優先度なし — 件数付きの所見です。CSVでダウンロード。24時間を超えて保存されるものはありません。リンク切れチェッカーURLを入力すると、クローラーが内部リンクをたどり(最大200ページ)、失敗するすべてのリンクを報告します: 404 などの 4xx、5xx、タイムアウト、DNSエラー — クロール中に見つかった内部リンクと、HEADリクエストで確認した外部リンク(最大100件)。切れたリンクにはそれを指しているページとアンカーテキストが付くので、何かが壊れていると知るだけでなく、リンクかページを修正できます。CSVでダウンロード。24時間を超えて保存されるものはありません。サイトマップ作成ツールURLを入力すると、クローラーが内部リンクをたどり(最大200ページ)、検索エンジンがインデックスできるページだけ — ステータス200、noindex なし、canonical が自分自身 — を残して、ダウンロードやコピーができるシンプルなXMLサイトマップを書き出します。サイトがすでに公開しているサイトマップも読み取り、両方向のギャップを表示します: サイトマップに載っていないインデックス可能ページと、クロールが到達しなかったサイトマップのURL。lastmod、priority、changefreq は捏造しません。24時間を超えて保存されるものはありません。オンページ SEO チェッカーURL と、任意で対象キーワードを入力します。チェッカーはページを Chrome と Googlebot として取得し、生の HTML が示す内容を報告します。文字数とピクセル幅付きのタイトルと meta description、robots meta と X-Robots-Tag、canonical、H1 の数とレベル飛びを含む見出しアウトライン、画像の alt カバレッジ、内部・外部リンクと nofollow の割合、Open Graph と Twitter カード、hreflang の妥当性、JSON-LD の種類、lang、viewport、charset、語数、キーワードの密度と配置。スコアはなく、合格・要確認・情報のみの一覧です。何も保存しません。