SEO監査
URLを入力すると、クローラーが検索エンジンの最初の巡回と同じように最大200ページを確認します: ステータスコード、noindex と canonical のディレクティブ、欠落や重複した title と description、H1 の欠落、薄いページ、alt のない画像、リダイレクトチェーン、リンク切れ、孤立ページ、robots.txt とサイトマップのカバレッジ。すべてのページは単一ページ用チェッカーと同じオンページ検査を受け、レポートは問題別とページ別にまとめます。スコアなし、捏造された優先度なし — 件数付きの所見です。CSVでダウンロード。24時間を超えて保存されるものはありません。
クロールは当社サーバーで実行されます: 1秒に1リクエスト、robots.txt を遵守、JavaScript は実行しません。保持するのは開始URLとこの要約のみで、24時間後に削除されます。
仕組み
1. 当社のクローラー(InsighthackerzBot、1秒に1リクエスト、JavaScriptなし)はまず robots.txt とそこに宣言されたサイトマップを取得し、指定したURLから内部リンクを幅優先でたどります — 同一ホストのみ、www ありなしは同じサイトとして扱います 2. 上限: 1回あたり50・100・200ページ、1ページ2 MB、1リクエスト15秒、1URLあたりリダイレクト5回。robots.txt が当クローラーのUAに禁止するURLはスキップして計数し、nofollow 指定のページは取得しますがそのリンクはたどりません 3. すべてのHTMLページは on-page SEOチェッカーと同じエンジンを通ります: title、description、H1、canonical、robots ディレクティブ、語数、alt のない画像 — 警告と失敗はページごとに保持し、HTMLは保持しません 4. クロール中に切れていると判明した内部リンク(4xx、5xx、タイムアウト)はリンク元ページとともに一覧化。外部リンクは HEAD のみで確認(サーバーが HEAD を拒否した場合は GET を1回)、1回あたり最大100件、nofollow リンクは除外 5. 結果は当社サーバー上の1ジョブです: 開始URLと要約のみを保持し、24時間後に失効し、他の用途には一切使いません 6. ページごと: オンページチェッカーの警告と失敗(title、description、H1、canonical、robots、lang、viewport、語数、画像、リンク、ソーシャルタグ)に加え、HTTPステータスと取得エラー。サイト全体: インデックス可能ページ間の title と description の重複、リダイレクトチェーン、孤立ページ、robots.txt の有無、サイトマップの有無、2つのカバレッジギャップ 7. 件数はクロールしたページのみが対象です。「薄い」はインデックス可能ページで300語未満を意味し、慣例であってルールではありません。スコアはありません: alt の欠落と noindex を天秤にかける数値は、測定として提示された意見になってしまいます
サイト監査と、この監査が何を報告するかについて
テクニカルSEO監査は、コンテンツに関することの前に3つの問いに答えます: 検索エンジンはページに到達できるか、インデックスを許されているか、各ページは自分が何であるかを明確に語っているか。クローラーは Googlebot の発見と同じように内部リンクをたどります — 同一ホスト、robots.txt 遵守、JavaScript なし — ので、見つかるものは最初の巡回クローラーが見つけるものに近くなります。到達できないページが最初の所見、到達したがインデックスするなと言われているページが2番目、title が欠けているか重複したままインデックスするページが3番目です。
レポートは意図的にフラットです。商用の監査ツールはヘルススコアと色分けした優先度リストを出しますが、どちらも測定の衣を着た意見であり、サイトにとって重要なことよりスコアを動かすことを直すよう人を促します。ここでは各問題は件数とページのリストです。ブログ記事40本の meta description 欠落と、料金ページの noindex は両方表示されます。どちらが緊急かはサイト次第で、サイトを知っているのはあなたです。
サイト全体のチェックは、単一ページのチェッカーにはできないことです。ページ間の title 重複はたいてい、ページ名を無視するテンプレートか、ページ番号のないページネーションを意味します。サイト内のリダイレクトチェーンは、リンクが古いURLを指していることを意味します。孤立ページは、サイトマップとナビゲーションが食い違っていることを意味します。クロールにあってサイトマップにないページと、サイトマップにあってクロールが到達しなかったページは、その食い違いの2方向を示します。どれも1ページからは見えません。
200ページの上限により、大きなサイトではこれはサンプルになります。サンプルはテンプレートレベルの問題を見つけるには十分で — 全商品ページの H1 欠落は最初の20ページで現れます — 5,000ページのカタログにある1本の切れたURLを見つけるには不十分です。構造を見るならトップページから、そのセクションのテンプレートを見るならセクションのインデックスから開始し、件数は「少なくとも」として読んでください。
よくある質問
- なぜスコアがないのですか?
- どんなスコアも誰かが選んだ重み付けだからです。alt 属性の欠落は1点で、収益ページの noindex は20点でしょうか?サイトが違えば答えも違います。レポートは件数とページを提供します。何を最初に直すかを決めるのはあなたのビジネスを知っている必要がある部分で、ツールはそれを知りません。
- 監査が確認しないものは何ですか?
- ブラウザが必要なものすべて: レンダリング後のコンテンツ、Core Web Vitals、JavaScript で挿入されたリンクやタグ、モバイルレイアウト。外部データが必要なものすべて: 被リンク、順位、検索ボリューム。サイト外のものすべて: ドメインをまたぐ hreflang の相互性、存在確認を超えた構造化データの妥当性。速度は PageSpeed Insights を、レンダリングは単一ページで SSR チェッカーを使ってください。
- ページが薄いと表示されるのはなぜですか?
- インデックス可能ページで可視語数が300未満と数えられたためです。これはコンテンツSEOの慣例であり Google のしきい値ではありません。80語の問い合わせページは問題ありません。このフラグは、うっかり空になっているページ — コンテンツのないテンプレート、商品のないカテゴリ — を見つけるためのもので、すべてのページを語数の上に押し上げるためではありません。
- 削除したページがクローラーに報告されます。なぜですか?
- 何かがまだそれらにリンクしているからです: 内部ナビゲーション、サイトマップ、またはリダイレクト先。リンク切れと孤立ページのリストがどれかを示します。削除したページは 404 か 410 を返し、リンクされるべきではありません。まだサイトマップに載っているなら、それはサイトマップの誤りです。
- サイトにはサイトマップがあるのに、監査はないと言います。
- クローラーは robots.txt の Sitemap: 行を探し、なければルートの /sitemap.xml を探します。robots.txt が宣言していない別のパスにあるサイトマップはクローラーには見えません — Search Console で知らされていない検索エンジンにも同様です。Sitemap: 行を追加して再実行してください。
- 重複がインデックス可能ページでしか数えられないのはなぜですか?
- 同じ title の2ページのうち一方が noindex か、もう一方へ canonical を向けている場合、検索で競合しません — それがディレクティブの目的です。意味のある重複は、両方がインデックス可能だと主張するページ間のものです。監査はそれだけを比較します。
- 200ページで十分ですか?
- ほとんどの中小企業サイトでは、はい — サイト全体をカバーします。大規模サイトでは、テンプレートレベルの問題は確実に、ページレベルの問題は不確実に見つけるサンプルになります。上限で停止した場合、監査はそう表示します。大規模サイトの完全なクロールにはデスクトップのクローラーソフトか有料サービスが必要です。