Interne-Links-Checker

URL eingeben, und der Crawler bildet den internen Linkgraphen von bis zu 200 Seiten ab: wie viele Seiten auf jede URL verlinken, wie viele Links jede Seite aussendet, wie viele Klicks jede Seite vom Start entfernt ist und auf welche Seiten niemand verlinkt — Waisen, die nur die Sitemap kennt. Die Tabelle ist nach eingehenden Links sortiert, damit die Seiten, die Ihre eigene Website als unwichtig behandelt, unten stehen. Als CSV herunterladen. Nichts wird länger als 24 Stunden gespeichert.

Ein HEAD-Request pro eindeutiger externer URL, maximal 100. Abwählen für einen schnelleren Crawl.

Der Crawl läuft auf unserem Server: eine Anfrage pro Sekunde, robots.txt wird beachtet, kein JavaScript. Nur die Start-URL und diese Zusammenfassung werden 24 Stunden aufbewahrt.

So funktioniert es

1. Unser Crawler (InsighthackerzBot, eine Anfrage pro Sekunde, kein JavaScript) holt zuerst die robots.txt und die dort deklarierten Sitemaps, startet dann bei Ihrer URL und folgt internen Links in Breitensuche — nur derselbe Host; www und die nackte Domain zählen als eine Website
2. Limits: 50, 100 oder 200 Seiten pro Lauf, 2 MB pro Seite, 15 s pro Anfrage, 5 Weiterleitungen pro URL; URLs, die Ihre robots.txt für unseren User-Agent sperrt, werden übersprungen und gezählt; nofollow-Seiten werden geladen, ihre Links aber nicht verfolgt
3. Jede HTML-Seite läuft durch dieselbe Engine wie der Onpage-SEO-Check: Title, Description, H1, Canonical, Robots-Direktiven, Wortzahl, Bilder ohne Alt — Warnungen und Fehler werden pro Seite behalten, das HTML nicht
4. Interne Links, die beim Crawl als defekt auffallen (4xx, 5xx, Timeouts), werden mit den verlinkenden Seiten gelistet; externe Links werden nur per HEAD geprüft (ein GET, wenn der Server HEAD ablehnt), maximal 100 pro Lauf, nofollow-Links ausgenommen
5. Das Ergebnis ist ein Job auf unserem eigenen Server: Er enthält nur die Start-URL und die Zusammenfassung, verfällt nach 24 Stunden und wird für nichts anderes verwendet
6. Eingehende Links zählen verschiedene gecrawlte Seiten, die auf eine URL verlinken (eine Seite, die dreimal verlinkt, zählt einmal); Tiefe ist der kürzeste Linkpfad von der Start-URL, per Sitemap gefundene Seiten beginnen bei Tiefe 1; eine Waise ist eine gecrawlte Seite mit null eingehenden Links außer der Startseite

Über interne Links, Klicktiefe und verwaiste Seiten

Interne Links sind das eine Rankingsignal, das vollständig in Ihrer Hand liegt. Sie sagen Crawlern, welche Seiten es gibt, Suchmaschinen, welche Seiten Sie für wichtig halten, und geben weiter, was die verlinkende Seite an Autorität hat. Eine Seite mit vielen internen Links von relevanten Seiten ist leicht zu finden und leicht zu ranken; eine Seite ohne solche Links ist unsichtbar, bis jemand von außen darauf verlinkt. Der Checker zählt eingehende Links pro Seite und sortiert danach, sodass unten in der Tabelle die vernachlässigten Seiten stehen.

Klicktiefe ist die Zahl der Links, denen ein Besucher — oder der Googlebot — von der Startseite aus folgen muss, um eine Seite zu erreichen. Tiefe 1 ist von der Startseite verlinkt; ab Tiefe 3 sinken auf den meisten Websites Crawl-Frequenz und wahrgenommene Bedeutung. Tiefe Seiten sind nicht falsch, aber eine Produkt- oder Leistungsseite auf Tiefe 4 ist meist ein Navigationsproblem, kein Inhaltsproblem. Das Verteilungsdiagramm zeigt die Form der Website: eine breite, flache Website und eine schmale, tiefe werden sehr unterschiedlich gecrawlt.

Verwaiste Seiten sind Seiten, die der Crawl gefunden hat — über die Sitemap oder weil sie das Weiterleitungsziel der Start-URL waren —, auf die aber keine gecrawlte Seite verlinkt. Sie existieren, sind vielleicht sogar indexiert, aber die Website selbst zeigt nicht auf sie. Typische Ursachen: aus der Navigation entfernte, aber nie gelöschte Seiten, für eine Kampagne gebaute Landingpages, alte Versionen nach einem Relaunch. Jede verdient entweder einen Link oder die Entfernung; sie nur in der Sitemap zu lassen, hält sie in einem Schwebezustand, in dem sie entdeckt, aber nie bestätigt werden.

Ein Crawl von 200 Seiten sieht eine kleine Website ganz und eine große teilweise. Zahlen eingehender Links aus einem Teil-Crawl sind Untergrenzen — Seiten außerhalb des Crawls verlinken vielleicht auch —, und Waisen in einem Teil-Crawl können einfach Seiten sein, deren verlinkende Seiten nicht erreicht wurden. Lesen Sie die Zahlen relativ zueinander und starten Sie den Crawl von einer anderen URL, wenn ein Bereich verdächtig dünn wirkt.

Häufige Fragen

Wie viele interne Links sollte eine Seite haben?
Es gibt keine Zahl. Google sagt, die alte Richtlinie '100 Links pro Seite' werde nicht mehr durchgesetzt, und der Checker setzt keine Schwelle. Wichtig ist, dass wichtige Seiten mehr eingehende Links haben als unwichtige und dass nichts, was Ihnen am Herzen liegt, bei null steht. Nutzen Sie die sortierte Tabelle, um diese Reihenfolge zu prüfen, nicht eine Zielzahl.
Was ist eine verwaiste Seite?
Eine Seite, auf die keine andere gecrawlte Seite verlinkt. Der Crawler findet sie nur, weil die Sitemap sie listet oder eine URL dorthin weiterleitet. Waisen werden spät entdeckt, selten gecrawlt und tragen keine interne Autorität. Verlinken Sie sie von einer passenden Seite oder entfernen Sie sie, wenn sie überholt sind, und lassen Sie sie 404 liefern oder weiterleiten.
Warum liegt meine Startseite auf Tiefe 0 und meine Blogbeiträge auf Tiefe 3?
Tiefe ist der kürzeste Linkpfad von der Start-URL. Startseite → Blogübersicht → Seite 2 der Übersicht → Beitrag sind drei Klicks. Paginierung ist die übliche Ursache; Kategorieseiten, die jeden Beitrag direkt verlinken, oder ein Block 'Neueste Beiträge' auf der Startseite bringen die meisten Beiträge ohne neuen Inhalt auf Tiefe 2.
Zählt der Checker Navigationslinks?
Ja — jedes <a href> im HTML, einschließlich Header, Footer und Sidebar, einmal pro verlinkender Seite. Nofollow-Links zählen zur ausgehenden Summe der verlinkenden Seite, erhöhen aber nicht die eingehende Zahl des Ziels. Per JavaScript eingefügte Links werden nicht gesehen.
Warum weichen die eingehenden Links von meinem SEO-Tool ab?
Drei übliche Gründe: Das andere Tool hat mehr Seiten gecrawlt (dieses stoppt bei 200), es zählt Links statt verlinkender Seiten (eine Seite mit demselben Link in Header und Footer zählt hier einmal), oder es rendert JavaScript und sieht Links, die dieser Crawler nicht sieht. Keiner davon ändert die Reihenfolge der Seiten zueinander wesentlich.
Kann ich nur einen Unterordner crawlen?
Starten Sie von der Indexseite des Unterordners. Der Crawler folgt weiterhin Links überall auf demselben Host, verlässt den Ordner also, wenn die Seiten hinausverlinken, aber die Tiefenwerte beziehen sich auf Ihre Start-URL — was beim Audit eines Bereichs oft genau das Gewünschte ist.
SEO-AuditURL eingeben, und der Crawler prüft bis zu 200 Seiten so, wie es der erste Durchgang einer Suchmaschine täte: Statuscodes, noindex- und Canonical-Direktiven, fehlende oder doppelte Titles und Descriptions, fehlende H1, dünne Seiten, Bilder ohne Alt, Weiterleitungsketten, defekte Links, verwaiste Seiten, robots.txt- und Sitemap-Abdeckung. Jede Seite bekommt dieselben Onpage-Checks wie der Einzelseiten-Checker; der Bericht gruppiert sie nach Problem und nach Seite. Kein Score, keine erfundenen Prioritäten — Befunde mit Zahlen. Als CSV herunterladen. Nichts wird länger als 24 Stunden gespeichert.Broken Link CheckerURL eingeben, und der Crawler folgt internen Links (bis zu 200 Seiten) und meldet jeden Link, der fehlschlägt: 404 und andere 4xx, 5xx, Timeouts und DNS-Fehler — interne Links, die beim Crawl auffallen, externe Links per HEAD-Request geprüft (bis zu 100). Jeder defekte Link kommt mit den Seiten, die auf ihn zeigen, und dem Ankertext, damit Sie den Link oder die Seite reparieren können, statt nur zu wissen, dass etwas kaputt ist. Als CSV herunterladen. Nichts wird länger als 24 Stunden gespeichert.Sitemap-GeneratorURL eingeben, und der Crawler folgt internen Links (bis zu 200 Seiten), behält nur die Seiten, die eine Suchmaschine indexieren könnte — Status 200, kein noindex, Canonical auf sich selbst — und schreibt eine schlichte XML-Sitemap zum Herunterladen oder Kopieren. Er liest auch die Sitemap, die die Website bereits veröffentlicht, und zeigt beide Lücken: indexierbare Seiten, die darin fehlen, und Sitemap-URLs, die der Crawl nie erreicht hat. Kein lastmod, priority oder changefreq wird erfunden. Nichts wird länger als 24 Stunden gespeichert.On-Page-SEO-CheckURL und optional ein Ziel-Keyword eingeben. Der Checker ruft die Seite als Chrome und als Googlebot ab und meldet, was das rohe HTML sagt: Titel und Meta-Description mit Zeichen- und Pixellänge, Robots-Meta und X-Robots-Tag, Canonical, H1-Anzahl und Überschriftengliederung mit übersprungenen Ebenen, Alt-Text-Abdeckung der Bilder, interne und externe Links samt Nofollow-Anteil, Open Graph und Twitter Card, hreflang-Gültigkeit, JSON-LD-Typen, lang, Viewport, Charset, Wortzahl sowie Keyword-Dichte und -Platzierung. Ohne Score — eine Liste dessen, was bestanden ist, was anzusehen ist und was nur Information ist. Nichts wird gespeichert.