SEO-Audit

URL eingeben, und der Crawler prüft bis zu 200 Seiten so, wie es der erste Durchgang einer Suchmaschine täte: Statuscodes, noindex- und Canonical-Direktiven, fehlende oder doppelte Titles und Descriptions, fehlende H1, dünne Seiten, Bilder ohne Alt, Weiterleitungsketten, defekte Links, verwaiste Seiten, robots.txt- und Sitemap-Abdeckung. Jede Seite bekommt dieselben Onpage-Checks wie der Einzelseiten-Checker; der Bericht gruppiert sie nach Problem und nach Seite. Kein Score, keine erfundenen Prioritäten — Befunde mit Zahlen. Als CSV herunterladen. Nichts wird länger als 24 Stunden gespeichert.

Ein HEAD-Request pro eindeutiger externer URL, maximal 100. Abwählen für einen schnelleren Crawl.

Der Crawl läuft auf unserem Server: eine Anfrage pro Sekunde, robots.txt wird beachtet, kein JavaScript. Nur die Start-URL und diese Zusammenfassung werden 24 Stunden aufbewahrt.

So funktioniert es

1. Unser Crawler (InsighthackerzBot, eine Anfrage pro Sekunde, kein JavaScript) holt zuerst die robots.txt und die dort deklarierten Sitemaps, startet dann bei Ihrer URL und folgt internen Links in Breitensuche — nur derselbe Host; www und die nackte Domain zählen als eine Website
2. Limits: 50, 100 oder 200 Seiten pro Lauf, 2 MB pro Seite, 15 s pro Anfrage, 5 Weiterleitungen pro URL; URLs, die Ihre robots.txt für unseren User-Agent sperrt, werden übersprungen und gezählt; nofollow-Seiten werden geladen, ihre Links aber nicht verfolgt
3. Jede HTML-Seite läuft durch dieselbe Engine wie der Onpage-SEO-Check: Title, Description, H1, Canonical, Robots-Direktiven, Wortzahl, Bilder ohne Alt — Warnungen und Fehler werden pro Seite behalten, das HTML nicht
4. Interne Links, die beim Crawl als defekt auffallen (4xx, 5xx, Timeouts), werden mit den verlinkenden Seiten gelistet; externe Links werden nur per HEAD geprüft (ein GET, wenn der Server HEAD ablehnt), maximal 100 pro Lauf, nofollow-Links ausgenommen
5. Das Ergebnis ist ein Job auf unserem eigenen Server: Er enthält nur die Start-URL und die Zusammenfassung, verfällt nach 24 Stunden und wird für nichts anderes verwendet
6. Pro Seite: die Warnungen und Fehler des Onpage-Checkers (Title, Description, H1, Canonical, Robots, lang, Viewport, Wortzahl, Bilder, Links, Social-Tags) plus HTTP-Status und ein etwaiger Ladefehler. Website-weit: doppelte Titles und Descriptions über indexierbare Seiten, Weiterleitungsketten, verwaiste Seiten, Vorhandensein von robots.txt und Sitemap und die beiden Abdeckungslücken
7. Zahlen gelten nur über gecrawlte Seiten; 'dünn' heißt weniger als 300 Wörter auf einer indexierbaren Seite — eine Konvention, keine Regel. Es gibt keinen Score: Eine Zahl, die ein fehlendes Alt gegen ein noindex abwägt, wäre eine Meinung, die als Messung auftritt

Über Site-Audits und was dieses hier meldet

Ein technisches SEO-Audit beantwortet drei Fragen, bevor es um Inhalte geht: Können Suchmaschinen die Seiten erreichen, dürfen sie sie indexieren, und sagt jede Seite klar, was sie ist. Der Crawler folgt internen Links so, wie die Entdeckung des Googlebots es tut — derselbe Host, robots.txt beachtet, kein JavaScript —, sodass sein Fund dem eines Erstdurchgangs-Crawlers nahekommt. Seiten, die er nicht erreicht, sind der erste Befund; Seiten, die er erreicht, aber nicht indexieren darf, der zweite; Seiten, die er mit fehlendem oder doppeltem Title indexiert, der dritte.

Der Bericht ist bewusst flach. Kommerzielle Audit-Tools erzeugen einen Health-Score und eine farbcodierte Prioritätenliste; beides sind als Messung verkleidete Meinungen, und sie drängen dazu, das zu beheben, was den Score bewegt, statt das, was für die Website zählt. Hier ist jedes Problem eine Zahl und eine Liste von Seiten. Eine fehlende Meta-Description auf 40 Blogbeiträgen und ein noindex auf Ihrer Preisseite erscheinen beide; welches dringend ist, hängt von der Website ab, und die kennen Sie.

Website-weite Prüfungen sind das, was ein Einzelseiten-Checker nicht kann. Doppelte Titles über Seiten hinweg bedeuten meist ein Template, das den Seitennamen ignoriert, oder eine paginierte Serie ohne Seitenzahlen. Weiterleitungsketten innerhalb der Website bedeuten, dass Links auf alte URLs zeigen. Verwaiste Seiten bedeuten, dass Sitemap und Navigation sich widersprechen. Seiten im Crawl, aber nicht in der Sitemap, und Seiten in der Sitemap, die der Crawl nie erreichte, zeigen die beiden Richtungen dieses Widerspruchs. Nichts davon ist von einer Seite aus sichtbar.

Das Limit von 200 Seiten macht dies bei größeren Websites zur Stichprobe. Eine Stichprobe reicht, um Template-Probleme zu finden — eine fehlende H1 auf jeder Produktseite zeigt sich in den ersten zwanzig —, und reicht nicht, um die eine defekte URL in einem Katalog mit 5.000 Seiten zu finden. Starten Sie von der Startseite für die Struktur, von einer Bereichsübersicht für das Template dieses Bereichs, und lesen Sie Zahlen als 'mindestens'.

Häufige Fragen

Warum gibt es keinen Score?
Weil jeder Score eine Gewichtung ist, die jemand gewählt hat. Ist ein fehlendes Alt-Attribut 1 Punkt wert und ein noindex auf einer Umsatzseite 20? Andere Websites, andere Antworten. Der Bericht gibt Ihnen die Zahlen und die Seiten; zu entscheiden, was zuerst behoben wird, ist der Teil, der Ihr Geschäft kennen muss — und das Tool kennt es nicht.
Was prüft das Audit nicht?
Alles, was einen Browser braucht: gerenderte Inhalte, Core Web Vitals, per JavaScript eingefügte Links oder Tags, mobiles Layout. Alles, was externe Daten braucht: Backlinks, Rankings, Suchvolumen. Alles außerhalb der Website: hreflang-Gegenseitigkeit über Domains, Gültigkeit strukturierter Daten über das Vorhandensein hinaus. Für Geschwindigkeit nutzen Sie PageSpeed Insights, für das Rendering den SSR-Checker auf einer einzelnen Seite.
Warum wird eine Seite als dünn markiert?
Es wurden weniger als 300 sichtbare Wörter auf einer indexierbaren Seite gezählt. Das ist eine Konvention aus dem Content-SEO, keine Google-Schwelle; eine Kontaktseite mit 80 Wörtern ist in Ordnung. Die Markierung existiert, damit Sie versehentlich leere Seiten finden — ein Template ohne Inhalt, eine Kategorie ohne Produkte —, nicht um jede Seite über eine Wortzahl zu drücken.
Der Crawler meldet Seiten, die ich gelöscht habe. Warum?
Weil noch etwas auf sie verlinkt: interne Navigation, die Sitemap oder ein Weiterleitungsziel. Die Listen defekter Links und Waisen sagen, was. Gelöschte Seiten sollten 404 oder 410 liefern und nicht verlinkt sein; stehen sie noch in der Sitemap, ist das der Fehler der Sitemap.
Meine Website hat eine Sitemap, aber das Audit sagt, es gebe keine.
Der Crawler sucht Sitemap:-Zeilen in der robots.txt und andernfalls /sitemap.xml im Stammverzeichnis. Eine Sitemap unter einem anderen Pfad, den die robots.txt nicht deklariert, ist für ihn unsichtbar — und für Suchmaschinen, denen sie nicht in der Search Console gemeldet wurde. Fügen Sie die Sitemap:-Zeile hinzu und starten Sie neu.
Warum werden Duplikate nur bei indexierbaren Seiten gezählt?
Zwei Seiten mit demselben Title, von denen eine noindex ist oder per Canonical auf die andere zeigt, konkurrieren nicht in der Suche — das ist der Zweck der Direktive. Duplikate, die zählen, liegen zwischen Seiten, die beide indexierbar sein wollen. Nur die vergleicht das Audit.
Reichen 200 Seiten?
Für die meisten Websites kleiner Unternehmen ja — sie decken die Website ab. Für größere Websites ist es eine Stichprobe, die Template-Probleme zuverlässig und Seitenprobleme unzuverlässig findet. Das Audit sagt, wenn es am Limit gestoppt hat. Ein vollständiger Crawl einer großen Website braucht Desktop-Crawler-Software oder einen kostenpflichtigen Dienst.
Sitemap-GeneratorURL eingeben, und der Crawler folgt internen Links (bis zu 200 Seiten), behält nur die Seiten, die eine Suchmaschine indexieren könnte — Status 200, kein noindex, Canonical auf sich selbst — und schreibt eine schlichte XML-Sitemap zum Herunterladen oder Kopieren. Er liest auch die Sitemap, die die Website bereits veröffentlicht, und zeigt beide Lücken: indexierbare Seiten, die darin fehlen, und Sitemap-URLs, die der Crawl nie erreicht hat. Kein lastmod, priority oder changefreq wird erfunden. Nichts wird länger als 24 Stunden gespeichert.Broken Link CheckerURL eingeben, und der Crawler folgt internen Links (bis zu 200 Seiten) und meldet jeden Link, der fehlschlägt: 404 und andere 4xx, 5xx, Timeouts und DNS-Fehler — interne Links, die beim Crawl auffallen, externe Links per HEAD-Request geprüft (bis zu 100). Jeder defekte Link kommt mit den Seiten, die auf ihn zeigen, und dem Ankertext, damit Sie den Link oder die Seite reparieren können, statt nur zu wissen, dass etwas kaputt ist. Als CSV herunterladen. Nichts wird länger als 24 Stunden gespeichert.Interne-Links-CheckerURL eingeben, und der Crawler bildet den internen Linkgraphen von bis zu 200 Seiten ab: wie viele Seiten auf jede URL verlinken, wie viele Links jede Seite aussendet, wie viele Klicks jede Seite vom Start entfernt ist und auf welche Seiten niemand verlinkt — Waisen, die nur die Sitemap kennt. Die Tabelle ist nach eingehenden Links sortiert, damit die Seiten, die Ihre eigene Website als unwichtig behandelt, unten stehen. Als CSV herunterladen. Nichts wird länger als 24 Stunden gespeichert.On-Page-SEO-CheckURL und optional ein Ziel-Keyword eingeben. Der Checker ruft die Seite als Chrome und als Googlebot ab und meldet, was das rohe HTML sagt: Titel und Meta-Description mit Zeichen- und Pixellänge, Robots-Meta und X-Robots-Tag, Canonical, H1-Anzahl und Überschriftengliederung mit übersprungenen Ebenen, Alt-Text-Abdeckung der Bilder, interne und externe Links samt Nofollow-Anteil, Open Graph und Twitter Card, hreflang-Gültigkeit, JSON-LD-Typen, lang, Viewport, Charset, Wortzahl sowie Keyword-Dichte und -Platzierung. Ohne Score — eine Liste dessen, was bestanden ist, was anzusehen ist und was nur Information ist. Nichts wird gespeichert.SSR-CheckerPrüfen Sie, ob eine URL ihren Inhalt im HTML liefert oder erst per JavaScript aufbaut. Die Seite wird als Browser und als Googlebot ohne JS abgerufen; Framework und Rendering-Modus (Next.js, Nuxt, React-SPA, WordPress …) werden erkannt, Wörter, Links und Überschriften gezählt, die ein Crawler sieht, Bot-Blocking und Dynamic Rendering markiert. Kostenlos, ohne Anmeldung.