Content-Term-Analyse
Fügen Sie 3–10 Wettbewerber-URLs ein — die Seiten, die für Ihre Suchanfrage ranken — und optional die URL Ihrer eigenen Seite oder Ihren Entwurf. Das Tool lädt jede Seite, extrahiert den Hauptinhalt, zählt Ein- bis Drei-Wort-Terme in der gewählten Sprache und listet die Terme, die in mindestens 60 % der Wettbewerberseiten vorkommen, mit der Zahl pro Seite und der Zahl bei Ihnen. Terme, die Sie nie verwenden, stehen gesondert; Wortzahlen und H1–H3-Gliederungen daneben. Kein SERP-Scraping, kein Content-Score — eine Abdeckungsmatrix zum Lesen und als CSV-Export. Nichts wird länger als 24 Stunden gespeichert.
Die Seiten lädt unser Server, eine pro Sekunde und Host; ihr Text wird nach dem Vergleich verworfen. Nur URLs, Zahlen und diese Tabelle werden 24 Stunden aufbewahrt.
So funktioniert es
1. Die Wettbewerberseiten nennen Sie (3–10 URLs); das Tool lädt keine Suchergebnisse. Unser Server fordert jede Seite einmal an, höchstens eine Anfrage pro Sekunde und Host, 2 MB pro Seite, 15 s pro Anfrage, bis zu fünf Weiterleitungen; Ihre eigene Seite wird, per URL angegeben, genauso geladen — eingefügter Text wird unverändert verwendet
2. Hauptinhalt = das <main>- oder <article>-Element, wenn die Seite eines hat, sonst der Body ohne Navigation, Header, Footer, Aside und Formulare, Skripte und Styles entfernt. Wortzahlen und H1–H3-Überschriften stammen aus diesem Inhalt
3. Terme: Wörter kleingeschrieben und an Nicht-Buchstaben getrennt; Folgen aus 1, 2 und 3 Wörtern gezählt; Folgen, die mit einem Stoppwort der gewählten Sprache beginnen oder enden, werden übersprungen ('Kosten pro Klick' zählt, 'pro Klick' nicht). Japanisch wird an Schriftgrenzen getrennt, nicht mit einem morphologischen Analysator — die Ergebnisse sind grob
4. Ein Term wird gelistet, wenn er in mindestens 60 % der lesbaren Wettbewerberseiten (nie weniger als zwei) und insgesamt mindestens zweimal vorkommt; bis zu 150 Terme, sortiert nach Seitenzahl, dann Gesamtvorkommen
5. Fehlend = gelistete Terme, die in Ihrem Text null Mal vorkommen. Es gibt keinen Score: Welche fehlenden Terme zählen, ist ein Urteil über das Thema, keine ZahlÜber Term-Abdeckung und was die Matrix sagt und nicht sagt
Die Idee hinter Term-Abdeckung ist einfach: Seiten, die für eine Suchanfrage ranken, decken meist dieselben Unterthemen ab, und diese Unterthemen hinterlassen Spuren im Vokabular. Wenn neun von zehn Seiten über E-Mail-Benchmarks 'Abmelderate' erwähnen und Ihre nicht, haben Sie entweder etwas ausgelassen oder es anders genannt. Die Matrix macht das pro Term und pro Seite sichtbar, damit Sie entscheiden können, welches von beidem. Kommerzielle Tools (Surfer, Clearscope und Verwandte) zählen genauso und packen dann einen Score und ein Ziel drumherum; dieses Tool hört beim Zählen auf.
Die Wettbewerber-URLs liefern Sie selbst. Das ist eine Einschränkung — ein Scraper, der die Top 10 holt, wäre bequemer — und zugleich der Punkt: Sie wählen Seiten, die wirklich vergleichbar sind (informativ gegen informativ, Produkt gegen Produkt), und das Tool muss keine Suchmaschine scrapen, um zu funktionieren. Drei Seiten sind das Minimum, damit die 60-%-Schwelle etwas bedeutet; zehn sind die Obergrenze, weil die Zahl pro Seite darüber zu Rauschen wird.
Die Matrix lesen: Terme, die in jedem Wettbewerber und nicht bei Ihnen vorkommen, sind das Erste, was man anschaut, aber sie sind nicht automatisch Lücken. Ein Term kann die Marke eines Wettbewerbers sein, ein Navigationslabel, das die Boilerplate-Entfernung überlebt hat, oder eine Idee, die Ihr Text mit anderen Worten ausdrückt. Die Zahlen pro Seite helfen — ein Term, der auf einer Seite 20-mal und auf den anderen einmal vorkommt, ist das Steckenpferd dieser Seite, nicht des Themas —, und die H1–H3-Gliederungen zeigen, ob ein Term ein eigener Abschnitt oder eine beiläufige Erwähnung ist.
Die Wortzahl wird als Median gezeigt, nicht als Ziel. Längere Seiten sind nicht besser; Seiten, die mehr von dem abdecken, worum es bei der Anfrage geht, sind tendenziell länger, was nicht dieselbe Behauptung ist. Wenn Ihre Seite ein Drittel des Medians hat und die Hälfte der gemeinsamen Terme fehlt, haben beide Tatsachen wahrscheinlich dieselbe Ursache. Wenn sie kürzer ist und nichts fehlt, ist sie kürzer.
Häufige Fragen
- Warum muss ich die Wettbewerber-URLs selbst einfügen?
- Weil das Tool keine Suchergebnisse scrapt — das wäre fragil, gegen die Bedingungen der Suchmaschinen, und die Verfügbarkeit des Tools hinge von ihnen ab. Suchen Sie Ihre Anfrage, wählen Sie die Seiten, die wirklich mit Ihrer konkurrieren (gleiche Absicht, gleiche Art Seite), und fügen Sie diese ein. Drei bis zehn.
- Wo ist der Content-Score?
- Es gibt keinen. Ein Score würde Terme gewichten, deren Gewichtung niemand begründet hat, und ein Zielwert würde den Text Richtung Keyword-Stuffing drängen. Die Matrix zeigt, welche Terme die Wettbewerber teilen und wie oft jede Seite sie nutzt; zu entscheiden, was Ihre Seite abdecken soll, ist redaktionelle Arbeit, und das Tool tut nicht so, als könnte es das.
- Manche gelisteten Terme sind Unsinn — Navigationslabels, Cookie-Hinweise, die Marke eines Wettbewerbers.
- Die Boilerplate-Entfernung ist heuristisch: <main> und <article>, wenn vorhanden, sonst werden nav, header, footer und aside entfernt. Websites, die ihr Menü in den Artikel setzen oder einen Call-to-Action im Body wiederholen, lassen solche Terme in die Liste. Ignorieren Sie sie; die Zahlen pro Seite machen sie meist offensichtlich (überall in geringer Zahl, oder nur auf einer Seite in hoher).
- Warum ist eine Wettbewerberseite als fehlgeschlagen markiert?
- Sie hat einen Fehlerstatus geliefert, war kein HTML, brauchte länger als 15 s oder hat unseren Crawler abgewiesen (Bot-Schutz antwortet unbekannten User-Agents mit 403 oder 429). Fehlgeschlagene Seiten sind von Schwelle und Zählung ausgenommen; die Zusammenfassung sagt, wie viele gelesen wurden. Fällt ein wichtiger Wettbewerber aus, fügen Sie seinen Text in einem zweiten Lauf als Ihre 'eigene' Eingabe ein, um wenigstens seine Terme zu sehen.
- Funktioniert es in anderen Sprachen als Englisch?
- Türkisch, Deutsch und Russisch nutzen dieselbe Worttrennung mit eigenen Stoppwortlisten; die Ergebnisse sind so gut wie für Englisch. Japanisch hat keine Wortzwischenräume, und das Tool trennt an Schriftwechseln (Kanji-, Kana-, Latein-Folgen) statt mit einem morphologischen Analysator — Phrasen werden grob, die Zahlen nur richtungsweisend. Wählen Sie die Sprache der Seiten, nicht der Oberfläche.
- Kann ich es vor der Veröffentlichung für meinen Entwurf nutzen?
- Ja — 'Text einfügen' wählen und den Entwurf einfügen. Er wird genau wie eine geladene Seite verglichen, nur ohne Überschriften. Bis zu 200.000 Zeichen.
- Was passiert mit den geladenen Seiten?
- Der Text wird in einem Job auf unserem Server verwendet und verworfen, wenn der Job endet; das Ergebnis behält nur URLs, Wortzahlen, Überschriften und die Term-Tabelle. Der Job selbst wird nach 24 Stunden gelöscht. Ihr eingefügter Text wird nie darüber hinaus gespeichert.