Kırık Link Kontrol

Bir URL girin; tarayıcı iç bağlantıları izler (200 sayfaya kadar) ve başarısız olan her bağlantıyı raporlar: 404 ve diğer 4xx, 5xx, zaman aşımı ve DNS hataları — tarama sırasında bulunan iç bağlantılar, HEAD isteğiyle kontrol edilen dış bağlantılar (100'e kadar). Her kırık bağlantı ona işaret eden sayfalar ve bağlantı metniyle gelir; böylece bir şeyin bozuk olduğunu bilmekle kalmaz, bağlantıyı ya da sayfayı düzeltirsiniz. CSV indirin. 24 saatten uzun hiçbir şey saklanmaz.

Her benzersiz dış URL için bir HEAD isteği, en fazla 100. Daha hızlı tarama için kaldırın.

Tarama sunucumuzda çalışır: saniyede bir istek, robots.txt'e uyum, JavaScript yok. Yalnızca başlangıç URL'si ve bu özet 24 saat tutulur.

Nasıl çalışır

1. Tarayıcımız (InsighthackerzBot, saniyede bir istek, JavaScript yok) önce robots.txt'i ve bildirdiği sitemap'leri getirir, sonra verdiğiniz URL'den başlayıp iç bağlantıları genişlik-öncelikli izler — yalnızca aynı host; www ve çıplak alan adı tek site sayılır
2. Sınırlar: çalıştırma başına 50, 100 ya da 200 sayfa, sayfa başına 2 MB, istek başına 15 sn, URL başına 5 yönlendirme; robots.txt'inizin user-agent'ımıza yasakladığı URL'ler atlanır ve sayılır, nofollow işaretli sayfalar getirilir ama bağlantıları izlenmez
3. Her HTML sayfa, sayfa içi SEO kontrol aracıyla aynı motordan geçer: title, description, H1, canonical, robots direktifleri, kelime sayısı, alt'sız görseller — uyarılar ve hatalar sayfa başına tutulur, HTML tutulmaz
4. Tarama sırasında kırık bulunan iç bağlantılar (4xx, 5xx, zaman aşımı) onlara bağlantı veren sayfalarla listelenir; dış bağlantılar yalnızca HEAD ile kontrol edilir (sunucu HEAD'i reddederse bir GET), çalıştırma başına en fazla 100, nofollow bağlantılar hariç
5. Sonuç kendi sunucumuzda tek bir iştir: yalnızca başlangıç URL'sini ve özeti tutar, 24 saat sonra silinir ve başka hiçbir şey için kullanılmaz
6. Yanıt 4xx ya da 5xx ise ya da istek başarısız olursa (zaman aşımı, DNS, TLS, bağlantı reddi) bağlantı kırık sayılır. İç sayfalarda yönlendirmeler izlenir ve burada değil denetim sekmesinde raporlanır

Kırık bağlantılar ve aracın onları nasıl bulduğu hakkında

Kırık bağlantı, hedefi artık yanıt vermeyen bağlantıdır: sayfa silindiği ya da yeniden adlandırıldığı için 404, bir 410, arkasındaki sunucu çöktüğü için 5xx ya da alan adı düştüğü için hiç yanıt yok. Ziyaretçi için çıkmaz sokak; arama motorları için boşa giden tarama ve ne kadar küçük olsa da sitenin bakılmadığına dair bir sinyal. İç kırık bağlantılar tamamen sizin düzelteceğiniz şeylerdir ve genellikle kimsenin yaymadığı bir URL değişikliğinden gelir; dış olanları başkası bozar, siz fark edersiniz.

Araç iki türü bilerek farklı ele alır. İç bağlantılar tarama sırasında keşfedilir — tarayıcının çarptığı her 4xx/5xx sayfa kırık bir bağlantıdır ve tarayıcı hangi sayfaların onu oraya gönderdiğini zaten bilir. Dış bağlantılar taranmaz; her benzersiz dış URL bir HEAD isteği alır (sunucu HEAD'i reddederse GET), host başına saniyede bir, çalıştırma başına en fazla 100. Bu, başkalarının sunucularını yormadan ve tarama bütçenizi onlara harcamadan ölü alan adlarını ve silinmiş sayfaları yakalamaya yeter.

Kaynak sayfalar kırık URL'nin kendisinden daha önemlidir. Eski bir blog yazısından bağlanan bir 404 beş saniyelik iştir; aynı 404 footer'dan bağlanıyorsa her sayfadadır ve yönlendirmeyi hak eder. Tablo bağlantı başına en fazla beş kaynak sayfa ve bağlantı metnini listeler; bu çoğu zaman bağlantının nereyi göstermesi gerektiğini tahmin etmeye yeter.

Bazı 'kırık' bağlantılar kırık değildir. Bot korumalı siteler tanımadıkları tarayıcıların HEAD isteklerine 403 ya da 429 döner; giriş isteyen sayfa 401 döner; bazı sunucular HEAD'e 405, GET'e 200 döner — araç bunu GET ile yeniden deneyerek çözer. Tanınmış bir sitede 403 neredeyse her zaman sitenin tarayıcıyı reddetmesidir, ölü bir sayfa değil — bağlantıyı kaldırmadan önce tarayıcıda açın.

Sık sorulan sorular

Çalışan bir bağlantı neden 403 ya da 429 görünüyor?
Hedef site isteğimizi reddetti, sayfayı değil. Cloudflare ve benzeri servisler tanımadıkları tarayıcılara 403 ile meydan okur, hız sınırları 429 döner. Araç bir meydan okumayı çözemez ve denemez. URL'yi tarayıcıda açın: yükleniyorsa bağlantı sağlamdır ve durum sitenin bot politikasıdır.
İç ve dış kırık bağlantı arasındaki fark ne?
İç bağlantılar kendi host'unuzu gösterir ve tarama sırasında bulunur; tarayıcı sayfayı getirdi, hata aldı ve bağlantının nereden geldiğini biliyor. Dış bağlantılar başka yeri gösterir ve her biri tek bir hafif istekle kontrol edilir. İç olanları yönlendirmeyle ya da bağlantıyı güncelleyerek düzeltin; dış olanlar için bağlantıyı güncelleyin, arşivlenmiş bir kopya bulun ya da kaldırın.
Bazı dış bağlantılar neden kontrol edilmedi?
Çalıştırma, diğer sitelere karşı nazik kalmak ve işi birkaç dakikanın altında tutmak için dış kontrolleri 100 benzersiz URL ve host başına saniyede bir istekle sınırlar. Araç kaç tanesinin atlandığını söyler. rel="nofollow" işaretli bağlantılar hiç kontrol edilmez. Dış seçeneğinin işaretini kaldırırsanız tamamen atlanır ve tarama hızlanır.
Araç yönlendirmeleri izliyor mu?
İç sayfalarda evet — çalışan bir sayfaya 301 yapan URL'ye bağlantı kırık değildir, ama yönlendirme site denetiminde listelenir ki zinciri kısaltabilesiniz. Dış bağlantılarda yönlendirme çalışıyor sayılır; araç daha ileri izlemez.
Kırık olduğunu bildiğim bir bağlantıyı araç neden bulmuyor?
Ya onu içeren sayfa taramanın dışındaydı (sayfa sınırının ötesinde, robots.txt'de yasaklı ya da başlangıç URL'sinden bağlantı izleyerek ulaşılamıyor) ya da bağlantı JavaScript ile ekleniyor — tarayıcı sunulan HTML'i okur, betik çalıştırmaz. Denetim sekmesi hangi sayfaların tarandığını gösterir.
Ne sıklıkla kontrol etmeliyim?
Dış bağlantılar kendiliğinden çürür — çoğu sitede yılda yüzde birkaç — bu yüzden üç ayda bir çalıştırma çoğunu yakalar. İç bağlantılar URL'ler değişince kırılır; her taşınma, yeniden tasarım ya da toplu yeniden adlandırmadan hemen sonra kontrol edin. 200 sayfanın üstündeki siteler bütününü tarayabilen bir araç ister; bu araç örneklem verir.
SEO DenetimBir URL girin; tarayıcı 200 sayfaya kadar bir arama motorunun ilk geçişi gibi kontrol eder: durum kodları, noindex ve canonical direktifleri, eksik ya da tekrar eden title ve description, eksik H1, ince sayfalar, alt'sız görseller, yönlendirme zincirleri, kırık bağlantılar, yetim sayfalar, robots.txt ve sitemap kapsamı. Her sayfa tek sayfa kontrol aracıyla aynı sayfa içi kontrollerden geçer; rapor bunları soruna ve sayfaya göre gruplar. Puan yok, uydurma öncelik yok — sayılarıyla bulgular. CSV indirin. 24 saatten uzun hiçbir şey saklanmaz.İç Link AnaliziBir URL girin; tarayıcı 200 sayfaya kadar iç bağlantı grafiğini çıkarır: her URL'ye kaç sayfa bağlantı veriyor, her sayfa kaç bağlantı gönderiyor, her sayfa başlangıçtan kaç tık uzakta ve kimse hangi sayfalara bağlantı vermiyor — yalnızca sitemap'in bildiği yetim sayfalar. Tablo gelen bağlantıya göre sıralanır; sitenizin önemsiz saydığı sayfalar en altta. CSV indirin. 24 saatten uzun hiçbir şey saklanmaz.Sitemap OluşturucuBir URL girin; tarayıcı iç bağlantıları izler (200 sayfaya kadar), yalnızca bir arama motorunun indeksleyebileceği sayfaları tutar — 200 durum, noindex yok, canonical kendisini gösteriyor — ve indirip kopyalayabileceğiniz sade bir XML sitemap yazar. Sitenin zaten yayınladığı sitemap'i de okur ve iki boşluğu gösterir: sitemap'te olmayan indekslenebilir sayfalar ve taramanın hiç ulaşmadığı sitemap URL'leri. lastmod, priority ya da changefreq uydurulmaz. 24 saatten uzun hiçbir şey saklanmaz.Yönlendirme KontrolEn fazla 20 URL yapıştırın ve yönlendirme zincirinin her atlamasını görün: durum kodu, hedef, Cache-Control ve atlama başına süre, son URL ve durum, döngüler, üç atlamayı aşan zincirler, 301 yerine geçici 302/307, http→https→www çift zincirleri, son sayfadaki meta refresh ve JavaScript yönlendirmeleri, son URL ile uyuşmayan canonical — ve isteğe bağlı olarak Googlebot'un tarayıcıdan farklı bir yere gönderilip gönderilmediği. CSV olarak dışa aktarın. Hiçbir şey saklanmaz.