Kırık Link Kontrol
Bir URL girin; tarayıcı iç bağlantıları izler (200 sayfaya kadar) ve başarısız olan her bağlantıyı raporlar: 404 ve diğer 4xx, 5xx, zaman aşımı ve DNS hataları — tarama sırasında bulunan iç bağlantılar, HEAD isteğiyle kontrol edilen dış bağlantılar (100'e kadar). Her kırık bağlantı ona işaret eden sayfalar ve bağlantı metniyle gelir; böylece bir şeyin bozuk olduğunu bilmekle kalmaz, bağlantıyı ya da sayfayı düzeltirsiniz. CSV indirin. 24 saatten uzun hiçbir şey saklanmaz.
Tarama sunucumuzda çalışır: saniyede bir istek, robots.txt'e uyum, JavaScript yok. Yalnızca başlangıç URL'si ve bu özet 24 saat tutulur.
Nasıl çalışır
1. Tarayıcımız (InsighthackerzBot, saniyede bir istek, JavaScript yok) önce robots.txt'i ve bildirdiği sitemap'leri getirir, sonra verdiğiniz URL'den başlayıp iç bağlantıları genişlik-öncelikli izler — yalnızca aynı host; www ve çıplak alan adı tek site sayılır 2. Sınırlar: çalıştırma başına 50, 100 ya da 200 sayfa, sayfa başına 2 MB, istek başına 15 sn, URL başına 5 yönlendirme; robots.txt'inizin user-agent'ımıza yasakladığı URL'ler atlanır ve sayılır, nofollow işaretli sayfalar getirilir ama bağlantıları izlenmez 3. Her HTML sayfa, sayfa içi SEO kontrol aracıyla aynı motordan geçer: title, description, H1, canonical, robots direktifleri, kelime sayısı, alt'sız görseller — uyarılar ve hatalar sayfa başına tutulur, HTML tutulmaz 4. Tarama sırasında kırık bulunan iç bağlantılar (4xx, 5xx, zaman aşımı) onlara bağlantı veren sayfalarla listelenir; dış bağlantılar yalnızca HEAD ile kontrol edilir (sunucu HEAD'i reddederse bir GET), çalıştırma başına en fazla 100, nofollow bağlantılar hariç 5. Sonuç kendi sunucumuzda tek bir iştir: yalnızca başlangıç URL'sini ve özeti tutar, 24 saat sonra silinir ve başka hiçbir şey için kullanılmaz 6. Yanıt 4xx ya da 5xx ise ya da istek başarısız olursa (zaman aşımı, DNS, TLS, bağlantı reddi) bağlantı kırık sayılır. İç sayfalarda yönlendirmeler izlenir ve burada değil denetim sekmesinde raporlanır
Kırık bağlantılar ve aracın onları nasıl bulduğu hakkında
Kırık bağlantı, hedefi artık yanıt vermeyen bağlantıdır: sayfa silindiği ya da yeniden adlandırıldığı için 404, bir 410, arkasındaki sunucu çöktüğü için 5xx ya da alan adı düştüğü için hiç yanıt yok. Ziyaretçi için çıkmaz sokak; arama motorları için boşa giden tarama ve ne kadar küçük olsa da sitenin bakılmadığına dair bir sinyal. İç kırık bağlantılar tamamen sizin düzelteceğiniz şeylerdir ve genellikle kimsenin yaymadığı bir URL değişikliğinden gelir; dış olanları başkası bozar, siz fark edersiniz.
Araç iki türü bilerek farklı ele alır. İç bağlantılar tarama sırasında keşfedilir — tarayıcının çarptığı her 4xx/5xx sayfa kırık bir bağlantıdır ve tarayıcı hangi sayfaların onu oraya gönderdiğini zaten bilir. Dış bağlantılar taranmaz; her benzersiz dış URL bir HEAD isteği alır (sunucu HEAD'i reddederse GET), host başına saniyede bir, çalıştırma başına en fazla 100. Bu, başkalarının sunucularını yormadan ve tarama bütçenizi onlara harcamadan ölü alan adlarını ve silinmiş sayfaları yakalamaya yeter.
Kaynak sayfalar kırık URL'nin kendisinden daha önemlidir. Eski bir blog yazısından bağlanan bir 404 beş saniyelik iştir; aynı 404 footer'dan bağlanıyorsa her sayfadadır ve yönlendirmeyi hak eder. Tablo bağlantı başına en fazla beş kaynak sayfa ve bağlantı metnini listeler; bu çoğu zaman bağlantının nereyi göstermesi gerektiğini tahmin etmeye yeter.
Bazı 'kırık' bağlantılar kırık değildir. Bot korumalı siteler tanımadıkları tarayıcıların HEAD isteklerine 403 ya da 429 döner; giriş isteyen sayfa 401 döner; bazı sunucular HEAD'e 405, GET'e 200 döner — araç bunu GET ile yeniden deneyerek çözer. Tanınmış bir sitede 403 neredeyse her zaman sitenin tarayıcıyı reddetmesidir, ölü bir sayfa değil — bağlantıyı kaldırmadan önce tarayıcıda açın.
Sık sorulan sorular
- Çalışan bir bağlantı neden 403 ya da 429 görünüyor?
- Hedef site isteğimizi reddetti, sayfayı değil. Cloudflare ve benzeri servisler tanımadıkları tarayıcılara 403 ile meydan okur, hız sınırları 429 döner. Araç bir meydan okumayı çözemez ve denemez. URL'yi tarayıcıda açın: yükleniyorsa bağlantı sağlamdır ve durum sitenin bot politikasıdır.
- İç ve dış kırık bağlantı arasındaki fark ne?
- İç bağlantılar kendi host'unuzu gösterir ve tarama sırasında bulunur; tarayıcı sayfayı getirdi, hata aldı ve bağlantının nereden geldiğini biliyor. Dış bağlantılar başka yeri gösterir ve her biri tek bir hafif istekle kontrol edilir. İç olanları yönlendirmeyle ya da bağlantıyı güncelleyerek düzeltin; dış olanlar için bağlantıyı güncelleyin, arşivlenmiş bir kopya bulun ya da kaldırın.
- Bazı dış bağlantılar neden kontrol edilmedi?
- Çalıştırma, diğer sitelere karşı nazik kalmak ve işi birkaç dakikanın altında tutmak için dış kontrolleri 100 benzersiz URL ve host başına saniyede bir istekle sınırlar. Araç kaç tanesinin atlandığını söyler. rel="nofollow" işaretli bağlantılar hiç kontrol edilmez. Dış seçeneğinin işaretini kaldırırsanız tamamen atlanır ve tarama hızlanır.
- Araç yönlendirmeleri izliyor mu?
- İç sayfalarda evet — çalışan bir sayfaya 301 yapan URL'ye bağlantı kırık değildir, ama yönlendirme site denetiminde listelenir ki zinciri kısaltabilesiniz. Dış bağlantılarda yönlendirme çalışıyor sayılır; araç daha ileri izlemez.
- Kırık olduğunu bildiğim bir bağlantıyı araç neden bulmuyor?
- Ya onu içeren sayfa taramanın dışındaydı (sayfa sınırının ötesinde, robots.txt'de yasaklı ya da başlangıç URL'sinden bağlantı izleyerek ulaşılamıyor) ya da bağlantı JavaScript ile ekleniyor — tarayıcı sunulan HTML'i okur, betik çalıştırmaz. Denetim sekmesi hangi sayfaların tarandığını gösterir.
- Ne sıklıkla kontrol etmeliyim?
- Dış bağlantılar kendiliğinden çürür — çoğu sitede yılda yüzde birkaç — bu yüzden üç ayda bir çalıştırma çoğunu yakalar. İç bağlantılar URL'ler değişince kırılır; her taşınma, yeniden tasarım ya da toplu yeniden adlandırmadan hemen sonra kontrol edin. 200 sayfanın üstündeki siteler bütününü tarayabilen bir araç ister; bu araç örneklem verir.