Taranabilirlik Sorunları: Taramayı Neler Bozar ve Nasıl Düzeltilir?

Taranabilirlik sorunları, arama motorlarının sayfalarınızı keşfetmesini, sayfalarınıza erişmesini veya onları getirmesini engelleyen teknik koşullardır. Bu önceliklendirme odaklı rehber; engellenen erişim, bozuk bağlantılar, arızalı sunucular ve şişmiş URL envanterinden oluşan dört grubu, bunların nasıl bulunacağını ve düzeltileceğini açıklar.

İlk yayın tarihi: 27 Haz 2026 · Son güncelleme: 9 Ağu 2026 · Advanced
Diller

Taranabilirlik, arama motoru tarayıcılarının sayfalarınızı ne kadar iyi keşfedebildiğini, sayfalarınıza erişebildiğini ve onları getirebildiğini ifade eder; taranabilirlik sorunu ise bunları engelleyen her şeydir. Neredeyse her sorun dört gruptan birine girer: erişimin engellenmesi (robots.txt, giriş duvarları, 403s, engellenen JS/CSS), bozuk veya taranamayan bağlantılar (yalnızca JS kullanan gezinme, yetim sayfalar), arızalanan veya hızı kısıtlanan sunucu (5xx, DNS hataları, yavaş ya da kesilen getirmeler, yönlendirme zincirleri) veya şişmiş URL envanteri (örümcek tuzakları, parametre kaynaklı kopyalar, soft 404s). Taranabilirlik, dizine ekleme ve sıralamadan önce gelir; gereklidir ancak bir sıralama faktörü değildir ve dizine eklenebilirlikten farklıdır. Bu merkez, yaygın ve yüksek etkili sorunları önceliklendirir ve sizi ayrıntılı incelemelere yönlendirir.

TL;DR — Taranabilirlik, tarayıcıların sayfalarınızı keşfetme, sayfalarınıza erişme ve onları getirme derecesidir; taranabilirlik sorunu ise bunu bozan her şeydir. Sorunların neredeyse tamamı dört gruba ayrılır: erişimin engellenmesi (robots.txt, giriş duvarları, 403s, engellenen JS/CSS), bozuk bağlantılar (yalnızca JS kullanan gezinme, yetim ve derin sayfalar), sunucu arızaları (5xx, DNS, yavaş/yarım kalan getirmeler, yönlendirme zincirleri) ve şişmiş URL envanteri (örümcek tuzakları, parametre kaynaklı kopyalar, soft 404s). Taranabilirlik, dizine ekleme ve sıralamadan önce gelir; sıralama için gereklidir ancak bir sıralama sinyali değildir ve dizine eklenebilirlikten farklıdır. GSC (Sayfa Dizine Ekleme, Tarama İstatistikleri, URL Denetimi) ve sunucu günlükleriyle teşhis koyun; önce erişim sorununu, ardından envanteri düzeltin. Bu merkez, her sorunu önceliklendirir ve ayrıntılı incelemelere bağlantı verir.

Taranabilirlik nedir (ve ne değildir)?

Taranabilirlik, arama işlem hattının ilk aşamasıdır: keşfet → tara → oluştur → dizine ekle → sun. Buradaki her hata, dizine ekleme ve sıralamanın öncesinde gerçekleşir. Terimin kendisi Google’a ait değil, SEO alanında kullanılan bir şemsiye kavramdır: Google’ın kendi modeli Arama’nın üç aşamasını tarama, dizine ekleme ve sunma olarak adlandırır; URL keşfini ve oluşturmayı ayrı üst düzey aşamalar hâline getirmek yerine taramanın içine dahil eder. Aşağıdaki beş adımlı işlem hattı ve dört gruplu önceliklendirme, bu çalışmayı uygulanabilir biçimde düzenlemek için oluşturduğum sentezdir. Sorunu hızla bulmak için yararlıdır ancak Google sistemlerinin kurum içinde resmen nasıl aşamalandırıldığına ilişkin bir kaynak değildir. Evidence for this claim Google describes Search as crawling, indexing, and serving, and not every page proceeds through every stage. Scope: Google Search processing model. Confidence: high · Verified: Google: How Search works

Üç “eşit değildir” ifadesi bu alandaki kafa karışıklığının çoğunu önler:

  • Taranabilirlik ≠ dizine eklenebilirlik. Bir sayfa tamamen taranabilir olduğu hâlde noindex etiketi nedeniyle dizinin dışında tutulabilir veya teknik olarak taranabilir olmasına rağmen kalite sinyalleri yüzünden dizine eklenmeyebilir. Taranabilirlik, dizine ekleme için gerekli ancak yeterli olmayan bir koşuldur. (Sonraki aşamadaki kalite durumu için tarandı – şu anda dizine eklenmedi bölümüne bakın.)
  • Tarama ≠ sıralama. Sonuçlarda görünmek için tarama gereklidir ancak Google’ın ifadesiyle “an increased crawl rate will not necessarily lead to better positions in Search results… while crawling is necessary for being in the results, it’s not a ranking signal.”
  • Tarama ≠ oluşturma. Google, sayfayı ayrı bir adımda oluşturur ve JavaScript’i çalıştırır: “during the crawl, Google renders the page and runs any JavaScript it finds using a recent version of Chrome”. Bu oluşturucu, ilk getirme işleminin gerisinde kalabilen ayrı bir kuyrukta çalışır.

İşlem hattının tamamı tarama merkezinde yer alır; bu makale ise bozulma durumunda kullanılacak önceliklendirme katmanıdır.

Taranabilirlik sorunlarının dört grubu

Sorununuzu hızla bulmak için bu grupları kullanın. Her biri burada kısaca ele alınır ve ayrıntılı incelemeye bağlantı verilir; henüz sınıflandıramadığınız bir şeyi düzeltmeye çalışmayın. Bu, kapsamlı bir sınıflandırma değil, önceliklendirme bakış açısıdır: Site haritaları, noindex, canonical etiketleri, nofollow, mobil eşitliği ve yinelenen içerik gerçek sorunlardır; ancak çoğu doğrudan erişim/getirme hatası olmaktan ziyade keşif, dizine eklenebilirlik, oluşturma veya tarama verimliliği kapsamındadır. Bu yüzden düz bir denetim kontrol listesi olarak bu merkeze dahil edilmek yerine aşağıda bağlantıları verilen ayrı sayfalarda ele alınırlar.

1. Erişim engellenmiştir

Robots.txt engellemesi (kasıtlı veya yanlışlıkla). Bir Disallow kuralı, tarayıcıların URL’yi hiç getirememesine neden olur. Google, bunun sayfaları kaldırmak için yanlış araç olduğunu açıkça belirtir: “A robots.txt file tells search engine crawlers which URLs the crawler can access on your site… It is not a mechanism for keeping a web page out of Google.” Klasik kazalar arasında hazırlık sitesindeki Disallow: / kuralının üretime aktarılması, bir CMS eklentisinin aşırı geniş kapsamlı bir kural eklemesi veya sayfanın oluşturulması için gereken *.js/*.css kaynaklarının engellenmesi bulunur. (robots.txt ve GSC’deki robots.txt tarafından engellendi durumuna bakın.) Evidence for this claim Google says robots.txt controls crawler access and is not a mechanism for keeping a page out of Google. Scope: Google robots.txt behavior; noindex must remain crawlable to be observed. Confidence: high · Verified: Google: robots.txt introduction

noindex + disallow tuzağı. Bu hata sürekli yaşanır. Bir sayfayı robots.txt içinde hem engeller hem de sayfaya noindex eklerseniz Google, noindex’i görmek için sayfayı hiçbir zaman getiremez; dolayısıyla sayfa dış bağlantılar üzerinden dizinde kalabilir. Bir sayfayı dizinden çıkarmak için taramaya izin verin ve noindex ekleyin. Dizinden çıkarmak için asla disallow kullanmayın. Bunun arkasındaki canlı deneyi Indexed, though blocked by robots.txt yazımda anlattım: “crawling and indexing are two different things.”

Giriş duvarları ve 401s. İçerik, Googlebot’un tamamlayamadığı etkileşimli bir giriş veya OAuth akışının arkasındaysa erişilemez durumdadır; taranamaz veya dizine eklenemez. Ancak bu, “her ödeme duvarı taranamaz” iddiasıyla aynı değildir: Yayıncılar, kısıtlı veya aboneliğe bağlı içeriği tarayıcılara normal ziyaretçilerden farklı biçimde sunmayı seçebilir. Bu nedenle “Googlebot’un aşamadığı bir giriş gerektiriyor” ve “ölçümlü/ödeme duvarlı” durumlarını, her ödeme duvarının aynı şekilde davrandığını varsaymak yerine ayrı ele alın. (401 tarafından engellendi bölümüne bakın.)

403 Forbidden. Bir IP izin listesine başvurmadan önce, bulduğunuz ilk nedenin tek neden olduğunu varsaymak yerine olası nedenleri sırayla inceleyin:

  1. robots.txt — tam yolun ilgili tarayıcının user-agent’ı için engellenmediğini doğrulayın; bu en yaygın nedendir ve elenmesi en hızlı olandır.
  2. Aralıklı veya önbelleğe alınmış engeller — aynı URL’yi birden fazla kez ve birden fazla konumdan yeniden test edin. Yalnızca ara sıra tetiklenen bir WAF/CDN kuralı veya eski bir önbellek 403’ü, kalıcı olmadığı hâlde kalıcı engel gibi görünebilir.
  3. User-agent engelleri — belirli bir bot dizesini reddeden WAF/CDN kuralı (yalnızca dizenin taklit edilebileceğini unutmayın; araştırmayı burada durdurmayın).
  4. IP aralığı engelleri — Googlebot’un gerçek IP aralıklarını veya veri merkezi coğrafyasını reddeden güvenlik duvarı, CDN ya da coğrafi kural. Yalnızca engellemenin hangi katmanda olduğunu gerçekten belirledikten sonra, sadece user-agent başlığına değil ters + ileri DNS’e göre doğrulanmış Googlebot’u izin listesine alın. (403 tarafından engellendi ve diğer 4xx tarafından engellendi bölümlerine bakın.)

Engellenen JS/CSS. Google, sayfaları headless Chrome içinde oluşturur. robots.txt, *.js/*.css dosyalarını engellerse veya CDN kaynakları Googlebot’a sunmazsa oluşturulan sayfa bozuk görünür. Yalnızca oluşturma sonrasında görünen içerik dizine eklenmeyebilir ve yalnızca JS sonrasında görünen bağlantılar izlenmeyebilir. URL Denetimi → Canlı Test ile sınayın ve oluşturulan ekran görüntüsünü inceleyin.

2. Bağlantılar bozuk ya da taranamaz durumdadır

Taranamayan bağlantılar. “Google can only crawl your link if it’s an <a> HTML element with an href attribute. Most links in other formats won’t be parsed and extracted by Google’s crawlers.” Dolayısıyla <a routerLink="...">, <span href="..."> ve <a onclick="goto(...)"> biçimleri geçerli değildir. Ana gezinmeniz yalnızca JS tıklama işleyicilerinden oluşuyorsa sitenin tüm bölümleri hiç keşfedilmeyebilir. (Tarama merkezinin oluşturma bölümüne ve JavaScript SEO Issues & Best Practices yazıma bakın.)

Yetim sayfalar. Kendisine işaret eden hiçbir iç bağlantı bulunmayan bir sayfa, yalnızca site haritası veya dış bağlantı üzerinden bulunabilir. Bağlantılar baskın keşif kanalıdır; bu nedenle yetim sayfa GSC’de çoğu zaman keşfedildi – şu anda dizine eklenmedi olarak görünür. Site haritası girdisi keşfe yardım eder ancak bağlantı sinyalinin yerini almaz. Çözüm: Sayfaya ilgili bir merkez veya kategori sayfasından bağlantı verin. (Keşif ve tarama derinliği bölümlerine bakın.)

Derin sayfalar. Ana sayfadan çok sayıda tıklama uzağa gömülmüş sayfalar daha geç ve daha seyrek taranır. Önemli sayfaları sığ bir yapıda tutun (tarama derinliği bölümüne bakın).

3. Sunucu arızalanıyor veya hızı kısıtlıyor

5xx sunucu hataları. 500/502/503/504, içerik yerine hata döndürür. Sürekli 5xx hataları Googlebot’un hızını düşürmesine neden olur: “they try not to crawl the site too fast to avoid overloading it… HTTP 500 errors mean ‘slow down’”. Sonunda önceden dizine eklenmiş sayfalar da kaldırılabilir. robots.txt dosyasının kendisi 5xx döndürürse bu, sitenin tamamında anında başlayan ve süresiz bir durma anlamına gelmez. Google’ın yayımladığı davranış aşamalıdır: Tarama önce yaklaşık 12 saat durur, ardından Google 30 güne kadar bilinen son geçerli robots.txt dosyasına dönebilir; sonrasında ne olacağı önbellekteki kurallara ve sitenin genel olarak erişilebilir olup olmadığına bağlıdır. 503 ayrıntısına dikkat edin: Retry-After başlığı içeren bir 503, planlı kısa kesintiler için doğru yanıttır; yalnızca haftalarca sürmesi zarar verir. Google, 429 (çok fazla istek) yanıtını da aynı geri çekilme davranışı kapsamında değerlendirir. (Sunucu hatası (5xx) ve tarama hızı bölümlerine bakın.)

DNS hataları. Bunlar tamamen HTTP’nin öncesinde gerçekleşir: Alan adı çözümlenemiyorsa — süresi dolmuş kayıt, hatalı nameserver geçişi veya bozuk apex-domain çözümlemesi — 5xx bile döndürebilecek bir sunucu yanıtı yoktur. Sürekli DNS hatası tüm sitenin kaldırılmasına yol açar. Bunu GSC Tarama İstatistikleri → Ana Makine Durumu bölümünde veya haricî çalışma süresi izleme sistemiyle daha hızlı yakalayın.

Yavaş yanıtlar ve getirme işleminin kesilmesi. Google’ın nezaket mekanizması sunucu sağlığına göre hızı kısıtlar; dolayısıyla yavaş yanıtlar daha az tarama anlamına gelir. Ayrıca katı bir bayt sınırı vardır: Google’ın Mart 2026 tarihli Inside Googlebot güncellemesine göre Googlebot, URL başına yaklaşık 2 MB getirir (eski 15 MB değerinden düşürüldü); PDF’lerde sınır 64 MB’dir. Sınır aşılırsa getirme reddedilmez, kesilir; yalnızca indirilen bölüm dizine eklenir. Kritik içeriğiniz 2 MB’lık şişkinliğin altında kalıyorsa kesilebilir.

Yönlendirme zincirleri ve döngüleri. Her yönlendirme adımı tarama kaynağı tüketir ve uzun zincirler taramayı olumsuz etkiler; Google, hedefi terk etmeden önce yalnızca yaklaşık beş adımı izler. Döngüler zaman aşımına uğrar ve GSC’de yönlendirme hatası olarak görünür. Yaygın nedenlerden biri, art arda yapılan geçişlerin oluşturduğu www → non-www → HTTPS adımlarıdır. (Yönlendirme zincirlerini tarama israfı olarak sıralayan tarama bütçesi bölümüne bakın.)

4. URL envanteri şişmiştir

Örümcek tuzakları. Etkin biçimde sonsuz URL üreten yapılar: fasetli filtre kombinasyonları, sonu olmayan “next month” takvim bağlantıları, URL’lerdeki oturum kimlikleri ve sonsuz sayfalama. Tarayıcılar birbirine çok benzeyen gereksiz URL’lerde bütçe harcarken gerçek sayfalar daha az taranır. Google, tarama sorunlarının büyük bölümünden fasetli gezinme ve işlem parametrelerini sorumlu tutmuş; “infinite spaces” ise 2008’den beri tarama israfı listesinin başında yer almıştır. Neyin “too much” sayılacağına ilişkin sabit ve evrensel bir eşik yoktur. Belirti, her yerde geçerli belirli bir yüzde değil, kendi sitenizin normal taban çizgisine kıyasla isabetlerin orantısız derecede büyük bölümünün tek bir gereksiz URL kalıbında yoğunlaşmasıdır. (Örümcek tuzakları bölümüne bakın.)

URL parametreleri. Sorgu dizeleri (?key=value) aynı içerik için birden fazla URL oluşturur. Etkin parametreler (sıralama/filtreleme/sayfalama) birbirine çok benzeyen kopyalar, pasif parametreler (izleme, oturum kimlikleri) ise birebir kopyalar üretir. Her ikisi de bütçeyi boşa harcar ve bağlantı sinyallerini seyreltir. Not: Google URL Parameters aracını Nisan 2022’de kullanımdan kaldırdı (yapılandırmaların yalnızca ~1% kadarını yararlı buldu ve artık çoğu durumu otomatik olarak ele alıyor); insanlara bu aracı kullanmalarını söylemeyin. Bing hâlâ Ignore URL Parameters aracına sahiptir. Güncel çözüm: tutarlı parametre sıralaması, pasif parametreler için rel=canonical, yalnızca gerçek tuzaklar için robots.txt disallow. (URL parametreleri ve canonicalization bölümlerine bakın.)

Soft 404s. İşlevsel olarak “not found” olan (boş arama sonuçları, içeriği kaldırılmış stok dışı ürün) ancak 200 OK döndüren sayfalardır. Durum kodu sayfanın var olduğunu söylediği için Google sayfayı taramayı sürdürür ve dizine eklenebilir içerik olmadan bütçeyi boşa harcar. Çözüm: Gerçek bir 404 veya 410 döndürün (410 Gone, kaldırma konusunda çok az daha hızlıdır). Gerçek bir 404, ilgili URL’yi yeniden taramamak için güçlü bir sinyaldir.

Tarama bütçesinin tükenmesi (yalnızca büyük siteler)

Bu, dördüncü gruptaki sorunun büyük ölçekteki hâlidir ve ayrı bir uyarıyı hak eder: Çoğu site bu sınıra hiçbir zaman ulaşmaz. Google açıkça şöyle der: “if your site doesn’t have a large number of pages that change rapidly, or if your pages seem to be crawled the same day that they are published, you don’t need to read this guide.” John Mueller buna bir sayı vermiştir: 100 000 URL genellikle tarama bütçesini etkilemek için yeterli değildir. Gerçekte bu konu, haftalık değişen ~1M+ sayfa veya günlük değişen 10k+ sayfa düzeyinde önem kazanır. Bütçe hostname başınadır ve Google’ın tüm tarayıcıları (görsel, video, haber, reklam) site başına aynı havuzdan yararlanır. Uyarı işareti, büyük ve giderek artan keşfedildi – şu anda dizine eklenmedi sayısıdır. (Ayrıntılı açıklama tarama bütçesi bölümündedir; ayrıca When Should You Worry About Crawl Budget? yazıma bakın.)

Taranabilirlik sorunları nasıl bulunur?

Google Search Console.

  • Sayfa Dizine Ekleme raporu, adlandırılmış hataları gösterir: robots.txt tarafından engellendi, sunucu hatası (5xx), bulunamadı (404), yönlendirme hatası.
  • Tarama İstatistikleri raporu, yanıt kodu eğilimlerini, ortalama yanıt süresini ve DNS, robots.txt ile sunucu bağlantısı sorunlarını işaretleyen ana makine durumu panelini gösterir. (Tarama İstatistikleri raporu bölümüne bakın.)
  • URL Denetimi (Canlı Test), Googlebot’un tek bir URL için gerçekten ne getirip oluşturduğunu gösterir. Oluşturulan ekran görüntüsü, engellenmiş JS/CSS’yi yakalamanın en hızlı yoludur.
  • “Keşfedildi – şu anda dizine eklenmedi”, tarama uyarı ışığıdır: Google URL’yi bilir ancak henüz getirmemiştir (genellikle bağlantı veya öncelik sorunu).

Sunucu günlük dosyası analizi temel gerçeği gösterir. Günlükler, botların tam olarak hangi URL’lere, ne sıklıkta ve hangi durum koduyla eriştiğini gösterir. Ayrıca gerçek Googlebot’u (ters + ileri DNS ile doğrulanmış) user-agent’ı taklit eden botlardan ayırmanın tek yoludur. Bir örümcek tuzağı, isabetlerin orantısız bölümünün tek bir URL kalıbında toplanmasıyla ortaya çıkar. (Günlük dosyası analizi bölümüne bakın.)

Site denetimi tarayıcıları — Ahrefs Site Audit ve Screaming Frog SEO Spider — taramayı simüle eder; yönlendirme zincirlerini, engellenen URL’leri, yetim sayfaları ve tarama derinliğini tek geçişte ortaya çıkarır.

Taranabilirlik ve dizine eklenebilirlik: Birbirine karıştırmayın

Kısacası taranabilirlik, bir botun sayfaya erişip erişemediğini; dizine eklenebilirlik ise Google’ın sayfayı getirdikten sonra saklamayı seçip seçmediğini ifade eder. Taranabilirlik düzeltildikten sonra sıradaki kapı dizine eklenebilirliktir.

GSC durumu yararlı bir başlangıç hipotezidir, garantili bir teşhis değildir. Keşfedildi – şu anda dizine eklenmedi genellikle tarama planlaması/önceliği sorununa işaret eder (iç bağlantılar ekleyin, site kalitesini artırın). Tarandı – şu anda dizine eklenmedi ise çoğunlukla taranabilirliğin sonrasındaki içerik/kalite sorununa işaret eder (zayıf, yinelenen veya arama amacıyla uyuşmayan içerik). Ancak Google bu durum için kapsamlı bir nedensel eşleme yayımlamaz; oluşturma gecikmeleri, canonicalization sinyalleri veya dizine eklenme uygunluğu kontrolleri gibi örtüşen etkenler de aynı etiketi oluşturabilir. Durumu ilk ipucunuz olarak değerlendirin, URL Denetimi ve günlüklerle doğrulayın; dizine eklenebilirlik sorunu olduğu anlaşılan bir duruma tarama çözümleri uygulamayın veya tersini yapmayın.

Bing taranabilirliği Google’dan nasıl farklıdır?

Her ikisi için optimizasyon yapıyorsanız bilmeye değer birkaç pratik fark vardır:

  • IndexNow — Bing (ve Yandex, Naver, Seznam, Yep) bunu anlık değişiklik bildirimleri için kullanır; Google katılmaz. IndexNow’ın Google taranabilirliğine yardımcı olmasını beklemeyin.
  • Crawl Control — Bing Webmaster Tools hâlâ tarama saatlerini planlamaya yarayan manuel bir tablo sunar; Google tarama hızı kaydırıcısını Ocak 2024’te kaldırdı.
  • Ignore URL Parameters — Bing bu aracı hâlâ sunar; Google eşdeğerini Nisan 2022’de kullanımdan kaldırdı.
  • lastmod — Bing bunu yeniden tarama sinyali olarak daha fazla ağırlıklandırır; Google hatalı lastmod değerlerini büyük ölçüde yok sayar.

Microsoft Bing’den Fabrice Canel, Bing’in yaklaşımını “Less is more for SEO… Less URLs to crawl, better for SEO” ifadesiyle özetliyor; taranabilirlik oyununun tamamı tek satırda budur. (bingbot bölümüne bakın.)

Sonraki adım

Bu merkez haritadır; ayrıntılı incelemeler işi yapar. Erişim kontrolleri için robots.txt ve noindex bölümlerine bakın. Sunucu tarafı için sunucu hatası (5xx), tarama hızı ve yönlendirme hatası bölümlerine bakın. Envanter şişkinliği için örümcek tuzakları, URL parametreleri ve tarama bütçesi bölümlerine bakın. Keşif ve bağlantılar için keşif, tarama derinliği ve yetim sayfalar bölümlerine bakın. İşlem hattının tamamını tek yerde görmek için tarama merkezinden başlayın.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.