Dizin şişkinliği

Dizin şişkinliği, dizine eklenmiş düşük değerli, ince ve yinelenen URL'lerle ilgili bir SEO terimidir. Tarama verimliliği ve kalite sorunudur, ceza değildir — nasıl düzeltileceğini açıklar.

İlk yayın tarihi: 23 Haz 2026 · Son güncelleme: 21 Ağu 2026 · Advanced
Diller

Dizin şişkinliği, Google'ın kullandığı değil, SEO alanında kullanılan bir terimdir: arama motorunun düşük değerli, ince veya yinelenen URL'leri dizine eklemesi — fasetli gezinme, parametreler, dahili arama sonuçları, etiket/arşiv sayfaları, soft 404'ler ve protokol kopyaları gibi. Bu bir tarama verimliliği ve sinyal seyrelmesi sorunudur, ceza değildir. Mesele sayfa sayısı değil kalitedir. Teşhis için GSC Sayfa dizine ekleme raporunu (`site:` yalnızca yaklaşık tahmindir), günlükleri ve tarayıcıları kullanın. Her URL'ye uygun aracı seçerek düzeltin: dizinden çıkarmak için `noindex` (taranabilir bırakın), kopyaları birleştirmek için `rel=canonical`, taramayı durdurmak için robots.txt (dizinden çıkarmaz), ortadan kalkan sayfalar için `404`/`410` veya ince içeriği birleştirme.

TL;DR — “Index bloat” Google’ın kullandığı bir terim değil, SEO sektörünün terimidir. Asıl sorun; fasetli gezinme, parametreler, dahili arama, etiket arşivleri, sayfalama, soft 404’ler ve protokol kopyaları gibi ince, yinelenen veya düşük değerli URL’lerin dizine eklenmesidir. Bu bir tarama verimliliği ve sinyal seyrelmesi sorunudur, ceza değildir. Bing, yinelenen içeriğin tek başına arama cezası doğurmadığını; Mueller ise yinelenen içerik cezası bulunmadığını söyler. Konu sayfa sayısı değil kalitedir. GSC Sayfa dizine ekleme raporu, günlükler ve tarayıcılarla teşhis edin; site: yalnızca kaba bir tahmindir. Evidence for this claim Search Console's Page Indexing report summarizes indexed and non-indexed pages and groups non-indexed pages by reason, with limited example rows. Scope: Google Search Console reporting; it is not an exhaustive downloadable URL inventory. Confidence: high · Verified: Google: Page indexing report İşlemi niyete göre seçin: noindex dizinden çıkarır (sayfayı taranabilir tutun), rel=canonical kopyaları birleştirir (kural değil ipucudur), robots.txt yalnızca taramayı durdurur (zaten dizine eklenmiş URL’yi çıkarmaz), ortadan kalkan sayfalarda 404/410, ince içerikte birleştirme kullanılır. Evidence for this claim Google recommends noindex to prevent indexing while allowing crawling, canonical signals for duplicates, and 404/410 for removed pages. Scope: The appropriate control depends on the page's intended state. Confidence: high · Verified: Google: Block indexing with noindex Google: Canonicalization Google: HTTP status codes Removals aracı geçicidir (yaklaşık 6 ay).

”Index bloat” gerçekte ne anlama gelir?

Önce çoğu makalenin yanlış kurduğu çerçeveyi düzeltelim: “index bloat” Google’ın değil, SEO sektörünün terimidir. Google bu ifadeyi kullanmaz. Terim; yinelenen URL’ler, düşük değerli veya önemsiz URL’ler, soft 404’ler, sonsuz alanlar ve fasetli gezinme gibi bileşenleri tanımlar. Bu ifadeyi Google’a atfetmeyin ve Google’ın adını koyup peşine düştüğü, cezalandırdığı ayrı bir sorunmuş gibi ele almayın.

Benim rahatlıkla kullandığım çalışma tanımı şu: Dizin şişkinliği, arama motorlarının sitenizde arama değeri taşımayan sayfaları dizine eklemesidir. Vurgu hacimde değil değerdedir. 500 sayfalık bir site temiz olabilir; 100 000 sayfalık bir site çoğunlukla şişkinlikten oluşabilir. Bu, sayfa sayısı kostümü giymiş bir kalite sorunudur.

Dizin şişkinliği gerçekten bir sorun mu? Dürüst yanıt

Çoğu kişinin düşündüğünden daha az — daha da önemlisi, ceza değildir. Bu, alandaki en çok abartılan noktadır. Bing, yinelenen içeriğin tek başına arama cezası doğurmadığını açıkça söyler. Mueller da yıllardır Google’ın yinelenen içerik cezası uygulamadığını ve çok yinelenen içeriği olduğu için bir siteyi geriletmediğini belirtiyor.

Peki bunun size maliyeti nedir? İki gerçek ve pratik sonuç vardır:

  1. Boşa giden tarama. Google’ın büyük site rehberine göre çok sayıda URL kopyaysa veya başka şekilde istenmiyorsa sitenizdeki Google tarama süresinin büyük bölümü boşa gider. Google tarayıcıları, taranmaması gereken URL’lere fazla zaman ayırdığında sitenin geri kalanına bakmanın buna değmeyeceğine karar verebilir. Mekanizma budur — gereksiz URL’ler önemsediğiniz sayfaların taranmasını boğar ve yeni içeriğin keşfini yavaşlatır.

  2. Seyrelmiş sinyaller. Bing, yakın kopyalarda tıklama, bağlantı, gösterim ve etkileşim gibi sinyallerin çoğu zaman seyreldiğini açıkça anlatır. Bir sayfanın değerini birbirine çok benzeyen beş URL’ye yayarsanız hiçbiri tek birleştirilmiş sayfanın sıralandığı kadar iyi sıralanmaz.

Bu ne zaman gerçekten önem taşır? Büyük veya şablonla yönetilen sitelerde — e-ticaret (fasetli gezinme, parametreler, ürün varyantları), yayıncılar (etiketler, arşivler, sayfalama) ve URL’leri otomatik oluşturan CMS’lerde (WordPress etiket/yazar/feed sayfaları, dahili arama). Küçük ve statik bir sitede ise çoğunlukla gürültüdür.

Kendi çalışmamda kullandığım dürüst içgüdü kontrolü şu: Bir keresinde Ahrefs blogunu canlı olarak denetledim ve 4 700’den fazla taranmış sayfa buldum; ancak gerçekten sıralanan sayfa sayısı yaklaşık 1 600’dü. “Zombi sayfalar” feed sayfaları (yorum, kategori, yazar feed’leri) ve sayfalama gibi şeylerdi. Çıkarımım sakin olandı: çoğu SEO’ya zarar vermedi, fakat tarama bütçesini tüketti; bu nedenle çözüm panik değil triyajdı (örneğin sayfalama hacmini azaltmak için sayfa başına daha fazla öğe göstermek). Her dizin şişkinliği incelemesine, hiçbir şeye dokunmadan önce “Bu gerçekten önemli mi?” diye sorarak başlayın.

Dizin şişkinliğine ne sebep olur?

En sık suçlu oldukları sıraya kabaca göre başlıca kaynaklar:

  • Fasetli gezinme. Bir numaralı kaynaktır. Gary Illyes, Google’ın Crawling December yazısında fasetli gezinmenin site sahiplerinin bildirdiği aşırı tarama sorunlarının açık ara en yaygın kaynağı olduğunu, çünkü neredeyse sonsuz sayıda URL üretebildiğini söyler. Bu yapı her zaman sunucu kaynağı tüketir ve aşırı tarama önemli yeni içeriğinizin keşfini yavaşlatır.
  • URL parametreleri — sıralama, filtreleme, izleme ve oturum kimlikleri. Her yeni parametre değeri, özgün içeriği olmayan yeni bir taranabilir ve dizine eklenebilir URL olabilir.
  • Dahili arama sonucu sayfaları — sitenizin kendi arama sonuçlarının dizine eklenmesi. Bunların neredeyse hiçbir zaman bağımsız arama değeri yoktur.
  • Etiket, kategori ve yazar arşivleri ile akışlar — otomatik üretilir ve çoğu zaman incedir.
  • Sayfalama — liste sayfalarının 2., 3. ve 4. sayfalarının kategori ve arşivler boyunca çoğalması.
  • Protokol ve ana bilgisayar kopyaları — http/https, www/www olmayan ve sondaki eğik çizgili/çizgisiz sürümler. Google’ın kanonikleştirme belgesi bölge, cihaz ve protokol varyantları ile sıralama/filtreleme sonuçları gibi site işlevlerini özellikle sayar.
  • Soft 404’ler ve sonsuz alanlar200 döndüren takvimler, sonsuz kaydırma ve “bulunamadı” sayfaları. Google’a göre soft 404 sayfaları taranmaya devam eder ve bütçenizi boşa harcar.
  • Otomatik üretilen ve ince sayfalar — arkasında çok az özgün içerik bulunan her şablon ürünü.

Google’ın ölçekle ilgili yararlı bir hatırlatması var: web, Google’ın mevcut her URL’yi keşfetme ve dizine ekleme kapasitesini aşan, neredeyse sonsuz bir alandır. Şablonlarınız sonsuz URL üretebiliyorsa Google sizi kendinizden kurtaramaz.

Dizin şişkinliği nasıl teşhis edilir?

GSC Sayfa dizine ekleme raporu authoritative sayımdır. Google toplamların “complete and accurate from Google’s perspective” olduğunu söyler. site: operatörü yerine bunu kullanın. Ham sayıdan daha değerli olan, sayfaların neden dizine eklenmediğinin dökümüdür. Şişkinliğin izini veren kategoriler şunlardır:

  • Taranmış – şu anda dizine eklenmemiş — sayfa Google tarafından taranmış ancak dizine eklenmemiştir. Buradaki şişmiş yığın klasik bloat sinyalidir.
  • Keşfedilmiş – şu anda dizine eklenmemiş — sayfa Google tarafından bulunmuş ancak henüz taranmamıştır. Google, ulaşmadığı URL’lerden haberdardır.
  • Kullanıcı tarafından seçilmiş canonical olmadan yinelenen — sayfa başka bir sayfanın kopyasıdır ancak tercih edilen canonical belirtilmemiştir.
  • Yinelenen; Google kullanıcıdan farklı bir canonical seçti — Google başka bir URL’nin daha iyi canonical olduğunu düşünür.
  • Soft 404 — kullanıcı dostu bir “bulunamadı” mesajı döndürür ancak 404 HTTP yanıt kodu döndürmez.

Aynı raporda şu durumlar da önemlidir: “Alternate page with proper canonical tag”, “Page with redirect”, “Blocked by robots.txt” ve “Excluded by ‘noindex’ tag”.

“Crawled - currently not indexed” konusunda önemli bir nüans var: Mueller bunu sayfa başına bir hata değil, site genelinde bir kalite sinyali olarak çerçeveledi. Sayfaları dizine girmeye zorlayamazsınız; tüm sitelerdeki tüm sayfaların dizine eklenmemesi normaldir. Sorun tek bir sayfadan çok site genelindedir; iyi bir site yapısı kurup sitenin mümkün olan en yüksek kalitede olmasını sağlamak gerekir. Sitenizde genel sorunlar varsa yalnızca dizine girmeyen URL’lere değil, sitenin geri kalanına bakmalısınız. Ancak durumun kendisini fazla yorumlamayın; düşük kaliteli içerik sorunlarını özellikle işaretlemek amacıyla oluşturulmamıştır.

Geri kalan teşhis araçları:

  • site: operatörü — yalnızca hızlı bir içgüdü kontrolüdür (ör. site:example.com inurl:? veya site:example.com/tag/ ile bir bloat örüntüsü bulmak). Bunu asla kesin sayı olarak aktarmayın; GSC ile karşılaştırın.
  • Günlük dosyası analizi — Googlebot’un gerçekte neye zaman harcadığını görün. İsteklerin büyük payı parametre/facet/feed URL’lerine gidiyorsa bu boşa giden taramadır.
  • Site tarayıcıları (Ahrefs Site Audit, Screaming Frog) — ince, yinelenen ve yetim sayfaları, dizine eklenebilir parametre URL’lerini ve yakın kopya kümelerini ortaya çıkarır; taranabilir dizine eklenebilir URL’leri XML site haritanızla ve gerçekten trafik alan sayfalarla karşılaştırın.
  • Taranan-sıralanan farkı (benim yöntemim) — dizine eklenebilir/taranmış sayfaları gerçekten sıralanan veya trafik alan sayfalarla karşılaştırın. Fark, triyaj için zombi/şişkinlik aday listenizdir.

Nasıl düzeltilir — doğru aracı seçin

Pick the treatment from the URL's intended job; robots.txt controls crawling but does not remove an indexed URL. Kaynak: /technical-seo/how-search-works/indexing/index-bloat/

Use noindex for a page that stays live but should not appear in search, canonical for a duplicate of a useful URL, 404 or 410 for a permanently gone URL, and consolidation when several thin pages serve one intent. Use robots.txt only to stop wasteful crawling because it does not deindex the URL.

© Patrick Stox LLC · CC BY 4.0 ·

Tek bir düzeltme yoktur. Her URL, ne olduğuna ve değer taşıyıp taşımadığına göre bir işlem alır. Karar tablosu (Cheat Sheets sekmesinde tamamı gösterilir) işin özüdür; her aracın arkasındaki mantık ise şöyledir:

noindex — dizinden çıkarma. Bir sayfanın arama değeri yoksa ve hiç görünmemesi gerekiyorsa kullanın (dahili arama sonuçları, teşekkür sayfaları, ince etiket/filtre sayfaları). Google, diğer siteler bağlantı verse bile sayfayı Arama sonuçlarından tamamen çıkarır. noindex etiketi, faset sayfalarının dizine eklenmesini önlemenin en güvenilir yoludur. Kritik tuzak: noindex’in çalışması için sayfa taranabilir kalmalıdır. Google’a göre noindex kuralının etkili olması için sayfa veya kaynak robots.txt ile engellenmemelidir. Önce engellerseniz Google noindex’i göremez.

rel=canonical — değer taşıyan kopyaları birleştirme. Bağlantı veya değer taşıyan yakın kopyalarda kullanın (parametre varyantları, yazdırma sürümleri, protokol/ana makine kopyaları). Canonical URL, Google’ın yinelenen sayfalar kümesinden en temsili olarak seçtiği URL’dir; birini işaret etmek sinyalleri birleştirmenin yoludur. Ancak bu bir ipucudur, kural değildir ve Google çeşitli nedenlerle sizden farklı bir sayfayı canonical seçebilir. Her zaman tekrarladığım kesin kural şudur: aynı sayfada noindex ile rel=canonical’ı asla birlikte kullanmayın — çelişkili talimatlardır.

robots.txt disallow — yalnızca taramayı durdurur. Dizine eklenmesini istemediğiniz ve sinyal almak istemediğiniz devasa taranabilir gereksiz URL hacimlerinde (sonsuz faset birleşimleri) botları dışarıda tutmak için kullanın. Illyes, bu URL’lerin dizine eklenmesine ihtiyacınız yoksa taramayı robots.txt ile engellemenizi önerir. Ancak ne yaptığını ve ne yapmadığını anlayın: robots.txt bir web sayfasını Google dışında tutma yöntemi değildir ve engellenen sayfa başka sitelerden bağlantı alıyorsa yine dizine eklenebilir. Taramayı durdurur; zaten dizine eklenmiş URL’leri dizinden çıkarmaz.

404 / 410 — gerçekten ortadan kalkan sayfalar. Artık var olmaması gereken sayfalar için bunları döndürün. 410, biraz daha güçlü bir “gone” sinyalidir; 404 ise “a strong signal not to crawl that URL again” ifadesindeki gibi URL’nin yeniden taranmaması için güçlü bir sinyaldir.

Birleştirme / merge / budama — tek konuda çok sayıda ince sayfa. Bunları tek bir güçlü sayfada birleştirin (geri kalanlara 301 uygulayın) veya silin. Google, taramayı benzersiz URL’ler yerine özgün içeriğe odaklamak için yinelenen içeriği birleştirmeyi önerir. Bu, ince içerik için en iyi uzun vadeli çözümdür.

Removals aracı — yalnızca geçici. GSC’nin Removals aracı bir URL’yi sonuçlardan hızla çıkarır, ancak bu bir yara bandıdır; istekler yaklaşık 6 ay geçerlidir. Bunu her zaman kalıcı bir yöntemle (noindex, 404/410 veya kaldırma) birlikte kullanın.

Herkesi zorlayan sıralama kuralı

Zaten dizine eklenmiş düşük değerli bir URL’yi kalıcı olarak kaldırmak için: noindex (veya 404/410) uygulayın ve Google yeniden işleyene kadar URL’yi taranabilir tutun. Tarama tasarrufu yapmak istiyorsanız disallow’ı robots.txt’ye yalnızca URL dizinden düştükten sonra ekleyin. Önce engellemek URL’yi dizinde hapseder — Google tarayamadığı noindex’i okuyamaz ve URL (bazen snippetsız) sonuçlarda süresiz kalabilir.

Evidence for this claim A `noindex` rule can remove a URL from Google Search after Google fetches it; blocking that URL in robots.txt can prevent observation of the rule and does not save the initial recrawl needed for removal. Scope: HTML and HTTP index controls Confidence: high · Verified: Block search indexing with noindex

Yaygın mitleri çürütelim

  • “Google dizin şişkinliğini / yinelenen içeriği cezalandırır.” Hayır. Ceza yoktur — yalnızca boşa giden tarama ve seyrelmiş sinyaller vardır.
  • “robots.txt sayfaları dizinden çıkarır.” Hayır — yalnızca taramayı durdurur. Engellenen sayfalar bağlantılar üzerinden yine de dizine eklenebilir.
  • “noindex tarama bütçesinden tasarruf sağlar.” Hayır — Google önce noindex’i görmek için sayfayı ister.
  • “Güvende olmak için aynı sayfada noindex VE robots.txt engeli kullanabilirsiniz.” Hayır — engellenmişse Google noindex’i okuyamaz ve sayfa dizinde kalabilir.
  • “rel=canonical birleştirmeyi zorunlu kılar.” Hayır — bu bir ipucudur; Google farklı bir canonical seçebilir.
  • site: operatörü dizine eklenen tam sayıyı verir.” Hayır — bu bir tahmindir. GSC Sayfa dizine ekleme raporuna güvenin.
  • “Daha çok dizine eklenmiş sayfa = daha iyi.” Hayır — niceliğe karşı kalite. Düşük değerli dizine eklenmiş URL’ler sinyalleri seyreltir ve taramayı boşa harcar.

Önleme — koruyucu sınırlar oluşturun

En iyi çözüm, en başta şişkinlik üretmemektir:

  • Şablon düzeyinde CMS noindex’i, asla sıralanmaması gereken şablonlarda kullanın (dahili arama, ince filtre sayfaları, bazı arşivler) — sayfa sayfa değil, şablon düzeyinde bir kez ayarlayın.
  • Parametre disiplini — hangi parametrelerin dizine eklenebilir URL oluşturacağını, hangilerinin canonical’a bağlanacağını veya engelleneceğini baştan belirleyin.
  • Tutarlı URL’ler — tek bir protokol, tek bir ana makine ve tek bir sondaki eğik çizgi kuralı seçin ve bunu zorunlu kılın.
  • Düzenli denetimler — şişkinliğin geri sızmaması için taranan-sıralanan kontrolünü üç ayda bir yeniden çalıştırın.

Bu konu birkaç kardeş başlığın hemen yanında durur: dizin şişkinliğinin kaynaklarını tükettiği tarama bütçesi, ana birleştirme aracı olan canonicalization ve en yaygın kaynak olan fasetli gezinme. Sayfaların dizine nasıl girdiği — ve nasıl dışarıda kaldığı — hakkında daha geniş çerçeve için indexing hub’ına bakın.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.