Dizin şişkinliği
Dizin şişkinliği, dizine eklenmiş düşük değerli, ince ve yinelenen URL'lerle ilgili bir SEO terimidir. Tarama verimliliği ve kalite sorunudur, ceza değildir — nasıl düzeltileceğini açıklar.
Diller
Dizin şişkinliği, Google'ın kullandığı değil, SEO alanında kullanılan bir terimdir: arama motorunun düşük değerli, ince veya yinelenen URL'leri dizine eklemesi — fasetli gezinme, parametreler, dahili arama sonuçları, etiket/arşiv sayfaları, soft 404'ler ve protokol kopyaları gibi. Bu bir tarama verimliliği ve sinyal seyrelmesi sorunudur, ceza değildir. Mesele sayfa sayısı değil kalitedir. Teşhis için GSC Sayfa dizine ekleme raporunu (`site:` yalnızca yaklaşık tahmindir), günlükleri ve tarayıcıları kullanın. Her URL'ye uygun aracı seçerek düzeltin: dizinden çıkarmak için `noindex` (taranabilir bırakın), kopyaları birleştirmek için `rel=canonical`, taramayı durdurmak için robots.txt (dizinden çıkarmaz), ortadan kalkan sayfalar için `404`/`410` veya ince içeriği birleştirme.
TL;DR — Dizin şişkinliği, arama motorlarının sitenizde kimsenin aramadığı bir dizi düşük değerli sayfayı dizine eklemesidir — filtre URL’leri, dahili arama sonuçları, etiket sayfaları ve yakın kopyalar. Bu bir ceza değildir. Bu, “Google’ın zamanını boşa harcıyor ve kendi sinyallerinizi bölüyorsunuz” sorunudur. Mesele sahip olduğunuz sayfa sayısı değil, kalitedir.
Dizin şişkinliği nedir?
“Index bloat”, SEO uzmanlarının Google’a atfetmediği bir terimdir; arama motorunun sitenizde gerçekten orada olmayı hak etmeyen çok sayıda sayfayı arşivlemesini anlatır. Dahili arama sonuç sayfalarını, bir mağazadaki olası her filtre birleşimini, boş etiket sayfalarını, yazıcı dostu sürümleri ve beş farklı URL’den erişilebilen aynı sayfayı düşünün.
Anahtar ifade düşük değerli olmaktır. Kimse aramıyorsa ve iyi içeriğinizi bulmaya yardımcı olmuyorsa bir sayfa şişkinliğe katkıda bulunur. Bunu sayfa sayısı belirlemez — küçük bir site karmakarışık olabilir, büyük bir site ise tertemiz olabilir.
Gerçekten bir sorun mu?
Genellikle insanların korktuğundan daha az önemlidir. “Dizin şişkinliği cezası” yoktur. Google bazı gereksiz URL’leri dizine ekledi diye sitenizin tamamını alt sıralara itmez. Gerçekte olan daha sıradandır:
- Boşa giden tarama. Arama motorları önemli, yeni sayfalarınız yerine gereksiz sayfaları getirmeye zaman harcar.
- Bölünmüş sinyaller. Aynı içerik birkaç URL’de bulunduğunda bağlantılar ve ilgi tek güçlü sayfada toplanmak yerine dağılır.
Küçük bir sitede bunun önemi nadiren büyüktür. Binlerce URL üreten şablonlara sahip büyük bir mağazada veya yayıncıda ise etkiler birikir.
Buna ne sebep olur?
En sık karşılaşılanlar:
- Filtreleme ve sıralama URL’leri (fasetli gezinme) — her birleşim yeni bir URL üretir.
- URL parametreleri — sıralama, filtreleme, izleme etiketleri ve oturum kimlikleri.
- Dahili arama sonucu sayfaları — sitenizin kendi arama sonuçlarının dizine eklenmesi.
- Gerçek içeriği olmayan etiket, kategori ve yazar arşivi sayfaları.
- Sayfalama — bir listenin 2., 3., 4. ve sonraki sayfaları.
- Yinelenen sürümler — http/https, www/www olmayan, sondaki eğik çizgili/çizgisiz URL’ler.
- Soft 404’ler — “bulunamadı” deyip “OK” durumu döndüren, bu nedenle arama motorunun tutmaya devam ettiği sayfalar.
Nasıl kontrol edilir?
site:example.com aramasına güvenmeyin — bu sayı yalnızca yaklaşık bir tahmindir. Google’ın dizine eklenen/dizine eklenmeyen özetini ve bildirilen nedenleri görmek için Google Search Console → Sayfa dizine ekleme raporunu kullanın; ancak örnek URL listelerinin sınırlı olduğunu unutmayın. Evidence for this claim Search Console's Page Indexing report summarizes indexed and non-indexed pages and groups non-indexed pages by reason, with limited example rows. Scope: Google Search Console reporting; it is not an exhaustive downloadable URL inventory. Confidence: high · Verified: Google: Page indexing report
Nasıl düzeltilir? (kısa sürüm)
Aracı sayfaya göre seçin:
- Arama değeri yok ve hiç görünmemeli mi?
noindexekleyin (etiketi Google görebilsin diye sayfanın taranabilir kalmasını sağlayın). Evidence for this claim Google recommends noindex to prevent indexing while allowing crawling, canonical signals for duplicates, and 404/410 for removed pages. Scope: The appropriate control depends on the page's intended state. Confidence: high · Verified: Google: Block indexing with noindex Google: Canonicalization Google: HTTP status codes - Önemli bir sayfanın kopyası mı?
rel=canonicalişaretini asıl sayfaya yöneltin. - Gerçekten ortadan kalktı mı?
404veya410döndürün. - Tek bir konu hakkında çok sayıda ince sayfa mı var? Bunları tek bir iyi sayfada birleştirin.
Tam karar tablosunu, teşhis yöntemlerini ve herkesi zorlayan tuzakları (örneğin robots.txt’de bir sayfayı engellemenin onu Google’dan kaldırmamasının nedenini) görmek için Advanced sekmesine geçin.
TL;DR — “Index bloat” Google’ın kullandığı bir terim değil, SEO sektörünün terimidir. Asıl sorun; fasetli gezinme, parametreler, dahili arama, etiket arşivleri, sayfalama, soft 404’ler ve protokol kopyaları gibi ince, yinelenen veya düşük değerli URL’lerin dizine eklenmesidir. Bu bir tarama verimliliği ve sinyal seyrelmesi sorunudur, ceza değildir. Bing, yinelenen içeriğin tek başına arama cezası doğurmadığını; Mueller ise yinelenen içerik cezası bulunmadığını söyler. Konu sayfa sayısı değil kalitedir. GSC Sayfa dizine ekleme raporu, günlükler ve tarayıcılarla teşhis edin;
site:yalnızca kaba bir tahmindir. Evidence for this claim Search Console's Page Indexing report summarizes indexed and non-indexed pages and groups non-indexed pages by reason, with limited example rows. Scope: Google Search Console reporting; it is not an exhaustive downloadable URL inventory. Confidence: high · Verified: Google: Page indexing report İşlemi niyete göre seçin:noindexdizinden çıkarır (sayfayı taranabilir tutun),rel=canonicalkopyaları birleştirir (kural değil ipucudur), robots.txt yalnızca taramayı durdurur (zaten dizine eklenmiş URL’yi çıkarmaz), ortadan kalkan sayfalarda404/410, ince içerikte birleştirme kullanılır. Evidence for this claim Google recommends noindex to prevent indexing while allowing crawling, canonical signals for duplicates, and 404/410 for removed pages. Scope: The appropriate control depends on the page's intended state. Confidence: high · Verified: Google: Block indexing with noindex Google: Canonicalization Google: HTTP status codes Removals aracı geçicidir (yaklaşık 6 ay).
”Index bloat” gerçekte ne anlama gelir?
Önce çoğu makalenin yanlış kurduğu çerçeveyi düzeltelim: “index bloat” Google’ın değil, SEO sektörünün terimidir. Google bu ifadeyi kullanmaz. Terim; yinelenen URL’ler, düşük değerli veya önemsiz URL’ler, soft 404’ler, sonsuz alanlar ve fasetli gezinme gibi bileşenleri tanımlar. Bu ifadeyi Google’a atfetmeyin ve Google’ın adını koyup peşine düştüğü, cezalandırdığı ayrı bir sorunmuş gibi ele almayın.
Benim rahatlıkla kullandığım çalışma tanımı şu: Dizin şişkinliği, arama motorlarının sitenizde arama değeri taşımayan sayfaları dizine eklemesidir. Vurgu hacimde değil değerdedir. 500 sayfalık bir site temiz olabilir; 100 000 sayfalık bir site çoğunlukla şişkinlikten oluşabilir. Bu, sayfa sayısı kostümü giymiş bir kalite sorunudur.
Dizin şişkinliği gerçekten bir sorun mu? Dürüst yanıt
Çoğu kişinin düşündüğünden daha az — daha da önemlisi, ceza değildir. Bu, alandaki en çok abartılan noktadır. Bing, yinelenen içeriğin tek başına arama cezası doğurmadığını açıkça söyler. Mueller da yıllardır Google’ın yinelenen içerik cezası uygulamadığını ve çok yinelenen içeriği olduğu için bir siteyi geriletmediğini belirtiyor.
Peki bunun size maliyeti nedir? İki gerçek ve pratik sonuç vardır:
-
Boşa giden tarama. Google’ın büyük site rehberine göre çok sayıda URL kopyaysa veya başka şekilde istenmiyorsa sitenizdeki Google tarama süresinin büyük bölümü boşa gider. Google tarayıcıları, taranmaması gereken URL’lere fazla zaman ayırdığında sitenin geri kalanına bakmanın buna değmeyeceğine karar verebilir. Mekanizma budur — gereksiz URL’ler önemsediğiniz sayfaların taranmasını boğar ve yeni içeriğin keşfini yavaşlatır.
-
Seyrelmiş sinyaller. Bing, yakın kopyalarda tıklama, bağlantı, gösterim ve etkileşim gibi sinyallerin çoğu zaman seyreldiğini açıkça anlatır. Bir sayfanın değerini birbirine çok benzeyen beş URL’ye yayarsanız hiçbiri tek birleştirilmiş sayfanın sıralandığı kadar iyi sıralanmaz.
Bu ne zaman gerçekten önem taşır? Büyük veya şablonla yönetilen sitelerde — e-ticaret (fasetli gezinme, parametreler, ürün varyantları), yayıncılar (etiketler, arşivler, sayfalama) ve URL’leri otomatik oluşturan CMS’lerde (WordPress etiket/yazar/feed sayfaları, dahili arama). Küçük ve statik bir sitede ise çoğunlukla gürültüdür.
Kendi çalışmamda kullandığım dürüst içgüdü kontrolü şu: Bir keresinde Ahrefs blogunu canlı olarak denetledim ve 4 700’den fazla taranmış sayfa buldum; ancak gerçekten sıralanan sayfa sayısı yaklaşık 1 600’dü. “Zombi sayfalar” feed sayfaları (yorum, kategori, yazar feed’leri) ve sayfalama gibi şeylerdi. Çıkarımım sakin olandı: çoğu SEO’ya zarar vermedi, fakat tarama bütçesini tüketti; bu nedenle çözüm panik değil triyajdı (örneğin sayfalama hacmini azaltmak için sayfa başına daha fazla öğe göstermek). Her dizin şişkinliği incelemesine, hiçbir şeye dokunmadan önce “Bu gerçekten önemli mi?” diye sorarak başlayın.
Dizin şişkinliğine ne sebep olur?
En sık suçlu oldukları sıraya kabaca göre başlıca kaynaklar:
- Fasetli gezinme. Bir numaralı kaynaktır. Gary Illyes, Google’ın Crawling December yazısında fasetli gezinmenin site sahiplerinin bildirdiği aşırı tarama sorunlarının açık ara en yaygın kaynağı olduğunu, çünkü neredeyse sonsuz sayıda URL üretebildiğini söyler. Bu yapı her zaman sunucu kaynağı tüketir ve aşırı tarama önemli yeni içeriğinizin keşfini yavaşlatır.
- URL parametreleri — sıralama, filtreleme, izleme ve oturum kimlikleri. Her yeni parametre değeri, özgün içeriği olmayan yeni bir taranabilir ve dizine eklenebilir URL olabilir.
- Dahili arama sonucu sayfaları — sitenizin kendi arama sonuçlarının dizine eklenmesi. Bunların neredeyse hiçbir zaman bağımsız arama değeri yoktur.
- Etiket, kategori ve yazar arşivleri ile akışlar — otomatik üretilir ve çoğu zaman incedir.
- Sayfalama — liste sayfalarının 2., 3. ve 4. sayfalarının kategori ve arşivler boyunca çoğalması.
- Protokol ve ana bilgisayar kopyaları — http/https, www/www olmayan ve sondaki eğik çizgili/çizgisiz sürümler. Google’ın kanonikleştirme belgesi bölge, cihaz ve protokol varyantları ile sıralama/filtreleme sonuçları gibi site işlevlerini özellikle sayar.
- Soft 404’ler ve sonsuz alanlar —
200döndüren takvimler, sonsuz kaydırma ve “bulunamadı” sayfaları. Google’a göre soft 404 sayfaları taranmaya devam eder ve bütçenizi boşa harcar. - Otomatik üretilen ve ince sayfalar — arkasında çok az özgün içerik bulunan her şablon ürünü.
Google’ın ölçekle ilgili yararlı bir hatırlatması var: web, Google’ın mevcut her URL’yi keşfetme ve dizine ekleme kapasitesini aşan, neredeyse sonsuz bir alandır. Şablonlarınız sonsuz URL üretebiliyorsa Google sizi kendinizden kurtaramaz.
Dizin şişkinliği nasıl teşhis edilir?
GSC Sayfa dizine ekleme raporu authoritative sayımdır. Google toplamların “complete and accurate from Google’s perspective” olduğunu söyler. site: operatörü yerine bunu kullanın. Ham sayıdan daha değerli olan, sayfaların neden dizine eklenmediğinin dökümüdür. Şişkinliğin izini veren kategoriler şunlardır:
- Taranmış – şu anda dizine eklenmemiş — sayfa Google tarafından taranmış ancak dizine eklenmemiştir. Buradaki şişmiş yığın klasik bloat sinyalidir.
- Keşfedilmiş – şu anda dizine eklenmemiş — sayfa Google tarafından bulunmuş ancak henüz taranmamıştır. Google, ulaşmadığı URL’lerden haberdardır.
- Kullanıcı tarafından seçilmiş canonical olmadan yinelenen — sayfa başka bir sayfanın kopyasıdır ancak tercih edilen canonical belirtilmemiştir.
- Yinelenen; Google kullanıcıdan farklı bir canonical seçti — Google başka bir URL’nin daha iyi canonical olduğunu düşünür.
- Soft 404 — kullanıcı dostu bir “bulunamadı” mesajı döndürür ancak 404 HTTP yanıt kodu döndürmez.
Aynı raporda şu durumlar da önemlidir: “Alternate page with proper canonical tag”, “Page with redirect”, “Blocked by robots.txt” ve “Excluded by ‘noindex’ tag”.
“Crawled - currently not indexed” konusunda önemli bir nüans var: Mueller bunu sayfa başına bir hata değil, site genelinde bir kalite sinyali olarak çerçeveledi. Sayfaları dizine girmeye zorlayamazsınız; tüm sitelerdeki tüm sayfaların dizine eklenmemesi normaldir. Sorun tek bir sayfadan çok site genelindedir; iyi bir site yapısı kurup sitenin mümkün olan en yüksek kalitede olmasını sağlamak gerekir. Sitenizde genel sorunlar varsa yalnızca dizine girmeyen URL’lere değil, sitenin geri kalanına bakmalısınız. Ancak durumun kendisini fazla yorumlamayın; düşük kaliteli içerik sorunlarını özellikle işaretlemek amacıyla oluşturulmamıştır.
Geri kalan teşhis araçları:
site:operatörü — yalnızca hızlı bir içgüdü kontrolüdür (ör.site:example.com inurl:?veyasite:example.com/tag/ile bir bloat örüntüsü bulmak). Bunu asla kesin sayı olarak aktarmayın; GSC ile karşılaştırın.- Günlük dosyası analizi — Googlebot’un gerçekte neye zaman harcadığını görün. İsteklerin büyük payı parametre/facet/feed URL’lerine gidiyorsa bu boşa giden taramadır.
- Site tarayıcıları (Ahrefs Site Audit, Screaming Frog) — ince, yinelenen ve yetim sayfaları, dizine eklenebilir parametre URL’lerini ve yakın kopya kümelerini ortaya çıkarır; taranabilir dizine eklenebilir URL’leri XML site haritanızla ve gerçekten trafik alan sayfalarla karşılaştırın.
- Taranan-sıralanan farkı (benim yöntemim) — dizine eklenebilir/taranmış sayfaları gerçekten sıralanan veya trafik alan sayfalarla karşılaştırın. Fark, triyaj için zombi/şişkinlik aday listenizdir.
Nasıl düzeltilir — doğru aracı seçin
Use noindex for a page that stays live but should not appear in search, canonical for a duplicate of a useful URL, 404 or 410 for a permanently gone URL, and consolidation when several thin pages serve one intent. Use robots.txt only to stop wasteful crawling because it does not deindex the URL.
© Patrick Stox LLC · CC BY 4.0 ·
Tek bir düzeltme yoktur. Her URL, ne olduğuna ve değer taşıyıp taşımadığına göre bir işlem alır. Karar tablosu (Cheat Sheets sekmesinde tamamı gösterilir) işin özüdür; her aracın arkasındaki mantık ise şöyledir:
noindex — dizinden çıkarma. Bir sayfanın arama değeri yoksa ve hiç görünmemesi gerekiyorsa kullanın (dahili arama sonuçları, teşekkür sayfaları, ince etiket/filtre sayfaları). Google, diğer siteler bağlantı verse bile sayfayı Arama sonuçlarından tamamen çıkarır. noindex etiketi, faset sayfalarının dizine eklenmesini önlemenin en güvenilir yoludur. Kritik tuzak: noindex’in çalışması için sayfa taranabilir kalmalıdır. Google’a göre noindex kuralının etkili olması için sayfa veya kaynak robots.txt ile engellenmemelidir. Önce engellerseniz Google noindex’i göremez.
rel=canonical — değer taşıyan kopyaları birleştirme. Bağlantı veya değer taşıyan yakın kopyalarda kullanın (parametre varyantları, yazdırma sürümleri, protokol/ana makine kopyaları). Canonical URL, Google’ın yinelenen sayfalar kümesinden en temsili olarak seçtiği URL’dir; birini işaret etmek sinyalleri birleştirmenin yoludur. Ancak bu bir ipucudur, kural değildir ve Google çeşitli nedenlerle sizden farklı bir sayfayı canonical seçebilir. Her zaman tekrarladığım kesin kural şudur: aynı sayfada noindex ile rel=canonical’ı asla birlikte kullanmayın — çelişkili talimatlardır.
robots.txt disallow — yalnızca taramayı durdurur. Dizine eklenmesini istemediğiniz ve sinyal almak istemediğiniz devasa taranabilir gereksiz URL hacimlerinde (sonsuz faset birleşimleri) botları dışarıda tutmak için kullanın. Illyes, bu URL’lerin dizine eklenmesine ihtiyacınız yoksa taramayı robots.txt ile engellemenizi önerir. Ancak ne yaptığını ve ne yapmadığını anlayın: robots.txt bir web sayfasını Google dışında tutma yöntemi değildir ve engellenen sayfa başka sitelerden bağlantı alıyorsa yine dizine eklenebilir. Taramayı durdurur; zaten dizine eklenmiş URL’leri dizinden çıkarmaz.
404 / 410 — gerçekten ortadan kalkan sayfalar. Artık var olmaması gereken sayfalar için bunları döndürün. 410, biraz daha güçlü bir “gone” sinyalidir; 404 ise “a strong signal not to crawl that URL again” ifadesindeki gibi URL’nin yeniden taranmaması için güçlü bir sinyaldir.
Birleştirme / merge / budama — tek konuda çok sayıda ince sayfa. Bunları tek bir güçlü sayfada birleştirin (geri kalanlara 301 uygulayın) veya silin. Google, taramayı benzersiz URL’ler yerine özgün içeriğe odaklamak için yinelenen içeriği birleştirmeyi önerir. Bu, ince içerik için en iyi uzun vadeli çözümdür.
Removals aracı — yalnızca geçici. GSC’nin Removals aracı bir URL’yi sonuçlardan hızla çıkarır, ancak bu bir yara bandıdır; istekler yaklaşık 6 ay geçerlidir. Bunu her zaman kalıcı bir yöntemle (noindex, 404/410 veya kaldırma) birlikte kullanın.
Herkesi zorlayan sıralama kuralı
Zaten dizine eklenmiş düşük değerli bir URL’yi kalıcı olarak kaldırmak için: noindex (veya 404/410) uygulayın ve Google yeniden işleyene kadar URL’yi taranabilir tutun. Tarama tasarrufu yapmak istiyorsanız disallow’ı robots.txt’ye yalnızca URL dizinden düştükten sonra ekleyin. Önce engellemek URL’yi dizinde hapseder — Google tarayamadığı noindex’i okuyamaz ve URL (bazen snippetsız) sonuçlarda süresiz kalabilir.
Yaygın mitleri çürütelim
- “Google dizin şişkinliğini / yinelenen içeriği cezalandırır.” Hayır. Ceza yoktur — yalnızca boşa giden tarama ve seyrelmiş sinyaller vardır.
- “robots.txt sayfaları dizinden çıkarır.” Hayır — yalnızca taramayı durdurur. Engellenen sayfalar bağlantılar üzerinden yine de dizine eklenebilir.
- “noindex tarama bütçesinden tasarruf sağlar.” Hayır — Google önce noindex’i görmek için sayfayı ister.
- “Güvende olmak için aynı sayfada noindex VE robots.txt engeli kullanabilirsiniz.” Hayır — engellenmişse Google noindex’i okuyamaz ve sayfa dizinde kalabilir.
- “rel=canonical birleştirmeyi zorunlu kılar.” Hayır — bu bir ipucudur; Google farklı bir canonical seçebilir.
- “
site:operatörü dizine eklenen tam sayıyı verir.” Hayır — bu bir tahmindir. GSC Sayfa dizine ekleme raporuna güvenin. - “Daha çok dizine eklenmiş sayfa = daha iyi.” Hayır — niceliğe karşı kalite. Düşük değerli dizine eklenmiş URL’ler sinyalleri seyreltir ve taramayı boşa harcar.
Önleme — koruyucu sınırlar oluşturun
En iyi çözüm, en başta şişkinlik üretmemektir:
- Şablon düzeyinde CMS noindex’i, asla sıralanmaması gereken şablonlarda kullanın (dahili arama, ince filtre sayfaları, bazı arşivler) — sayfa sayfa değil, şablon düzeyinde bir kez ayarlayın.
- Parametre disiplini — hangi parametrelerin dizine eklenebilir URL oluşturacağını, hangilerinin canonical’a bağlanacağını veya engelleneceğini baştan belirleyin.
- Tutarlı URL’ler — tek bir protokol, tek bir ana makine ve tek bir sondaki eğik çizgi kuralı seçin ve bunu zorunlu kılın.
- Düzenli denetimler — şişkinliğin geri sızmaması için taranan-sıralanan kontrolünü üç ayda bir yeniden çalıştırın.
Bu konu birkaç kardeş başlığın hemen yanında durur: dizin şişkinliğinin kaynaklarını tükettiği tarama bütçesi, ana birleştirme aracı olan canonicalization ve en yaygın kaynak olan fasetli gezinme. Sayfaların dizine nasıl girdiği — ve nasıl dışarıda kaldığı — hakkında daha geniş çerçeve için indexing hub’ına bakın.
AI özet
Advanced sürümün kısaltılmış özeti:
- “Index bloat” Google’ın değil, SEO sektörünün terimidir. Asıl sorun; fasetli gezinme, parametreler, dahili arama, etiket/arşiv sayfaları, sayfalama, soft 404’ler ve protokol/ana bilgisayar kopyaları gibi ince, yinelenen veya düşük değerli URL’lerin dizine eklenmesidir.
- Konu sayfa sayısı değil kalitedir. Küçük bir site dağınık, çok büyük bir site temiz olabilir.
- Ceza değildir. Bing yinelenen içeriğin tek başına arama cezası doğurmadığını, Mueller ise yinelenen içerik cezası olmadığını söyler. Gerçek maliyetler boşa giden tarama ve yakın kopyalar arasında seyrelen sinyallerdir.
- En çok büyük ve şablon güdümlü sitelerde önemlidir (e-ticaret, yayıncılar ve otomatik içerik üreten CMS’ler). Önce bunun gerçekten sorun olup olmadığını değerlendirin.
- GSC Sayfa dizine ekleme raporuyla teşhis edin. “Taranmış – şu anda dizine eklenmemiş” ve “Yinelenen” gruplarını izleyin.
site:yalnızca kaba bir tahmindir; günlükleri, site tarayıcılarını ve taranan-sıralanan farkını da kullanın. - Niyete göre düzeltin: dizinden çıkarmak için
noindex(sayfayı taranabilir tutun), kopyaları birleştirmek içinrel=canonical(kural değil ipucudur; noindex ile karıştırmayın), yalnızca taramayı durdurmak için robots.txt, ortadan kalkan sayfalar için404/410, ince içerik için birleştirme kullanın. - Sıralama: zaten dizine eklenmiş URL’ye noindex (veya 404/410) uygulayın ve düşene kadar taranabilir tutun; ancak bundan sonra robots.txt ile engelleyin. Önce engellemek URL’yi dizinde hapseder.
- Removals aracı geçicidir (yaklaşık 6 ay) — kalıcı bir düzeltmeyle birlikte kullanın.
- CMS düzeyinde şablon noindex’i, parametre disiplini, tutarlı URL’ler ve düzenli denetimlerle önleyin.
Resmî dokümantasyon
Arama motorlarının birincil kaynak dokümantasyonu.
- Tarama bütçenizi optimize edin — “şişkinlik taramayı boşa harcar” mekanizması, kopyaları birleştirme, soft 404s ve taramadan tasarruf etmek için neden noindex kullanılmaması gerektiği.
- Tarama bütçesi yönetimi — altyapı görünümü: web “nearly infinite” olduğu için gereksiz tarama sitenizin geri kalanının kaynaklarını tüketir.
- Crawling December: Fasetli gezinme — Gary Illyes’in fasetli gezinmeyi bir numaralı aşırı tarama kaynağı olarak açıklaması ve ne zaman engellemek yerine optimize etmek gerektiği.
- noindex ile dizine eklemeyi engelleme — noindex’in ne yaptığı ve sayfanın taranabilir kalması gerektiğine ilişkin önemli ayrıntı.
- robots.txt’ye giriş — disallow’ın neden dizinden çıkarma aracı olmadığı.
- URL canonicalization / Canonical belirtme — canonical’ın ne olduğu, yinelenmenin nedenleri ve “a hint, not a rule” ilkesi.
- Sayfa dizine ekleme raporu — yetkili sayım ve şişkinliğe işaret eden dizine eklenmemiş durumlar.
- Google’dan bilgileri kaldırma — Removals aracı ve neden geçici olduğu.
Bing / Microsoft
- Yinelenen içerik SEO’ya ve yapay zekâ arama görünürlüğüne zarar verir mi? — Bing’in yinelenen/düşük değerli URL’leri ceza değil, tarama verimliliği ve sinyal seyrelmesi sorunu olarak yeniden çerçevelemesi.
Kaynak metninden alıntılar
Google ve Bing tarafından kaynağın kendisinde açıkça belirtilen açıklamalar. Her bağlantı, kaynak sayfadaki alıntı bölümüne doğrudan gider.
Google — ceza yok; taramayı boşa harcar ve sinyalleri seyreltir
- “this wastes a lot of Google crawling time on your site.” — Google Arama Merkezi dokümanları. Alıntıya git
- “If Google spends too much time crawling URLs that it shouldn’t, Google’s crawlers might decide that it’s not worth the time to look at the rest of your site.” Alıntıya git
- “The web is a nearly infinite space, exceeding Google’s ability to explore and index every available URL.” Alıntıya git
Google (Gary Illyes) — fasetli gezinme, bir numaralı kaynak
- “faceted navigation is by far the most common source of overcrawl issues site owners report to us.” — Gary Illyes, Google (Crawling December, 2024). Alıntıya git
- “Because it can generate a near-infinite number of URLs.” — Gary Illyes, Google. Alıntıya git
- “This overcrawling slows down the discovery of your important, new content.” — Gary Illyes, Google. Alıntıya git
- “If you don’t need these URLs indexed, use robots.txt to disallow crawling.” — Gary Illyes, Google. Alıntıya git
Google — noindex, robots.txt, canonical (araçlar)
- “Google will drop that page entirely from Google Search results, regardless of whether other sites link to it.” (çeviri) “Google, diğer sitelerin bağlantı verip vermediğine bakmaksızın bu sayfayı Google Arama sonuçlarından tamamen çıkarır.” — Google Arama Merkezi dokümanları (noindex). Alıntıya git
- “For the noindex rule to be effective, the page or resource must not be blocked by a robots.txt file.” (çeviri) “noindex kuralının etkili olabilmesi için sayfa veya kaynak robots.txt dosyasıyla engellenmemiş olmalıdır.” Alıntıya git
- “it is not a mechanism for keeping a web page out of Google.” (çeviri) “Bu, bir web sayfasını Google dışında tutma yöntemi değildir.” — Google Arama Merkezi dokümanları (robots.txt). Alıntıya git
- “A page that’s disallowed in robots.txt can still be indexed if linked to from other sites.” (çeviri) “robots.txt ile engellenen bir sayfa, başka sitelerden bağlantı alıyorsa yine dizine eklenebilir.” Alıntıya git
- “a canonical URL is the URL of a page that Google chose as the most representative from a set of duplicate pages.” (çeviri) “Canonical URL, Google’ın yinelenen sayfalar kümesinden en temsili olarak seçtiği sayfanın URL’sidir.” Alıntıya git
- “indicating a canonical preference is a hint, not a rule.” (çeviri) “Canonical tercihi belirtmek bir ipucudur, kural değildir.” Alıntıya git
- “Consolidate duplicate content to focus crawling on unique content rather than unique URLs.” (çeviri) “Taramayı benzersiz URL’ler yerine özgün içeriğe odaklamak için yinelenen içeriği birleştirin.” Alıntıya git
- “a 404 status code is a strong signal not to crawl that URL again.” (çeviri) “404 durum kodu, bu URL’yi yeniden taramamak için güçlü bir sinyaldir.” Alıntıya git
Google — teşhis (Sayfa dizine ekleme raporu) ve Removals
- “The indexed + not indexed totals above the chart are complete and accurate from Google’s perspective.” (çeviri) “Grafiğin üzerindeki dizine eklenmiş ve eklenmemiş toplamları Google’ın bakış açısından eksiksiz ve doğrudur.” Alıntıya git
- “The page was crawled by Google but not indexed. It may or may not be indexed in the future.” (çeviri) “Sayfa Google tarafından tarandı ancak dizine eklenmedi. Gelecekte dizine eklenebilir veya eklenmeyebilir.” — “Taranmış – şu anda dizine eklenmemiş.” Alıntıya git
- “Requests made in the Removals tool last for about 6 months.” (çeviri) “Removals aracında yapılan istekler yaklaşık 6 ay geçerlidir.” Alıntıya git
Google (John Mueller) — site genelinde kalite, ceza değil
- “you can’t force pages to be indexed — it’s normal that we don’t index all pages on all websites. It’s not an issue with ‘that page’, it’s more site-wide. Creating a good site structure and making sure the site is of the highest quality possible is essentially the direction.” (çeviri) “Sayfaları dizine eklenmeye zorlayamazsınız; tüm sitelerdeki tüm sayfaları dizine eklemememiz normaldir. Sorun ‘o sayfa’dan çok site genelindedir. İyi bir site yapısı kurmak ve sitenin mümkün olan en yüksek kalitede olmasını sağlamak izlenecek temel yoldur.” — John Mueller, Arama Savunucusu, Google (2021). Alıntıya git
- “If there are overall issues with your site, you need to look at the rest of your site, not the URLs that didn’t end up getting indexed.” (çeviri) “Sitenizde genel sorunlar varsa dizine eklenmeyen URL’lere değil, sitenizin geri kalanına bakmanız gerekir.” — John Mueller, Google. Alıntıya git
- “We don’t have a duplicate content penalty. It’s not that we would demote a site for having a lot of duplicate content.” (çeviri) “Yinelenen içerik cezamız yok. Çok fazla yinelenen içeriği olduğu için bir siteyi geriletmeyiz.” — John Mueller, Google. Alıntıya git
Bing (Fabrice Canel ve Krishna Madhavan) — ceza yok, yalnızca seyrelme
- “Duplicate content doesn’t trigger search penalties on its own.” — Fabrice Canel ve Krishna Madhavan, Microsoft Bing (2025). Alıntıya git
- “signals such as clicks, links, impressions, and engagement are often diluted.” — Microsoft Bing. Alıntıya git
Dizin şişkinliği denetim listesi
Şişkinlikten şüphelendiğinizde bunu bir kez uygulayın — ancak önce durumu sakin değerlendirin (çoğu sitenin gerçek bir sorunu yoktur):
- Kapsamı GSC Sayfa dizine ekleme raporuyla,
site:operatörüyle değil, doğruladım. “Crawled - currently not indexed” ve “Duplicate” kümelerinin olağandışı büyük olup olmadığını not ettim. - Taranan-sıralanan farkını çalıştırdım — dizine eklenebilir/taranmış sayfalarla gerçekten sıralanan veya trafik alan sayfaları saydım; farktan bir aday listesi oluşturdum.
- Sunucu günlüklerini taramanın parametre/faset/akış/dahili arama URL’lerine gidip gitmediği açısından kontrol ettim.
- Bir site tarayıcısı (Ahrefs Site Audit / Screaming Frog) çalıştırarak ince, yinelenen ve yetim sayfaları ve dizine eklenebilir parametre URL’lerini ortaya çıkardım.
- Mevcut kaynak kalıplarını belirledim: fasetli gezinme, URL parametreleri, dahili arama, etiket/kategori/yazar arşivleri ve akışları, sayfalama, protokol/ana makine kopyaları, soft 404s, sonsuz alanlar, ince/otomatik üretilen sayfalar.
- Her kalıp için niyete uygun doğru aracı seçtim (Cheat Sheets sekmesindeki karar tablosuna bakın).
-
noindexverilen URL’lerin hâlâ taranabilir olduğunu (robots.txt ile ayrıca engellenmediğini) doğruladım. - Hiçbir sayfada hem
noindexhem derel=canonicalolmadığını doğruladım. - Zaten dizine eklenmiş gereksiz URL’ler için önce
noindex/404/410uyguladım, URL’yi taranabilir tuttum ve robots.txt engelini yalnızca URL düştükten sonra planladım. - Removals aracına kalıcı çözüm olarak güvenmedim (yaklaşık 6 ay sürer).
- Önleme sınırlarını kurdum: CMS şablonu düzeyinde noindex, parametre kuralları, tutarlı URL’ler ve üç ayda bir yeniden denetim.
Zihinsel modeller
1. Nicelik değil, kalite. Dizin şişkinliği “çok fazla sayfa” demek değildir. Arama değeri taşımayan “dizine eklenmiş sayfalar” demektir. Denetim sorusu hiçbir zaman “Kaç sayfam var?” değildir — “Bu sayfalardan hangisi dizinde yer almayı hak ediyor?” sorusudur.
2. Verimlilik + seyrelme; asla ceza değil. Dizin şişkinliği cezası da yinelenen içerik cezası da yoktur. İki gerçek maliyet, boşa giden tarama (gereksiz URL’ler iyi sayfalarınızın taranmasını engeller) ve seyrelmiş sinyallerdir (değer yakın kopyalar arasında bölünür). Her öneriyi sıralama düşürülmesi korkusuna değil, bu iki maliyete dayandırın.
3. “Bu gerçekten önemli mi?” kapısı. Her şeye dokunmadan önce şunları sorun: Site büyük mü veya şablonlarla mı yönetiliyor? Önemli/yeni sayfaların taranıp dizine eklenmesi yavaş mı? GSC’de “Crawled - currently not indexed” ya da “Duplicate” kümesi büyüyor mu? Bunların hiçbiri doğru değilse şişkinlik çoğunlukla kozmetiktir — zamanınızı başka yerde harcayın.
4. Aracı URL’nin niyetiyle eşleştirin.
Bütün düzeltme, URL türüne göre verilen bir yönlendirme kararıdır: değer yoksa → noindex; değer taşıyan kopyaysa → rel=canonical; taranmasını bile istemediğiniz büyük ve taranabilir gereksiz hacimse → robots.txt; gerçekten ortadan kalkmışsa → 404/410; çok sayıda ince sayfaysa → birleştirin. (Cheat Sheets sekmesindeki karar tablosuna bakın.)
5. Sıralama önemlidir: engellemeden önce dizinden çıkarın.
Zaten dizine eklenmiş bir URL’yi kaldırmak için, Google yeniden işleyene kadar URL’yi taranabilir tutarken noindex (veya 404/410) uygulayın; ancak URL düştükten sonra robots.txt ile engelleyin. Önce engellerseniz URL’yi sonsuza kadar dizinde hapsedersiniz.
6. Yetkili sayım GSC’de bulunur.
site:, kalıpları fark etmek için kaba bir tahmindir. Sayıyı veren kaynak Sayfa dizine ekleme raporudur — dizine eklenmeme nedenleri de asıl teşhis bilgisidir.
Düzeltme karar tablosu — noindex vs canonical vs robots.txt vs 404/410 vs birleştirme
| Durum | Kullanılacak araç | Neden / dikkat |
|---|---|---|
| Sayfa arama değeri taşımıyor, hiç görünmemeli (dahili arama sonuçları, teşekkür sayfaları, ince etiket/filtre sayfaları) | noindex | Dizinden çıkarır. Sayfa taranabilir kalmalıdır — robots.txt ile ayrıca engellemeyin. |
| Değer veya bağlantı taşıyan yinelenen/yakın kopya (parametre varyantları, yazdırma sürümleri, http/https, www) | rel=canonical (veya kopyayı tamamen emekliye ayırabiliyorsanız 301) | Sinyalleri birleştirir. İpucudur, kural değildir — Google geçersiz kılabilir. noindex ile asla birlikte kullanmayın. |
| Dizine eklenmesini ve sinyallerini istemediğiniz devasa taranabilir gereksiz URL hacmi (sonsuz faset birleşimleri) | robots.txt disallow | Taramayı durdurur. Zaten dizine eklenmiş URL’leri dizinden çıkarmaz; bunlar snippet olmadan dizinde kalabilir — zaten dizine eklenmişse önce noindex ile çıkarın. |
| Sayfa gerçekten ortadan kalktı | 404 / 410 | 410 biraz daha güçlü bir “gone” sinyalidir; 404 ise “a strong signal not to crawl that URL again.” |
| Tek bir konu hakkında çok sayıda ince sayfa | Birleştir / merge / buda | Tek bir güçlü sayfada birleştirin (geri kalanlara 301 uygulayın) veya silin. İnce içerik için en iyi uzun vadeli düzeltmedir. |
| Bir sayfayı sonuçlardan hızla çıkarma ihtiyacı (geçici) | GSC Removals aracı | Yaklaşık 6 ay sürer; kalıcı bir yöntemle (noindex / 404 / kaldırma) birlikte kullanın. |
Sıralama kuralı: zaten dizine eklenmiş düşük değerli bir URL’yi kalıcı olarak kaldırmak için noindex (veya 404/410) uygulayın ve Google yeniden işleyene kadar taranabilir tutun; yalnızca URL dizinden düştükten sonra robots.txt disallow ekleyin. Önce engellemek URL’yi dizinde hapseder.
Teşhis — kısa başvuru
| Yöntem | Size ne söyler | Dikkat |
|---|---|---|
| GSC Sayfa dizine ekleme raporu | Yetkili dizine eklenmiş/dizine eklenmemiş toplamları ve sayfaların neden dizine eklenmediğini gösterir | site: yerine bunu kullanın. “Crawled - currently not indexed” ve “Duplicate” kümelerini izleyin |
site: operatörü | Şişkinlikteki kalıp hakkında kaba bir fikir verir (ör. inurl:?, /tag/) | Yalnızca tahmindir — hiçbir zaman kesin sayım değildir |
| Günlük dosyası analizi | Googlebot’un taramayı gerçekte nereye harcadığını gösterir | Gerçekten Googlebot olduğunu doğrulayın |
| Site tarayıcısı (Ahrefs / Screaming Frog) | İnce, yinelenen, yetim ve dizine eklenebilir parametre URL’lerini gösterir | Sitemap ve trafik alan sayfalarla karşılaştırın |
| Taranan-sıralanan farkı | Zombi/şişkinlik aday listenizi verir | Fark, otomatik silinecekler değil, triyaj yapılacak adaylardır |
Dizin şişkinliğini bulma ve düzeltme araçları
- Google Search Console — Sayfa dizine ekleme raporu — yetkili dizine eklenmiş sayımını ve dizine eklenmeme nedenlerini gösterir. Buradan başlayın; gerçek ölçüt budur,
site:değil. - GSC — URL Inspection — tek bir URL’nin nasıl tarandığını, oluşturulduğunu ve dizine eklendiğini ve Google’ın hangi canonical’ı seçtiğini kontrol edin.
- GSC — Removals aracı — bir URL’yi sonuçlardan hızla çıkarın (geçicidir, yaklaşık 6 ay sürer; kalıcı bir düzeltmeyle birlikte kullanın).
- Ahrefs Site Audit / Screaming Frog SEO Spider — taramayı simüle ederek ince, yinelenen ve yetim sayfaları, dizine eklenebilir parametre URL’lerini ve yakın kopya kümelerini ortaya çıkarın; sitemap’iniz ve trafik sağlayan sayfalarınızla karşılaştırın.
- Sunucu günlük dosyası analizi — taramanın gerçekte nereye gittiğini görün (Screaming Frog Log File Analyser kullanın veya günlükleri BigQuery’ye / bir günlük platformuna aktarın). (Günlük dosyası analizi bölümüne bakın.)
- Ahrefs Webmaster Tools — doğruladığınız siteler için ücretsiz tarama ve denetim.
- Bing Webmaster Tools — Bing’in dizin kapsamı ve tarama bilgileri.
Vakit ayırmaya değer kaynaklar
Yazdıklarım
- Fasetli Gezinme: Kesin Rehber — dizin şişkinliğinin bir numaralı kaynağı ve kontroller ( “arama değeri” tanımının geldiği yer).
- Canonicalization: Kesin Rehber — ana birleştirme aracı, yaklaşık 40 canonical sinyali ve “never mix noindex and rel=canonical” kuralı.
- Yinelenen İçerik: Neden Olur ve Nasıl Düzeltilir — Mueller’ın “we don’t have a duplicate content penalty” açıklaması da dahil.
- Taranmış – Şu Anda Dizinlenmemiş — klasik şişkinlik parmak izi olan GSC durumu.
- Teknik SEO’ya Başlangıç Rehberi — dizine eklemenin daha geniş çerçevedeki yeri.
Konuşmalarım
- Arama Nasıl Çalışır (SlideShare) — tarama → dizin → sunma akışını anlattığım sunum. (Sürekli geçerli uyarı: “This is my understanding of systems… not going to be 100% complete or accurate.”)
Diğer kaynaklar
- Google’ın Crawling December serisi — Gary Illyes’in fasetli gezinme açıklaması da dahil olmak üzere tarama/dizin konusundaki en yoğun açıklama seti.
- r/TechSEO — tarama ve dizin hata ayıklama topluluğu.
- SEO’da Dizin Şişkinliği: Nedir ve Nasıl Düzeltilir (Search Engine Land) — otomasyon sınırlarını ve şablon düzeyinde CMS noindex’ini kapsayan sağlam bir genel bakış.
- Taranmış – Şu Anda Dizinlenmemiş: Google Kalite Sorununun Bir İşareti mi? (Search Engine Roundtable, Barry Schwartz) — Mueller’ın “Crawled – currently not indexed” durumunu sayfa başına bir hata yerine site genelinde bir kalite sinyali olarak çerçeveleyen haber kapsamı.
- Dizin Şişkinliği (Inflow) — e-ticarete odaklanan fasetli gezinme ve parametre şişkinliği incelemesi; mağaza sahipleri için yararlı bağlam.
- Screaming Frog SEO Spider — Ahrefs Site Audit’in yanında ince, yinelenen ve yetim sayfaları ve dizine eklenebilir parametre URL’lerini denetlemek için en yaygın kullanılan tarayıcı.
Uygulamalı örnekler
1. Fasetli gezinmenin dizine eklenebilir URL’lere dönüşmesi
https://example.com/shoes/
https://example.com/shoes/?color=red
https://example.com/shoes/?color=red&size=9
https://example.com/shoes/?color=red&size=9&sort=price-asc
https://example.com/shoes/?color=red&size=9&sort=price-asc&in-stock=true- Yanlış: CMS’in her kombinasyonu otomatik olarak bağlamasına ve hepsini taranabilir ve dizine eklenebilir bırakmasına izin vermek. Her parametre URL sayısını katlar ve derin kombinasyonların hiçbirinin benzersiz arama talebi yoktur.
- Doğru: Hangi parametrelerin kendi dizine eklenmiş URL’sini hak edecek kadar içeriği değiştirdiğine (genellikle yalnızca
color) ve hangilerinin yalnızca sıralama/filtre gürültüsü (sort,in-stock) olduğuna karar verin. Gürültü parametrelerini/shoes/?color=redadresine canonical’laştırın; canonical’laştırmadan sonra hâlâ tarama trafiği üretiyorlarsa en gürültülü kombinasyonları robots.txt’de engelleyin.
2. noindex + robots.txt tuzağı
# robots.txt
User-agent: *
Disallow: /search/<!-- /search/?q=running+shoes -->
<meta name="robots" content="noindex">- Yanlış: Kemer ve askı gibi görünen ama ters tepen bir yöntemdir. Googlebot robots.txt ile engellendiği için
/search/?q=running+shoesadresini yeniden getirmez venoindexetiketini göremez. URL zaten dizine eklenmişse süresiz olarak dizinde kalabilir, çoğu zaman snippet olmadan. - Doğru: Önce
Disallow: /search/satırını kaldırın;noindexetiketinin işini yapmasına izin verin (Google yeniden tarar, etiketi okur, sayfayı düşürür), URL’nin “Excluded by noindex tag,” durumuna geçtiğini GSC Sayfa dizine ekleme raporunda doğrulayın; bundan sonra o yol için tarama bütçesinden de tasarruf etmek istiyorsanız robots.txt engelini ekleyin.
3. Protokol/ana makine varyantlarından yinelenen içerik; canonical ile düzeltme
http://example.com/guide/
http://www.example.com/guide/
https://example.com/guide/
https://www.example.com/guide/- Yanlış: Dört adresin tamamında aynı içeriği sunmak ve Google’ın istediğini seçmesine izin vermek — bağlantı değeri ve etkileşim sinyalleri dört yöne bölünür.
- Doğru: Tek bir canonical ana makine/protokol birleşimi seçin (örneğin
https://www.example.com/guide/), diğer üçünü ona 301 ile yönlendirin ve yedek sinyal olarak<link rel="canonical" href="https://www.example.com/guide/">ekleyin. Dört varyantın da aynı tanımlı canonical’a çözümlendiğini canonical-checker (/tools/canonical-checker) ile doğrulayın.
4. İnce etiket arşivi sayfalarını noindex yerine birleştirme
Bir yayıncının /tag/seo/, /tag/seo-tips/ ve /tag/technical-seo/ adresleri var — her biri aynı yazıların 2-3 tanesini listeleyen, neredeyse aynı üç arşiv sayfası.
- Yanlış: Üçüne de noindex uygulayıp sağladıkları dahili bağlantı değerini kaybetmek veya hepsini ince yakın kopyalar olarak dizine eklenmiş bırakmak.
- Doğru: Bunları tek bir
/tag/seo/arşivinde birleştirin, diğer ikisine 301 uygulayın ve dahili bağlantıları kalan URL’yi gösterecek şekilde güncelleyin. Bu, sayfaların meşru bağlantı/organizasyon değeri olduğu için “noindex” değil “consolidate” işlemidir — sorun yalnızca bu değerin parçalanmış olmasıdır.
Doğrulama testleri
Her düzeltmenin gerçekten etkili olduğunu doğrulayın — yalnızca yayımladınız diye çalıştığını varsaymayın.
Test: noindex düşük değerli bir URL’yi dizinden çıkardı mı?
- Çalıştırılacak test:
noindexekledikten ve sayfanın robots.txt’de engellenmediğini doğruladıktan sonra (robots-txt-tester,/tools/robots-txt-testerkullanın), URL’nin durumunu GSC → Sayfa dizine ekleme raporunda kontrol edin veya URL Inspection ile örnek kontrol yapın. - Beklenen sonuç: Durum “Excluded by ‘noindex’ tag.” olur.
- Başarısızlık yorumu: Hâlâ “Indexed” veya “Blocked by robots.txt” görünüyorsa sayfa dizinde hapsolmuştur; Google noindex etiketini okuyabilmek için sayfayı tarayamıyordur.
- İzleme aralığı: Google’ın yeniden tarayıp yeniden işlemesi için URL’nin tarama sıklığına bağlı olarak 1-4 hafta.
- Geri alma tetikleyicisi: Sayfa 4+ hafta sonra hâlâ dizine eklenmiş görünüyorsa robots.txt’nin sayfayı engellemediğini doğrulayın; ardından noindex yayılırken geçici bir önlem olarak GSC Removals aracını kullanın.
Test: robots.txt disallow taramayı gerçekten durduruyor mu (dizinlemeyi değil)?
- Çalıştırılacak test:
Disallowkuralını ekleyin, robots-txt-tester (/tools/robots-txt-tester) ile doğru ayrıştırıldığını doğrulayın; ardından engellenen yolda Googlebot isteklerinin devam edip etmediğini log-file-analyzer (/tools/log-file-analyzer) ile sunucu günlüklerinde kontrol edin. - Beklenen sonuç: Günlüklerde engellenen yoldaki Googlebot istekleri sıfıra iner. (URL zaten dizine eklenmişse GSC’de “Indexed, though blocked by robots.txt” olarak görünmeye devam edebilir — bu beklenen bir durumdur, başarısızlık değildir.)
- Başarısızlık yorumu: Tarama isteklerinin sürmesi, kuralın gerçek URL kalıbıyla eşleşmediği anlamına gelir (yazım hatalarını, büyük/küçük harf duyarlılığını veya çakışan bir
Allowkuralını kontrol edin). - İzleme aralığı: robots.txt sözdizimi kontrolü için hemen; tarama davranışının değiştiğini doğrulamak için 1-2 haftalık günlük verisi.
- Geri alma tetikleyicisi: Aynı yol altındaki meşru sayfalar da taranmayı bırakırsa kalıp fazla geniştir — daraltın ve testi tekrarlayın.
Test: rel=canonical dikkate alınıyor mu (geçersiz kılınmıyor mu)?
- Çalıştırılacak test: Yinelenen sayfaya canonical etiketini ekleyin; ardından GSC → Sayfa dizine ekleme raporu → Duplicate, Google chose different canonical than user durumunu kontrol edin veya belirli URL’yi inceleyin. Tanımlanan canonical ile taranan canonical’ı canonical-checker (
/tools/canonical-checker) ile karşılaştırın. - Beklenen sonuç: Kopyanın “Google-selected canonical” değeri, belirttiğiniz canonical ile eşleşir.
- Başarısızlık yorumu: Google farklı bir canonical seçiyorsa sayfalar ipucuna güvenmesi için yeterince benzer olmayabilir veya rakip bir sinyal vardır (dahili bağlantılar, sitemap girdileri ya da hâlâ kopyaya işaret eden geri bağlantılar).
- İzleme aralığı: Değişiklikten sonra canonical seçiminin kararlı hâle gelmesi için 2-4 hafta.
- Geri alma tetikleyicisi: Google bir ay sonra da geçersiz kılmaya devam ederse sinyali güçlendirin (canonical yerine 301 kullanın, dahili bağlantıları tercih edilen URL’ye güncelleyin, kopyayı sitemap’ten çıkarın).
Test: birleştirme taranan-sıralanan farkını azalttı mı?
- Çalıştırılacak test: İnce sayfaları birleştirmeden önce dizine eklenebilir/taranan URL’leri ( site-audit-lite,
/tools/site-audit-liteveya tam bir tarayıcı aracılığıyla) gerçekten sıralanan ya da organik trafik alan sayılarla karşılaştırın. Birleştirmeden sonra aynı sayımı yeniden yapın. - Beklenen sonuç: Fark daralır — sıralanan sayfalara kıyasla daha az taranmış/dizine eklenmiş URL ve GSC’deki “Crawled - currently not indexed” kümesinde küçülme görülür.
- Başarısızlık yorumu: Fark değişmiyorsa birleştirilen sayfalar yönlendirilmemiş (hâlâ ince kopyalar olarak taranabilir) olabilir veya siz temizledikçe yeni şişkinlik üretiliyor olabilir.
- İzleme aralığı: 4-8 hafta — bu anlık değil, daha yavaş ve birikimli bir sinyaldir.
- Geri alma tetikleyicisi: Burada gerçek bir geri alma yoktur; fark daralmak yerine genişlerse birleştirmeyi geri çevirmek yerine yeni bir şişkinlik kaynağı (şablon değişikliği, yeni parametre veya CMS güncellemesi) için yeniden denetim yapın.
Dizin şişkinliği zaman içinde nasıl ölçülür?
Bunlar konu için düzenli izlenecek KPI’lardır — yalnızca tek seferlik temizlik sırasında değil, tekrarlanan bir düzenle takip edin.
Taranan-sıralanan farkı
- Ne anlatır: Dizine eklenmiş URL’lerin ne kadarının gerçekten organik trafik veya sıralama kazandığını, ne kadarının atıl ağırlık olarak kaldığını gösterir.
- Nasıl çıkarılır: Dizine eklenebilir/taranan URL’leri (site crawler veya site-audit-lite,
/tools/site-audit-lite) sayın ve aynı dönemde Google Search Console Performans raporunda organik tıklama veya gösterim alan sayfalarla karşılaştırın. - Benchmark / gerçekçi aralık: Site türüne ve yaşına büyük ölçüde bağlıdır — evrensel bir sağlıklı oran yoktur. İlk ölçümde kendi başlangıç çizginizi belirleyin, ardından trendi izleyin: belirli bir oran değil, zaman içinde genişleyen fark harekete geçmeniz gereken sinyaldir.
- Sıklık: Üç ayda bir veya büyük bir şablon/CMS değişikliğinden sonra.
”Crawled - currently not indexed” sayısı (GSC)
- Ne anlatır: Google’ın incelediği ancak dizine eklememeye karar verdiği sayfa sayısını gösterir — Mueller’ın site genelinde kalite sinyali olarak çerçevelemesine göre klasik şişkinlik parmak izidir.
- Nasıl çıkarılır: GSC → Sayfa dizine ekleme raporu içindeki “Why pages aren’t indexed” tablosunu kullanın.
- Benchmark / gerçekçi aralık: Dürüstçe söylenebilecek evrensel bir sayı yoktur — binlerce ince varyantı olan şablon güdümlü bir site, küçük ve özenle seçilmiş bir siteden doğal olarak daha yüksek değer gösterir. Bunu kendi toplam URL sayınızla karşılaştırın ve mutlak bir hedef yerine her düzeltmeden sonraki trendi izleyin.
- Sıklık: Aylık veya noindex/canonical kullanıma alındıktan hemen sonra küçüldüğünü doğrulamak için.
Yinelenen durumundaki URL sayısı (GSC)
- Ne anlatır: Google’ın yinelenen olarak değerlendirdiği dizine eklenmiş URL sayısını gösterir — ya “kullanıcı tarafından seçilmiş canonical olmadan” ya da “Google kullanıcıdan farklı bir canonical seçti” durumundadır.
- Nasıl çıkarılır: GSC → Sayfa dizine ekleme raporunu iki yinelenen-durum satırına göre filtreleyin.
- Benchmark / gerçekçi aralık: Sitenin ne kadar meşru parametre/varyant URL yapısına sahip olduğuna bağlıdır. Canonical’laştırma hamlesinden sonra sayının yükselmesi sinyalin dikkate alınmadığı, düşmesi ise çalıştığı anlamına gelir.
- Sıklık: Aylık.
Boşa giden tarama payı (günlük dosyalarından)
- Ne anlatır: Googlebot’un gerçek tarama isteklerinin yüzde kaçının gerçek içeriğiniz yerine düşük değerli URL kalıplarına (parametreler, fasetler, dahili arama, akış sayfaları) gittiğini gösterir.
- Nasıl çıkarılır: URL kalıbına göre bölümlendirilmiş bir günlük analizi hattı veya log-file-analyzer (
/tools/log-file-analyzer) kullanın. - Benchmark / gerçekçi aralık: Sabit bir hedef yoktur — site mimarisine bağlıdır. İlk ölçümü başlangıç çizginiz kabul edin ve noindex/robots.txt/birleştirme düzeltmelerini uyguladıktan sonra boşa giden payın küçülüp küçülmediğini izleyin.
- Sıklık: Büyük/şablon güdümlü sitelerde aylık; diğerlerinde üç ayda bir.
Quiz
Beş kısa soruyla dizin şişkinliği çerçevesinin yerleşip yerleşmediğini kontrol edin.
Değişiklik günlüğü
21 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
8 Ağu 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
-
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.
16 Tem 2026 tarihinde güncellendi.
Editoryal özet ve kaydedilen değişiklik ayrıntıları.Değişiklik ayrıntıları
- Advanced
Ayrıntılı değişiklik notları şu anda İngilizce olarak mevcut.
Tam karşılaştırma kullanılamıyor — bu sürüm için önceki anlık görüntü arşivlenmemiş.