Tarama

Arama motorlarının web'i nasıl keşfedip indirdiği: Googlebot ve Bingbot, URL keşfi, tarama planlayıcısı, oluşturma ve taramanın dizine ekleme ile sıralamadan farkı. Taramayla ilgili her şeyin merkezi.

İlk yayın tarihi: 22 Haz 2026 · Son güncelleme: 9 Ağu 2026 · Advanced
Diller
Bu sayfada 1 kanıt sinyali

Tarama, aramanın ilk aşamasıdır (tarama → dizine ekleme → sunma): Googlebot ve Bingbot gibi botlar, sayfaların oluşturulabilmesi, dizine eklenebilmesi ve sıralanabilmesi için URL'leri keşfeder ve sayfaları indirir. Arama sonuçlarında görünmek için gereklidir ancak bir sıralama faktörü değildir; ayrıca hem dizine eklemeden hem de oluşturmadan farklıdır. Çoğu sitenin tarama bütçesini yönetmesi gerekmez; tarama aksadığında gerçekte ne olduğunu sunucu günlükleri gösterir. Bu merkez, sürecin tamamını açıklar ve sizi ayrıntılı incelemelere yönlendirir.

TL;DR — Tarama, aramanın üç aşamasından ilkidir (tarama → dizine ekleme → sunma). Botlar URL’leri pull (bağlantılar + site haritaları) ve push (IndexNow, Indexing API) yöntemleriyle keşfeder; ardından sunucunuzun sağlığına göre hızını düşüren algoritmik bir programa göre getirir. JavaScript’in oluşturulması ayrı bir adımdır. Tarama, sıralamaya girmek için gereklidir ancak kendi başına bir sıralama sinyali değildir ve dizine eklemeden farklıdır; robots ile engellenmiş bir sayfa yine de dizine eklenebilir. Çoğu sitenin tarama bütçesini yönetmesi gerekmez; gerçekte ne olduğunu günlükler gösterir.

Tarama, üç aşamanın ilkidir

Crawling is stage one of three. A page must clear each stage before it can rank. Kaynak: /technical-seo/how-search-works/crawling/

Three stages run left to right. Crawl: a bot discovers a URL and downloads the page. Index: the engine processes the page and stores eligible information. Serve or rank: the best indexed matches are ordered for a query. The Crawl stage is highlighted, and a note says not every page advances through every stage.

© Patrick Stox LLC · CC BY 4.0 ·

Google süreç hakkında açık konuşur: “Google Search works in three stages, and not all pages make it through each stage” — tarama, dizine ekleme ve sunma. “not all pages make it” bölümü, teknik SEO’daki bütün meselenin özüdür. Bir sayfa taranıp dizine eklenmeyebilir veya dizine eklenip hiçbir sorgu için sunulmayabilir. Bu aşamaları zihninizde ayrı tutmak, buradaki en yararlı düşünce modelidir. Evidence for this claim Google describes Search as three stages: crawling, indexing, and serving results. Scope: Google Search's documented processing model; it does not guarantee that a page reaches every stage. Confidence: high · Verified: Google Search Central: In-depth guide to how Google Search works

Taramayı gerçekte kim yapar?

“Googlebot” tek bir programmış gibi görünür. Öyle değildir. How Search Works sunumumda onu; masaüstü, mobil, görsel, haber, video ve reklam gibi uzmanlaşmış tarayıcılar ailesini çalıştıran 1 000+ sistem olarak tanımlıyorum. İsteklerin çoğu Mountain View kaynaklıdır. Hepsi aynı tarama bütçesi havuzundan yararlanır; bu nedenle kontrolden çıkan bir görsel veya parametre taraması, gerçek içeriğinizin taranmasına ayrılan kaynakları tüketebilir.

Üstelik artık yalnızca arama motorlarından söz etmiyoruz. Cloudflare Radar verileri üzerine yaptığım analizde (Meet the New Web Crawlers), hâlâ en çok arama motoru botları tarama yapıyor; ancak AI botları kesin biçimde ikinci sırada ve önümüzdeki birkaç yıl içinde onları geçme yolunda. Günlüklerinizi okuyorsanız oyuncu kadrosunun değiştiğini göreceksiniz.

Tarayıcılar URL’leri nasıl keşfeder?

Discovery is both pull and push — Google calls the whole thing “URL discovery.” Kaynak: /technical-seo/how-search-works/crawling/

Two discovery routes feed one crawl queue. Pull discovery includes following links and sitemaps. Push discovery includes IndexNow for Bing, Yandex, and other participating engines but not Google for general pages; the Google Indexing API for JobPosting and BroadcastEvent pages; and change notifications through sitemap lastmod, RSS, and WebSub.

© Patrick Stox LLC · CC BY 4.0 ·

Keşif hem pull hem de push yöntemiyle gerçekleşir:

  • Pull — bağlantılar. Google: “Other pages are discovered when Google extracts a link from a known page to a new page.” Bu nedenle hiçbir bağlantının yönelmediği yetim sayfaların bulunması zordur.
  • Pull — site haritaları. “Still other pages are discovered when you submit a list of pages (a sitemap) for Google to crawl.”
  • Push — değişiklik bildirimleri. Yeniden taranmayı beklemek yerine motora bir şeyin değiştiğini bildirirsiniz: IndexNow (Bing, Yandex ve diğerleri; Google bunu genel sayfalar için kullanmaz) ve Google’ın Indexing API’si (resmî olarak yalnızca JobPosting ve BroadcastEvent sayfaları için). Site haritalarındaki lastmod, RSS ve WebSub da push seçeneklerini tamamlar.

Google bu sürecin tamamına “URL discovery.” adını verir.

Tarayıcılar sayfaları nasıl getirir?

  • Program algoritmiktir. “Googlebot uses an algorithmic process to determine which sites to crawl, how often, and how many pages to fetch from each site.” Onu etkileyebilirsiniz; ancak siz belirleyemezsiniz.
  • Tarama ölçülüdür. Botlar sitenizi çökertmemek için kendi hızlarını sınırlar: “they try not to crawl the site too fast to avoid overloading it… HTTP 500 errors mean ‘slow down.’” Taramayı geçici olarak yavaşlatmanın arkasındaki mekanizma budur: 503/429 döndürdüğünüzde Googlebot bir veya iki günlüğüne geri çekilir; sonsuza kadar değil.
  • Bir bayt sınırı vardır. Google’ın Mart 2026 tarihli Inside Googlebot güncellemesine göre Googlebot, URL başına yaklaşık 2 MB getirir (eski 15 MB sınırından daha düşük); PDF’ler için 64 MB’a kadar izin verilir. Sınır aşılırsa getirme işlemi reddedilmez, kesilir; yalnızca indirilen bölüm dizine eklenmek üzere aktarılır. Kritik içeriğiniz 2 MB’lık şişkinliğin altında kalıyorsa bu önemlidir.
  • Önbellekleme yeniden tarama maliyetini azaltır. Google’ın tarayıcıları, değişmeyen kaynakların her defasında yeniden getirilmemesi için koşullu istekler ve önbellekleme kullanır. Google, oluşturma kaynakları için kesin bir önbellek süresi yayımlamaz. Bu nedenle kod değişiklikleri için sabit bir yenileme aralığı varsaymayın; anında yansıma değil, bir miktar gecikme bekleyin. Evidence for this claim Googlebot algorithmically determines which sites to crawl, how often to crawl them, and how many pages to fetch. Scope: web Confidence: high · Verified: In-Depth Guide to How Google Search Works

Oluşturma, tarama değildir

Bu ayrım insanların sürekli kafasını karıştırır. “During the crawl, Google renders the page and runs any JavaScript it finds using a recent version of Chrome.” Oluşturma, HTML’yi getirmekten farklı bir adımdır. Oluşturucu (Web Rendering Service) durumsuzdur; yüklemeler arasında depolama alanı ve çerezler temizlenir, izin istemleri reddedilir ve service worker’lar kabul edilmez. İçeriğiniz yalnızca bir tıklamadan veya gerçek bir <a href> bağlantısı olmayan JS tabanlı gezinmeden sonra görünüyorsa keşif ve oluşturma sorunları bekleyin. (Konunun tamamı için JavaScript SEO makalesine bakın.)

Tarama, dizine ekleme ve sıralama

Bu sayfadaki en önemli ayrımlar şunlardır:

  • Tarama ≠ sıralama. Sonuçlarda yer almak için tarama gereklidir; ancak tarama bir sıralama sinyali değildir. Daha yüksek tarama hızı konumlarınızı yükseltmez. Tarama bütçesi yalnızca bir verimlilik meselesidir.
  • Tarama ≠ dizine ekleme. robots.txt ile engellediğiniz bir sayfa, başka sayfalar ona bağlantı veriyorsa yine de dizine eklenebilir. Google yalnızca içeriği veya sayfaya koyduğunuz herhangi bir noindex etiketini göremez. Indexed, though blocked by robots.txt makalesinde belirttiğim gibi: “crawling and indexing are two different things.” Bir sayfayı gerçekten kaldırmak için taramaya izin verip noindex ekleyin; sayfayı engellemeyin.

Engelleme tarafını doğrudan test ettim. The Story of Blocking 2 High-Ranking Pages With Robots.txt makalesinde sıralamaya giren iki sayfamızı engelledim. Sonuç şuydu: “We lost a position here or there and all of the featured snippets for the pages… I expected a lot more impact, but the world didn’t end.” Çıkardığım sonuç hâlâ geçerli: “Don’t block pages you want indexed. It hurts. Not as bad as you might think it does — but it still hurts.”

Tarama nasıl denetlenir?

  • robots.txt, dizine eklemeyi değil taramayı denetler. “A robots.txt file tells search engine crawlers which URLs the crawler can access on your site.” Bunu, botları düşük değerli alanlardan uzak tutmak için kullanın; dizinden çıkarma aracı olarak değil.
  • Site mimarisi ve iç bağlantılar, sayfaların ne kadar derinde bulunduğunu ve keşfedilip keşfedilmeyeceğini belirler (bkz. tarama derinliği).
  • Tarama hızı denetimleri. Google, Search Console’daki manuel tarama hızı kaydırıcısını 2024’ün başında kullanımdan kaldırdı. Artık sunucunuzun yanıtlarına ve daha düşük bir otomatik alt sınıra dayanıyor. Bing, Bing Webmaster Tools’ta hâlâ manuel bir Crawl Control tablosu sunuyor (bkz. tarama hızı). Evidence for this claim robots.txt controls crawler access and is not a reliable way to keep a URL out of Google. Scope: Google Search behavior for URLs blocked by robots.txt; blocked URLs may still be indexed when discovered elsewhere. Confidence: high · Verified: Google Search Central: Introduction to robots.txt

Tarama verimliliği ve tarama bütçesi

Her iki motor da taramayı bir verimlilik meselesi olarak ele alır. Gary Illyes, Google tarafını tarama hızı sınırı + tarama talebi (popülerlik ve güncelliğini yitirme) şeklinde açıklar. Bing’den Fabrice Canel ise bunu “crawl efficiency north star … to crawl a URL only when the content has been added … updated.” diye tanımlar.

Rahatlatıcı kısmı şu: Çoğu sitenin bunu dert etmesi gerekmez. Google bunu açıkça söyler: Sitenizde hızla değişen çok sayıda sayfa yoksa veya sayfalarınız yayımlandığı gün taranıyorsa “you don’t need to read this guide.” Konu, haftalık değişen 1M+ veya günlük değişen 10k+ sayfa civarında önem kazanmaya başlar (bkz. tarama bütçesi ve tarama sıklığı). Evidence for this claim Sites without many rapidly changing pages, or whose new pages are crawled the day they are published, generally do not need crawl-budget management. Scope: large websites Confidence: high · Verified: Optimize your crawl budget

Tarama aksadığında bunu nasıl anlarsınız?

Bir düzeltmeye girişmeden önce gerçekte hangi aşamanın bozuk olduğunu belirleyin; belirtiler ve çözümler her aşamada farklıdır:

  • Hiç keşfedilmemiş mi? Sayfaya hiçbir bağlantı yönelmiyordur ve sayfa site haritanızda yoktur. İç bağlantıları ve site haritası kapsamını düzeltin; bkz. tarama derinliği ve tarama sıklığı.

  • Keşfedilmiş ama hiç getirilmemiş mi? Sunucu hataları, zaman aşımları veya robots.txt engeli botları geri çeviriyordur. GSC Tarama İstatistikleri’ni ve günlüklerinizi kontrol edin; bkz. tarama bütçesi ve tarama hızı.

  • Getirilmiş ama yanlış oluşturulmuş mu? İçerik, Googlebot’un yapmayacağı bir tıklamaya veya yalnızca JS ile çalışan gezinmeye bağlıdır ya da WRS zaman aşımına uğruyordur. Oluşturmaya özgü hata türleri için JavaScript SEO’ya bakın.

  • Getirilmiş ve oluşturulmuş ama hâlâ dizine eklenmemiş mi? Bu, dizinin verdiği ayrı bir karardır. Bunu tarama sorunu olarak ele almak yerine Dizine Ekleme merkezine bakın.

  • Günlük dosyası analizi temel gerçektir. Sunucu günlükleriniz, botların tam olarak hangi URL’lere eriştiğini, bunu ne sıklıkta yaptığını ve hangi durum kodlarını aldığını gösterir. Boşa harcanan taramayı saptamanın ve botların hiç ulaşmadığı sayfaları bulmanın en iyi yoludur (bkz. günlük dosyası analizi).

  • Örümcek tuzakları — takvimler, fasetli gezinme, oturum kimlikleri veya göreli bağlantı patlamalarından doğan sonsuz URL alanları — tarama bütçenizi gereksiz URL’lerde sessizce tüketir (bkz. örümcek tuzakları).

Sonraki adım: tarama konu kümesi

Bu merkez bir haritadır. Aşağıdaki her konu kendi başına ayrıntılı bir incelemedir:

Tarama verimliliği — ne kadar ve ne sıklıkta?

  • Tarama bütçesi — nedir (kapasite + talep), neler bütçeyi boşa harcar ve gerçekte kimlerin önemsemesi gerekir?
  • Tarama hızı — botlar ne kadar hızlı getirir, GSC hız kaydırıcısı neden kaldırıldı ve günümüzde tarama nasıl hızlandırılır veya yavaşlatılır?
  • Tarama sıklığı — Google’ın bir sayfayı daha erken yeniden taramasını neler sağlar (popülerlik, güncelliğini yitirme, doğru lastmod) ve neler sağlamaz?
  • Tarama derinliği — tıklama derinliği ile tarama geçiş derinliği arasındaki fark ve önemli sayfaların neden ana sayfaya yakın olması gerektiği.

Tarayıcıları tanıyın — sayfalarınızı gerçekte kim getiriyor?

  • Tarayıcı — web tarayıcısı (bot, örümcek) nedir ve tümünün yürüttüğü getir → ayrıştır → izle döngüsü nasıl çalışır?
  • User agent — botun kendisini tanıttığı user-agent dizesi ve robots.txt belirteci nedir; neden yalnızca bu dizeye güvenemezsiniz?
  • Googlebot — Google’ın tarayıcısı: Smartphone ve Desktop, oluşturma ve doğrulama yöntemleri.
  • Bingbot — Microsoft’un tarayıcısı, farklılıkları ve Bing dışında beslediği yüzeyler.
  • AI tarayıcıları — AI şirketlerinin botları (eğitim, AI araması ve kullanıcı tarafından tetiklenen getiriciler) ve bunları denetleme yöntemleri.

Tarama sorunlarını teşhis etme

  • Günlük dosyası analizi — gerçek botları doğrulama ve neleri taradıklarını okuma.
  • Örümcek tuzakları (tarayıcı tuzakları) — sonsuz URL üreten kalıplar ve bunları düzeltme yöntemleri.

Yukarıdaki her konu, bu merkezin altında yer alan ayrı bir ayrıntılı incelemedir; kenar çubuğunda da bulunurlar.

Giden bağlantılarınızı nitelemek, taramayla kesişen ilgili bir sayfa içi denetimdir. Bunlar Google’a bir bağlantıyı tarayıp taramamasını değil, bağlantıya nasıl davranacağını bildirir: nofollow (başlangıçtaki genel seçenek, artık bir ipucu) ile ücretli/reklam bağlantıları ve kullanıcılar tarafından oluşturulan bağlantılar için rel=sponsored ve rel=ugc. Üçü de sayfa içi meta etiketleri kümesinde yer alır.

En başta bulunmak, ilişkili ancak ayrı bir aşamadır. Arama motorlarının URL’lerinizi nasıl keşfettiği — iç bağlantılar, site haritaları (XML, site haritası dizini, görsel ve video) ve IndexNow ile Google Indexing API push protokolleri (her birinin gerçekte ne işe yaradığı ve Google’ın neden IndexNow kullanmadığı) — artık kendi Keşif merkezinde yer alıyor. Daha geniş konu için How Search Works sayfasına bakın.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.