Googlebot: Google'ın Tarayıcısı

Googlebot’un gerçekte ne olduğu — Smartphone ve Desktop, evergreen Chromium oluşturması, user-agent dizeleri, IP aralığı doğrulaması, bayt sınırları ve tarama ile sıralama arasındaki fark.

İlk yayın tarihi: 24 Haz 2026 · Son güncelleme: 8 Ağu 2026 · Advanced
Diller
Bu sayfada 1 kanıt sinyali

Googlebot, Google’ın sayfaları getirip dizine ekleyebilmesi ve sıralayabilmesi için kullandığı web tarayıcısıdır. Aynı robots.txt belirtecini paylaşan iki çeşidi vardır: birincil olan Googlebot Smartphone (mobile-first indexing altında) ve Googlebot Desktop. Evergreen Chromium çalıştırır ve JavaScript’i ayrı, daha sonraki bir kuyrukta oluşturur (tarama ≠ oluşturma). Tarama sıralama faktörü değildir; Googlebot’u robots.txt’de engellemek dizinden çıkarmakla aynı şey değildir — engellenen bir URL yalnızca URL olarak yine de dizine eklenebilir. User-agent kolayca taklit edildiğinden ters + ileri DNS veya Google’ın yayımlanmış IP aralıklarıyla doğrulayın. “Googlebot”, gerçekte çok daha büyük bir tarama platformunun Google Search’e bakan dilimidir.

TL;DR — Googlebot, Smartphone (birincil, mobile-first) ve Desktop olarak ayrılan Google Search tarayıcısıdır; ikisi de robots.txt içinde tek bir Googlebot belirtecini paylaşır — ayrı hedefleyemezsiniz. Evergreen Chromium çalıştırır ve JavaScript’i daha sonra ayrı bir kuyrukta oluşturur (tarama ≠ oluşturma). Sıralanmak için taranmak gerekir ancak tarama sıralama sinyali değildir; robotlar tarafından engellenen bir URL yine yalnızca URL olarak dizine eklenebilir. Ters + ileri DNS ile Google alan adına veya Google’ın yayımlanmış IP aralıklarına göre doğrulayın — user-agent kolayca taklit edilir. Ayrıca “Googlebot”, çok daha büyük bir tarama platformunun Search’e bakan dilimidir.

Evidence for this claim Googlebot is Google's crawler, with smartphone and desktop crawler types that share the same product token. Scope: Current Googlebot crawler and user-agent documentation. Confidence: high · Verified: Google Search Central: Googlebot Evidence for this claim A claimed Google crawler can be verified using reverse and forward DNS or Google's published IP ranges. Scope: Google's current crawler-verification methods. Confidence: high · Verified: Google Search Central: Verify Googlebot

Googlebot gerçekte nedir?

Google ad konusunda nettir: “Googlebot is the generic name for two types of web crawlers used by Google Search.” Bu iki tür Googlebot Smartphone (“mobil cihazdaki kullanıcıyı taklit eden mobil tarayıcı”) ve Googlebot Desktop (“masaüstündeki kullanıcıyı taklit eden masaüstü tarayıcısı”)dır.

Tek bir makinede çalışan tek bir küçük program değildir. Googlebot rehberimde açıkladığım gibi “Googlebot runs on thousands of machines,” ve “they determine how fast and what to crawl on websites,”; dünya genelindeki veri merkezlerine dağılmıştır ancak esas olarak ABD IP adreslerinden çıkış yapar. Keşif çoğunlukla bağlantılarla gerçekleşir — Google yeni URL’leri “öncelikle daha önce taranan sayfalara gömülü bağlantılardan” bulur — ve buna site haritaları eklenir. (Eksiksiz keşif ve planlama resmi için crawling merkezine bakın.)

Smartphone ve Desktop — neden “smartphone-first”?

Mobile-first indexing altında akıllı telefon tarayıcısı birincildir. Google şöyle der: “For most sites Google Search primarily indexes the mobile version of the content. As such the majority of Googlebot crawl requests will be made using the mobile crawler, and a minority using the desktop crawler.” Mobile-first indexing Ekim 2023’ten beri tüm siteler için tamamlanmıştır; pratik kural şudur: içerik akıllı telefon aracısında görünmüyorsa dizine eklenmez. İçeriğinizi, yapılandırılmış verinizi, metadatanızı ve robot etiketlerinizi mobil ve masaüstünde eşleştirin.

robots.txt açığı şudur: “Both crawler types obey the same product token (user agent token) in robots.txt, and so you cannot selectively target either Googlebot Smartphone or Googlebot Desktop using robots.txt.” Farklılaştırmanın tek yolu kendi sunucu tarafı mantığınızda HTTP user-agent istek başlığını okumaktır. (Bu başlık biçiminin mekanikleri için mobile-first indexing ve user-agent sayfalarına bakın.)

User-agent dizeleri

Her ikisi için robots.txt ürün belirteci yalnızca Googlebot’tur. Tam UA dizeleri farklıdır:

Googlebot Desktop:

Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; Googlebot/2.1; +http://www.google.com/bot.html) Chrome/W.X.Y.Z Safari/537.36

Googlebot Smartphone:

Mozilla/5.0 (Linux; Android 6.0.1; Nexus 5X Build/MMB29P) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/W.X.Y.Z Mobile Safari/537.36 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)

W.X.Y.Z, Googlebot’un evergreen Chromium’u güncellendikçe değişen güncel Chrome sürümü için bir yer tutucudur. Yine de dizeye tek başına güvenmeyin — kolayca taklit edilir (doğrulama bölümüne bakın).

Evergreen Chromium ve oluşturma kuyruğu

İnsanların en çok karıştırdığı ayrım budur: tarama ve oluşturma ayrı adımlardır. Googlebot “an evergreen version of Chromium” çalıştırır ve Mayıs 2019’da eski Chrome 41’den güncel kararlı sürüme geçerek evergreen olmuştur; bu nedenle ES6+, IntersectionObserver, Web Components ve modern CSS’yi artık işler. Ancak HTML’yi getirir getirmez JavaScript’inizi çalıştırmaz.

Google şöyle der: “Googlebot queues all pages with a 200 HTTP status code for rendering, unless a robots meta tag or header tells Google not to index the page. The page may stay on this queue for a few seconds, but it can take longer than that. Once Google’s resources allow, a headless Chromium renders the page and executes the JavaScript.” Oluşturma hizmeti (WRS) modern bir tarayıcı gibi davranır ancak bilinmesi gereken tuhaflıkları vardır: etkili olarak durumsuzdur — local/session storage ve çerezler sayfa yüklemeleri arasında temizlenir — bant genişliğinden tasarruf için resim veya video getirmez, agresif önbellekleme yapar (önbellek başlıklarınızı görmezden gelebilir) ve WebSockets veya WebRTC’yi desteklemez. İçeriğiniz yalnızca tıklamadan veya gerçek bir <a href> bağlantısı olmayan JS güdümlü gezinmeden sonra görünüyorsa oluşturma sorunu bekleyin. (Ayrıntılar rendering kardeş sayfasındadır.)

Bayt sınırları

Googlebot URL başına sınırsız indirme yapmaz. Google’ın Mart 2026 tarihli Inside Googlebot güncellemesi itibarıyla, herhangi bir tek URL’nin ilk yaklaşık 2 MB’ını (HTTP başlığı dahil) ve bir PDF’in 64 MB’a kadarını getirir. Rakam değişebilir — Google’ın kendi çerçevesi şöyledir: “this limit is not set in stone and may change over time as the web evolves and HTML pages grow in size,”; önceki belgelerde 15 MB yazıyordu, bu Search’ün sayısı değil daha geniş altyapı varsayılanıydı. Pratik sonuç değişmez: kesimden sonrası getirilmez — “to Googlebot, they simply don’t exist.” Kritik içerik ve işaretlemeyi şişkinliğin üstünde tutun.

Çalışan hata örneği: canonical var ama Googlebot hiç alamıyor

2,4 MB HTML döndüren bir ürün şablonu düşünün. Uygulama, belgenin üst kısmına dev bir ürün durumu nesnesi ve öneri yükü serileştiriyor; canonical, ürün açıklaması, yapılandırılmış veri ve ilgili ürün bağlantıları yaklaşık 2.180.000. bayta kadar görünmüyor. Tarayıcı tüm yanıtı indirir, bu nedenle View Source doğru görünür. Googlebot Search belgelenen yaklaşık 2 MB sınırında durur; bu sonraki sinyaller getirilen kaynakta yoktur.

Yanıtı yalnızca oluşturulmuş DOM’a göre değil, bayt sırasına göre teşhis edin:

curl -sS -D response-headers.txt -o page.html https://example.com/product
wc -c response-headers.txt page.html
LC_ALL=C grep -abo 'rel="canonical"' page.html
LC_ALL=C grep -abo 'application/ld+json' page.html

Yerel bayt sayıları, teslimat aracıları ve yanıt işleme farklı olabileceği için yaklaşık değerlerdir; ancak yararlı ilk soruyu yanıtlar: kritik sinyaller yeterince erken mi, yoksa sınıra yakın ya da sınırın ötesinde mi? Çözüm, aşırı büyük satır içi verileri kaldırıp ertelemek ve temel metadatayı, ana içeriği ve taranabilir bağlantıları erken üretmektir — aynı şişkinliği taşıyıp kesimin değişmesini ummak değil.

Googlebot nasıl kibarca getirir?

  • Tarama hızı algoritmik ve kendini sınırlar. “For most sites, Googlebot shouldn’t access your site more than once every few seconds on average.” Sunucunuzun sağlığına göre hızlanır veya geri çekilir.
  • Durum kodları kaldıraçtır. 429, 500 veya 503 döndürmek Googlebot’a yavaşlamasını söyler — ancak bu yalnızca hata veren URL’leri değil tüm hostname’i etkiler ve sürdürülen hatalar sayfaları dizinden düşürmeye başlamadan önce yalnızca bir veya iki gün işe yarar. John Mueller şöyle der: “I’d only expect the crawl rate to react that quickly if they were returning 429 / 500 / 503 / timeouts,” ve “404s are generally fine & once discovered, Googlebot will retry them anyway.”
  • crawl-delay yok sayılır. Google, standart olmayan crawl-delay robots.txt yönergesini hiç işlemez. (Bing buna uyar — gerçek Googlebot/Bingbot ayrımlarından biri.)
  • Tarama, düz bir kotayı değil tarama talebini izler — kapasite (sunucunuzun kaldırabileceği) ve talep (popülerlik ve güncellik). Çoğu site için bu sorun değildir; yalnızca gerçek ölçekte etkili olur. Tam anlatım crawl budget sayfasındadır.

Gerçekten Googlebot olduğunu doğrulamak

User-agent başlığı “often spoofed by other crawlers” olduğundan tek başına hiçbir şeyi kanıtlamaz. Google’ın tarayıcıları kendilerini üç şekilde tanıtır: user-agent başlığı, kaynak IP ve bu IP’nin ters DNS hostname’i. İki gerçek doğrulama yöntemi vardır:

  1. Manuel (tek seferlik). Kaynak IP’yi ters DNS ile çözümleyin; googlebot.com, google.com veya googleusercontent.com ile biten bir hostname döndüğünü doğrulayın (maske crawl-***-***-***-***.googlebot.com gibi görünür); ardından hostname’i ileri DNS ile çözümleyin ve özgün IP’yi döndürdüğünü doğrulayın.
  2. Otomatik (ölçekte). IP’yi Google’ın yayımladığı CIDR aralıklarıyla eşleştirin. Google bunları eski tek googlebot.json dosyasından tarayıcı kategorisine göre birkaç JSON dosyasına ayırdı — Googlebot dosyası https://www.gstatic.com/ipranges/common-crawlers.json’dur (eski googlebot.json URL’si hâlâ aynı veriye yönlendirir).

İkisi de Scripts sekmesinde, macOS/Linux ve Windows için bulunur. Neden uğraşmalı? Çok sayıda trafik Googlebot gibi görünür; bu nedenle “Googlebot’u gösteren” günlükler büyük ölçüde taklitçilerden oluşabilir — güvenmeden önce doğrulayın.

Googlebot bir filo içindeki tek bottur

“Googlebot” gerçekten de biraz yanlış adlandırmadır. Gary Illyes, Mart 2026: “I mean, calling it Googlebot, that’s a misnomer,” ve “Googlebot is not our crawler infrastructure.” Altyapı, kendi ifadesiyle “software as a service, if you like. SaaS” — birçok Google ürününün yararlandığı ortak bir platformdur. Günlüklerinizde gördüğünüz şey onun Search dilimidir: “When you see Googlebot in your server logs, you are just looking at Google Search.” Ayrıca çoğu belgelenemeyecek kadar küçük “dozens, if not hundreds of different crawlers” bulunduğunu söyler.

Googlebot’un yanında gerçekten karşılaşacağınız adlandırılmış botlar arasında Googlebot’un dizelerini/belirteçlerini paylaşan Googlebot-Image, Googlebot-Video ve Googlebot-News, Storebot-Google ve URL Inspection ile Rich Results araçlarını çalıştıran Google-InspectionTool bulunur. İkisi alışılmadık davranır: AdsBot, genel * robots.txt kuralını yok sayar (Disallow: / altında User-agent: * olsa bile onu durdurmaz) ve Google-Safety, robots.txt’yi tamamen yok sayar. AI ile ilgili tarayıcılar — Gemini eğitimini yöneten Google-Extended (sıralama sinyali değildir) ve Googlebot’tan boşaltılan Ar-Ge taramalarını yapan GoogleOther — da vardır; ancak AI crawlers kardeş sayfası bunları ayrıntılı ele aldığı için burada tekrar etmeyeceğim.

Googlebot nasıl kontrol edilir?

Üç kontrol, üç farklı etki:

  • robots.txt taramayı durdurur, dizine eklemeyi değil. Düşük değerli URL alanlarında botları dışarıda tutmak için kullanın — asla dizinden çıkarma aracı olarak değil.
  • noindex dizine eklemeyi durdurur — ancak etiketi ilk etapta görebilmesi için Googlebot’un sayfayı taramasına izin verilmelidir.
  • Parola koruması erişimi tamamen engeller.

Bu bizi en yanlış anlaşılan Googlebot gerçeğine getirir: “There’s a difference between crawling and indexing; blocking Googlebot from crawling a page doesn’t prevent the URL of the page from appearing in search results.” Robotlarca engellenen bir URL, bir şey ona bağlantı veriyorsa yalnızca URL olarak yine de dizine eklenebilir. Bir sayfayı gerçekten kaldırmak için taramaya izin verin ve noindex ekleyin. Bunu Indexed, though blocked by robots.txt yazısında ayrıntılı anlattım.

Googlebot’un içinde yaşadığı daha geniş işlem hattı — URL keşfi, tarama zamanlayıcısı, oluşturma ve tarama-dizine ekleme-sıralama ayrımları — için crawling merkezine ve How Search Works sayfasına bakın.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.