AI Tarayıcıları

Eğitim botları, AI arama dizinleyicileri ve kullanıcı tetiklemeli getiricilerden oluşan üç AI tarayıcısı türünü, başlıca adlandırılmış botları ve SEO’ya zarar vermeden her birini nasıl yöneteceğinizi açıklar.

İlk yayın tarihi: 24 Haz 2026 · Son güncelleme: 22 Ağu 2026 · Advanced
Diller
Bu sayfada 2 kanıt sinyali

AI tarayıcıları üç türdür ve bunları birbirine karıştırmak en büyük hatadır: GPTBot, ClaudeBot ve CCBot gibi eğitim/model geliştirme botları; OAI-SearchBot, PerplexityBot ve Applebot gibi AI arama dizinleyicileri; ChatGPT-User, Perplexity-User ve Claude-User gibi kullanıcı tetiklemeli getiriciler. Denetimler sağlayıcıya ve agente özgüdür: GPTBot’u engellemek OAI-SearchBot’u engellemez; OAI-AdsBot’un reklamlar için ayrı bir kapsamı vardır. Google-Extended ve Applebot-Extended bağımsız tarayıcılar değil, ürün ve denetim belirteçleridir. Google-Extended, Gemini/Vertex model geliştirmesini ve grounding’i kapsar; Google Arama’ya dahil olmayı, sıralamayı, AI Overviews’i veya AI Mode’u kapsamaz. Applebot-Extended, sayfaları Apple aramasından kaldırmadan Apple temel modellerinde kullanımı denetler. llms.txt hâlâ bir öneridir; yaygın biçimde benimsenmiş bir denetim standardı değildir.

OpenAI, GPTBot, OAI-SearchBot ve ChatGPT-User ayarlarının birbirinden bağımsız olduğunu belirtir. Evidence for this claim OpenAI publishes separate controls for GPTBot, OAI-SearchBot, and ChatGPT-User, and says each setting is independent. Scope: OpenAI-declared crawlers and user agents; their purposes and robots behavior are platform-specific. Confidence: high · Verified: OpenAI: Crawlers Anthropic ise ClaudeBot, Claude-SearchBot ve Claude-User’ı farklı aracılar olarak tanımlar ve bunların robots.txt kurallarını nasıl uyguladığını belgeler. Evidence for this claim Anthropic documents ClaudeBot, Claude-SearchBot, and Claude-User separately and says its bots honor robots.txt directives. Scope: Anthropic-declared bots; user-initiated retrieval has additional product-specific conditions. Confidence: high · Verified: Anthropic: Bot information

TL;DR — AI tarayıcıları üç kategoriye ayrılır ve bunları birbirine karıştırmak neredeyse herkesin yaptığı hatadır. Eğitim botları (GPTBot, ClaudeBot, CCBot, Bytespider, Amazonbot, Meta-ExternalAgent) model derlemleri oluşturmak için içerik tarar. AI arama botları (OAI-SearchBot, PerplexityBot, Applebot, Amzn-SearchBot) alıntı yapmaya elverişli bir dizin oluşturur. Kullanıcı tarafından tetiklenen getiriciler (ChatGPT-User, Perplexity-User, Claude-User), bir kişi soru sorduğunda sayfayı canlı olarak getirir. Her birinin kendi user-agent’ı ve kendi robots.txt kuralı vardır; bu nedenle GPTBot’u engellemek OAI-SearchBot’u etkilemez. Google-Extended ve Applebot-Extended bot değil, belirteçtir: Tarama yapmaz, yalnızca eğitim/temellendirme kullanımından çıkmanızı sağlar. Eğitim botlarını engellemenin Google sıralamalarına hiçbir etkisi yoktur (Google bunu belirtir ve ampirik veriler bunu destekler); AI arama botlarını engellemek ise AI yanıtlarındaki görünürlüğünüzü azaltır. robots.txt tartışması, kullanıcı getiricileri (işletmeciler kuralların “may not apply” olduğunu söylüyor) ve Perplexity (gizli tarama yaptığı bildirildi) bakımından gerçektir. llms.txt büyük ölçüde okunmayan bir öneridir ve büyük sağlayıcılarca benimsenmemiştir.

Üç kategori — bu konunun omurgası

Classify the purpose before writing the rule: training, AI-search visibility, and live user fetching are separate decisions. Kaynak: /technical-seo/how-search-works/crawling/crawler/ai-crawlers/

Training crawlers such as GPTBot, ClaudeBot, and CCBot collect data for model corpora. AI-search crawlers such as OAI-SearchBot and PerplexityBot build indexes used for answers and citations. User-triggered agents such as ChatGPT-User and Claude-User fetch a page for a live request. Blocking one category does not automatically block the others.

© Patrick Stox LLC · CC BY 4.0 ·

Adlandırılmış her AI botu üç gruptan birine girer. Grubu doğru belirlerseniz sonraki bütün kararlar (engellemeli miyim, izin vermeli miyim, SEO’ma ne olur?) kendiliğinden netleşir.

1. Eğitim / veri toplama tarayıcıları. Bunlar, LLM’lerin eğitimi ve ince ayarı için derlemler oluşturmak üzere büyük ölçekte tarama yapar. Çoğu yayıncının engellemek istediği botlar bunlardır ve bunlara izin vermemenin arama sıralamalarına hiçbir etkisi yoktur. Üyeler: GPTBot (OpenAI), ClaudeBot (Anthropic), CCBot (Common Crawl), Bytespider (ByteDance), Amazonbot (Amazon), Meta-ExternalAgent (Meta), AI2Bot (Allen Institute), cohere-training-data-crawler (Cohere), Diffbot, Timpibot (Timpi), webzio-extended (Webz.io). Ayrıca ayrı tarayıcılar OLMAYAN iki denetim belirteci vardır: Aşağıda ele alınan Google-Extended ve Applebot-Extended.

2. AI arama / dizinleme tarayıcıları. Bunlar, sorguları atıflarla ve size geri dönen bağlantılarla yanıtlamak için kullanılan canlı bir dizin oluşturur. Bunları engellemek AI arama sonuçlarından çıkarılmanıza yol açabilir. Üyeler: OAI-SearchBot (OpenAI — GPTBot’tan ayrıdır), PerplexityBot (Perplexity), Applebot (Apple — Spotlight/Siri/Safari önerilerini destekler), Amzn-SearchBot (Amazon).

3. Kullanıcı tarafından tetiklenen / isteğe bağlı getiriciler. Bunlar, bir bot kendi başına dolaştığı için değil, bir kullanıcı soru sorduğu için belirli bir sayfayı canlı olarak getirir. İşletmeciler genellikle robots.txt kurallarının kullanıcı tarafından başlatılan bir getirmeyi bağlamadığını ileri sürer; bu tartışmalı bir alandır. Üyeler: ChatGPT-User (OpenAI), Perplexity-User (Perplexity), Claude-User ve Claude-SearchBot (Anthropic), Amzn-User (Amazon, Alexa için), Meta-ExternalFetcher (Meta).

User-agent belirteçlerini ve robots.txt uyumluluğunu içeren tam tablo Cheat Sheets sekmesindedir; bu tablo makalenin merkezinde yer alır.

”Bot değil, belirteç” tuzağı (Google-Extended ve Applebot-Extended)

Bu, alandaki en yanlış anlaşılan olgudur; bu nedenle kesin konuşalım. Google-Extended ve Applebot-Extended hiçbir şeyi taramaz. Bağımsız user-agent’ları yoktur ve tarama trafiği oluşturmazlar. Bunlar, mevcut taramaların içeriğinizle ne yapmasına izin verildiğini değiştiren robots.txt denetim belirteçleridir.

  • Google-Extended, Google Arama dışındaki temellendirme dâhil olmak üzere Gemini Apps ve Vertex AI üretken modellerinin geliştirilmesi için kullanımı denetler. Google Arama’nın AI Overviews veya AI Mode özelliklerini denetlemez; bunlar Googlebot erişimini kullanır. Google açıkça şöyle der: “Google-Extended does not impact a site’s inclusion in Google Search nor is it used as a ranking signal in Google Search.” (Türkçe çeviri) “Google-Extended, bir sitenin Google Arama’ya dahil edilmesini etkilemez ve Google Arama’da sıralama sinyali olarak kullanılmaz.” Buna izin vermemek Googlebot’u veya sıralamalarınızı etkilemez.
  • Applebot-Extended, Apple için aynı fikri uygular. Apple şöyle der: “Applebot-Extended does not crawl webpages. Webpages that disallow Applebot-Extended can still be included in search results.” (Türkçe çeviri) “Applebot-Extended web sayfalarını taramaz. Applebot-Extended’a izin vermeyen web sayfaları yine de arama sonuçlarına dahil edilebilir.” Bu belirteç, Apple’ın temel modellerinin (Apple Intelligence) eğitiminden çıkmanızı sağlar; sayfalarınız gerçek tarayıcı Applebot aracılığıyla Spotlight/Siri’de görünmeye devam eder.

Dolayısıyla Disallow: Google-Extended ve Disallow: Applebot-Extended, bağımsız tarama engellerinden çok ürün kullanım denetimleridir. Yayımlanmış kapsamları sayfaları ilgili arama dizininden çıkarmaz; ancak birbirlerinin yerine kullanılamazlar ve ikisi de yalnızca “eğitim botu” diye adlandırılmamalıdır.

Botlara göre başlıca işletmeciler

OpenAI, birbirinden bağımsız dört beyan edilmiş bot çalıştırır: GPTBot (eğitim — “used to make our generative AI foundation models more useful and safe” (Türkçe çeviri) “üretken yapay zekâ temel modellerimizi daha yararlı ve güvenli hâle getirmek için kullanılır”), OAI-SearchBot (arama — “used to surface websites in search results in ChatGPT’s search features” (Türkçe çeviri) “web sitelerini ChatGPT’nin arama özelliklerindeki sonuçlarda göstermek için kullanılır”), ChatGPT-User (kullanıcı getiricisi — “used for certain user actions in ChatGPT” (Türkçe çeviri) “ChatGPT’deki belirli kullanıcı eylemleri için kullanılır”) ve OAI-AdsBot (eğitim veya arama dizini tarayıcısı olmayan bağımsız bir reklam kapsamı). OpenAI’ın politika cümlesi bütün alan için örnek niteliğindedir: “Each bot setting is independent, allowing webmasters granular control over how their content interacts with different OpenAI systems.” (Türkçe çeviri) “Her bot ayarı bağımsızdır; böylece site yöneticileri içeriklerinin farklı OpenAI sistemleriyle nasıl etkileşime gireceğini ayrıntılı biçimde denetleyebilir.” GPTBot’a izin vermemek, “signals that future data from these materials should be excluded from model training datasets” (Türkçe çeviri) “bu materyallerden gelecek verilerin model eğitim veri kümelerinin dışında tutulması gerektiğini bildirir”; OAI-SearchBot’a izin vermemek ise sitenizin “won’t appear in ChatGPT search results.” (Türkçe çeviri) “ChatGPT arama sonuçlarında görünmez.” anlamına gelir.

Anthropic üç bot çalıştırır: ClaudeBot (eğitim), Claude-SearchBot (arama dizinleme) ve Claude-User (kullanıcı getirmesi). Anthropic, botlarının “respect ‘do not crawl’ signals by honoring industry standard directives in robots.txt” (Türkçe çeviri) “robots.txt içindeki sektör standardı yönergelere uyarak “tarama” sinyallerine saygı gösterir” olduğunu belirtir. Güncel destek sayfası ayrıca Anthropic’e özgü doğrulama için ortak bir yayımlanmış IP listesine yönlendirir. Sağlayıcıya özgü bu liste kimlik kanıtıdır; her bot için geçerli evrensel bir IP veya ters DNS doğrulama kuralı değildir.

Google — temel olgu yukarıdakiyle aynıdır: Google-Extended bir bottan ziyade belirteçtir. Google ayrıca site sahibinin isteğiyle çalışan Vertex AI Agents için tarama yapan ve sıralamayı etkilemeyen Google-CloudVertexBot ile Gemini-Deep-Research ve Google-NotebookLM gibi kullanıcı tarafından tetiklenen aracılar çalıştırır.

Apple, Spotlight/Siri/Safari önerilerini destekleyen ve “may also be used to help train Apple foundation models” (Türkçe çeviri) “Apple temel modellerinin eğitimine yardımcı olmak için de kullanılabilir” olan gerçek tarayıcı Applebot ile Applebot-Extended belirtecini çalıştırır. Applebot’u engellemek sizi Apple aramasından çıkarır; Applebot-Extended’ı engellemek yalnızca eğitimden çıkmanızı sağlar.

Perplexity iki bot beyan eder: PerplexityBot (arama/atıflar — açıkça “not used to crawl content for AI foundation models” (Türkçe çeviri) “yapay zekâ temel modelleri için içerik taramak amacıyla kullanılmaz”; dolayısıyla Perplexity’nin beyan edilmiş bir eğitim tarayıcısı yoktur) ve Perplexity-User (kullanıcı getirmesi). Belgelerinde, getirme işlemi kullanıcı tarafından başlatıldığı için Perplexity-User’ın “generally ignores robots.txt rules” (Türkçe çeviri) “genellikle robots.txt kurallarını yok sayar” olduğu belirtilir. Perplexity ayrıca bildirilen gizli tarama vakalarının konusudur; aşağıdaki tartışmaya bakın.

Amazon üç bot çalıştırır ve burada yararlı bir istisna vardır: Amazonbot (ürünleri geliştirir ve “may be used to train Amazon AI models” (Türkçe çeviri) “Amazon yapay zekâ modellerini eğitmek için kullanılabilir”), Amzn-SearchBot (arama) ve Amzn-User (Alexa kullanıcı getirmeleri). Amazon’ın belgelerine göre Amzn-SearchBot ve Amzn-User üretken AI modeli eğitimi için kesinlikle tarama YAPMAZ; dolayısıyla “bütün AI şirketleri eğitim için içerik tarar” iddiası bir yanılgıdır. Amazon ayrıca noarchive meta etiketine özel bir anlamla uyar: sayfayı model eğitimi için kullanma. Bu, sayfa bazında nadir görülen bir eğitimden çıkma seçeneğidir.

Amazon’ın robots işleyişinde alışılmadık iki operasyonel özellik vardır: Tarayıcıları önceki 30 gün içinde önbelleğe alınmış bir robots.txt kopyasını kullanabilir ve Amazon, dosya getirilemezse tarayıcılarının dosya yokmuş gibi davrandığını belirtir. Bu, başarısız bir denetim getirmesinin Amazon’ın herkese izin veren bir durum gördüğünü kanıtladığı anlamına gelmez; denetim ile Amazon ana makineye farklı zamanlarda veya farklı ağ yolları üzerinden ulaşıyor olabilir. Evidence for this claim Amazon says its crawlers may use a robots.txt copy cached within the previous 30 days. Scope: Amazon crawler behavior only; a current audit fetch cannot identify which cached copy Amazon used. Confidence: high · Verified: Amazon: Amazonbot Evidence for this claim Amazon says its crawlers behave as if robots.txt does not exist when they cannot fetch it. Scope: Amazon crawler behavior only; a tool-side fetch failure is not proof that Amazon observed the same failure. Confidence: high · Verified: Amazon: Amazonbot

Meta, Meta-ExternalAgent (Llama ve Meta AI için eğitim/dizinleme), Meta-ExternalFetcher (kullanıcı getirmesi) ve ayrıca Facebookbot (bağlantı önizlemeleri — bir AI tarayıcısı değildir) çalıştırır. Meta-ExternalAgent’ı engellemek Facebook bağlantı önizlemelerinizi etkilemez.

Common Crawl (CCBot), açık bir web arşivi tutan kâr amacı gütmeyen bir vakıf tarafından işletilir. Gizli katman budur: Common Crawl veri kümesi ChatGPT, Claude, LLaMA ve daha birçok modelin eğitiminde kullanılmıştır; bu nedenle CCBot’u engellemek, sizi hiçbir zaman doğrudan taramayan modeller üzerinde dolaylı etki yaratır. Common Crawl ayrıca sahte botların kendilerini CCBot olarak tanıttığı konusunda uyarır.

ByteDance (Bytespider) saldırgan örnektir: robots.txt kurallarına uyduğunu beyan eder ancak bunları ihlal ettiği ve çok yüksek istek hacimleri oluşturduğu yaygın biçimde bildirilir. Bilinmesi gereken diğerleri: AI2Bot (Allen Institute, açık modeller / Dolma veri kümesi), Cohere, Diffbot (çıktısı pek çok sonraki AI işlem hattını besleyen yapılandırılmış veri çıkarımı) ve Timpibot / webzio-extended.

AI botları robots.txt kurallarına gerçekten uyuyor mu?

Başlıca işletmecilerin (OpenAI, Anthropic, Google, Apple, Amazon) tümü, eğitim ve arama tarayıcılarının robots.txt kurallarına uyduğunu belgelerinde belirtir. Tartışmalı alan, bazı işletmecilerin isteği bir kişi başlattığı için robots.txt kurallarının geçerli olmayabileceğini açıkça söylediği kullanıcı tarafından tetiklenen getiricilerdir. OpenAI, “these actions are initiated by a user, robots.txt rules may not apply” (Türkçe çeviri) “bu eylemleri bir kullanıcı başlattığı için robots.txt kuralları geçerli olmayabilir”; Perplexity ise Perplexity-User’ın “generally ignores robots.txt rules.” (Türkçe çeviri) “genellikle robots.txt kurallarını yok sayar.” olduğunu söyler. Bu, ihlal değil, beyan edilmiş politikadır.

Perplexity tartışması en çok öne çıkan anlaşmazlıktır ve bunu kesinleşmiş bir bulgu değil, bildirilen bir durum olarak işaretlemek gerekir. Haziran 2024’te Wired ve geliştirici Robb Knight, Perplexity’nin kendisini engellemiş sitelerdeki içeriğe görünüşe göre listelenmemiş IP’ler kullanarak eriştiğini bildirdi. Ağustos 2025’te Cloudflare, Perplexity’nin macOS üzerinde Chrome’u taklit eden gizli bir user-agent kullandığını, engellerden kaçınmak için IP’leri ve ASN’leri değiştirdiğini ve tam Disallow: / taşıyan yeni oluşturulmuş test alan adlarından içerik getirdiğini bildirdi. Cloudflare daha sonra Perplexity’yi doğrulanmış bot listesinden çıkardı. Bunlar ilgili kaynakların belgelenmiş bildirimleri olarak sunulmalıdır; Perplexity’nin kendi belgeleri PerplexityBot’un robots.txt kurallarına uyduğunu savunmaktadır.

Bazı botlar robots.txt kurallarını belirli ölçülerde yok saydığı için Cloudflare uygulamada yaptırım katmanı hâline gelmiştir: ağ düzeyinde engelleme, tek tıklamalı “AI Scrapers and Crawlers” anahtarı, yönetilen robots.txt, robots.txt ihlali takibi ve tarama başına ödeme beta sürümü. Temmuz 2025 itibarıyla yeni Cloudflare alan adları bilinen AI tarayıcılarını varsayılan olarak engeller.

AI tarayıcıları nasıl denetlenir?

  • User-agent bazında robots.txt, başlıca ve ayrıntılı denetim aracıdır: GPTBot’u engellemek OAI-SearchBot veya ChatGPT-User’ı engellemez. robots.txt tarifleri (tüm eğitim botlarını veya AI arama botlarını engelleme) Scripts sekmesindedir.
  • Eğitim belirteçleri olan Google-Extended ve Applebot-Extended, arama açısından bir bedel yaratmadan Gemini/Apple-Intelligence eğitiminden çıkmanızı sağlar.
  • Amazon’ın noarchive meta etiketi, Amazon için sayfa bazında eğitimden çıkma seçeneğidir.
  • Cloudflare AI Crawl Control, ağ düzeyinde engelleme/izin verme/ücretlendirme ile yönetilen robots.txt ve Content Signals yönergeleri (search, ai-input, ai-train) sunar; varsayılan değer search=yes, ai-train=no şeklindedir.
  • llms.txt, bir öneridir (Jeremy Howard / Answer.AI, Sept 2024); benimsenmiş bir standart değildir ve başlıca tarayıcılarca dikkate alınmaz. Çıkarım sırasında okunması amaçlanan, seçilmiş bir markdown haritasıdır; ancak 137K siteyi kapsayan bir Ahrefs araştırması, yayımlanmış llms.txt dosyalarının 97%‘sinin sıfır istek aldığını ve hiçbir büyük LLM sağlayıcısının bunu resmen benimsemediğini buldu. Bunu AI arama aracı değil, dokümantasyon aracı olarak değerlendirin.
  • ai.robots.txt topluluk projesi, 150+ AI bot user-agent’ını listeleyen kapsamlı bir Disallow: / dosyası tutar; tümünü birden engellemek için yararlı bir başvuru kaynağıdır.

Görünürlük öncelikli tarayıcı politikası

AI arama görünürlüğü isteyen herkese açık bir eğitim veya ticaret sitesi için varsayılan politikam şöyledir:

  1. İstediğiniz arama yüzeylerini besleyen geleneksel arama tarayıcılarına izin verin; buna Googlebot ve Bingbot da dâhildir.
  2. Herkese açık içerikte OAI-SearchBot, Claude-SearchBot ve PerplexityBot gibi belgelenmiş AI arama/dizinleme tarayıcılarına izin verin.
  3. Sağlayıcıların robots davranışlarının farklı olduğunu dikkate alarak ChatGPT-User, Claude-User ve Perplexity-User gibi amaçlanan kullanıcı yönlendirmeli getiricilere izin verin. Evidence for this claim OpenAI publishes separate controls for GPTBot, OAI-SearchBot, and ChatGPT-User, and says each setting is independent. Scope: OpenAI-declared crawlers and user agents; their purposes and robots behavior are platform-specific. Confidence: high · Verified: OpenAI: Crawlers Evidence for this claim Anthropic documents ClaudeBot, Claude-SearchBot, and Claude-User separately and says its bots honor robots.txt directives. Scope: Anthropic-declared bots; user-initiated retrieval has additional product-specific conditions. Confidence: high · Verified: Anthropic: Bot information Evidence for this claim Perplexity documents PerplexityBot for search indexing separately from Perplexity-User for user-requested fetches, with different robots behavior. Scope: Perplexity-declared crawlers and published IP ranges; a user-agent string alone does not verify identity. Confidence: high · Verified: Perplexity: Crawlers
  4. Eğitim/model geliştirme erişimi için ayrı bir hak kararı verin. GPTBot, ClaudeBot, Google-Extended ve diğer eğitim denetimleri arama politikasını paylaşmak zorunda değildir. Bunlara yalnızca bu kullanım yayın politikanızla örtüşüyorsa izin verin.
  5. Özel ve operasyonel yolları kimlik doğrulamayla koruyun. /admin/, önizlemeler, hesap verileri ve herkese açık olmayan API’leri sunucu tarafı yetkilendirmenin arkasında tutun; bir Disallow yalnızca tarayıcı tercihidir.
  6. WAF denetimlerini aşmadan önce kimliği doğrulayın. Belgelenmiş user-agent’ı güncel sağlayıcı IP aralıkları, ters DNS doğrulaması veya desteklenen bot kimlik doğrulamasıyla birleştirin. Yalnızca taklit edilebilir bir user-agent’a dayanarak geniş kapsamlı bir WAF izin kuralı oluşturmayın.

Belirli bir tarayıcı için geçerli kalması gereken bütün kısıtlamaları yinelemiyorsanız, yalnızca Allow: / demek amacıyla belirli bir user-agent grubu eklemeyin. Robots eşleştirme kurallarında belirli bir grup, sağlayıcıya özgü robots ayrıştırmasına bağlı olarak joker grubun özel yol dışlamalarını devralmak yerine joker grubun yerini alabilir. En basit güvenli dosya çoğu zaman kendi başına güvenli tek bir joker grup ile dar kapsamlı eğitimden çıkma kurallarından oluşur.

Özellikle bu site için mevcut herkese açık politika; yönetici, önizleme, API, tuzak ve ağ geçidi yollarını dışlarken arama, AI girdisi ve AI eğitimi için açık bir izin yaklaşımıdır. Arama ve kullanıcı yönlendirmeli getirmeye izin vermeye devam ederdim. Eğitim erişiminin kanıtlanmış bir atıf faydası olmadığı için ai-train=yes değerini AI görünürlüğü taktiği olarak değil, yalnızca editoryal haklar kararı olarak değiştirirdim.

AI tarayıcı erişimi, AI hazırlığı değildir

Bir izin kuralı en fazla, beyan edilen robots politikasının adlandırılmış bir aracının URL istemesine izin verdiğini kanıtlar. İşletmecinin politikaya uyduğunu, sayfayı getirdiğini, işlediğini, önemli bilgiyi çıkardığını, model bağlamına yerleştirdiğini, ona atıf yaptığını veya bir işlemi tamamladığını kanıtlamaz.

Beş katmanı birbirinden ayrı tutun:

KatmanSoruKanıt
İzinBeyan edilen politika uyarınca bu adlandırılmış aracı URL’yi isteyebilir mi?Etkin robots ve ağ erişimi testi
ÇıkarılabilirlikÖnemli içerik kararlı metinde, bağlantılarda, meta verilerde veya yapılandırılmış veride mevcut mu?Alan çıkarımıyla ham ve işlenmiş yakalama
İşlemeİçerik, aracının gerçek tarayıcı/JavaScript yeteneğiyle kullanılabilir kalıyor mu?Mevcutsa sağlayıcıya özgü getirme kanıtı; aksi hâlde belirtilmiş test sınırlaması
İşletilebilirlikBir aracı amaçlanan işlemi belirleyip güvenle çağırabilir mi?Belgelenmiş araç/arayüz sözleşmesi ve denetimli uçtan uca test
Ticaret hazırlığıKimlik, fiyat, kullanılabilirlik, politika, sipariş karşılama, sepet ve ödeme birbiriyle uyumlu mu?Akış/sayfa/arka uç/sipariş mutabakatı

Bu nedenle bir tarayıcı erişimi denetleyicisi politika için “AI hazır” değil, izin verildi, engellendi veya belirsiz sonucunu bildirmelidir. Başarılı bir günlük isteği yalnızca o isteğin gerçekleştiğini kanıtlar; sayfanın bir yanıtta kullanıldığına kanıt değildir. Geçerli bir akış veya araç bildirimi de herkese açık bir sayfanın doğru işlendiğini ya da ödeme sürecinin gösterilen teklifi karşılayabildiğini kanıtlamaz.

Getirme ve atıf katmanları için How AI Search Works, katalog ve işlem hazırlığı için AI Shopping Optimization içeriğini kullanın. Katmanları ayrı tutmak çözümü belirginleştirir: engel için erişim politikasını, çıkarım için sayfa çıktısını, eksik durum için işlemeyi, işletilebilirlik için arayüz sözleşmesini veya başarısız satın alma için ticaret verilerini düzeltin.

E-ticaret sayfalarında çıkarılabilirlik testi, temel ürün kimliğinin ve seçilen teklifin — SKU, grup ID’si, fiyat, para birimi ve kullanılabilirlik — ilk yanıtta bulunduğunu ve işleme sonrasında da birbiriyle uyumlu kaldığını doğrulamalıdır. Ham ve işlenmiş ürün sayfası standardı sunucuda nelerin görünür olması gerektiğini tanımlar; tek başına tarayıcı izni bu sözleşme hakkında hiçbir şey söylemez.

Trafik kaybettiren yanılgı: eğitim ≠ AI arama

Doğru anlaşılması gereken konu şudur: Eğitim botlarını engellemek, AI arama botlarını engellemekle aynı şey değildir. Bunlar zıt sonuçları olan ayrı robots.txt kurallarıdır:

  • Eğitim botlarını (GPTBot, ClaudeBot, CCBot, Bytespider ve Google-Extended/Applebot-Extended belirteçleri) engellemek → Google ve ampirik yayıncı verileri tarafından doğrulandığı üzere Google sıralamalarını etkilemez. Model eğitiminden çıkmış olursunuz, hepsi bu.
  • AI arama botlarını (OAI-SearchBot, PerplexityBot) engellemek → ChatGPT ve Perplexity yanıtlarındaki görünürlüğünüzü kaybedersiniz. Bu, bedelsiz bir tercih değil, gerçek bir ödünleşimdir.

Çok geniş kapsamlı bir engelleme uygularsanız — örneğin yalnızca eğitimi durdurmak isterken OAI-SearchBot’u da yakalayan genel bir engel — fark ettirmeden kendinizi AI aramasından çıkarabilirsiniz. Her kuralın hangi kategoriyi etkilediğini kesin olarak belirleyin.

Yayıncılar neden engelliyor? Toplumsal sözleşme

Bu tartışmanın varlık nedeni trafiktir. AI botları analizimde belirttiğim gibi, botların web sitelerini taramasının bir maliyeti vardır; arama motorları ile site sahipleri arasındaki toplumsal sözleşmede arama motorları sitelere yönlendirme trafiği göndererek değer katar. Google trafik gönderdiği için (şimdilik) engellenmez. AI tarayıcıları şimdiye kadar çoğunlukla geri trafik göndermiyor ve veriler bu huzursuzluğu destekliyor. Cloudflare Radar analizimde AI botları arama motorlarının ardından açık ara #2 tarayıcıdır ve onları geçme yolundadır. Ayrıntılar Stats sekmesindedir.

Açıklama: Eski bir Ahrefs çalışanıyım ve ücretsiz Ahrefs erişimi alıyorum. Bağlantı verilen tarayıcı analizi, o görevde yayımladığım çalışmadır; Ahrefs bu sitenin güncel editoryal sonuçlarını incelemez veya onaylamaz.

Bunun içinde yer aldığı daha geniş işlem hattı — keşif, tarama zamanlayıcısı, işleme ve taramanın dizinlemeden nasıl farklı olduğu — için tarama merkezine ve genel olarak tarayıcı, user-agent, Googlebot, Bingbot ve robots.txt hakkındaki ilişkili konulara bakın.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.