Statistik Crawling Report

cara baca Google Search Console's Statistik Crawling report — total permintaan, download size, respons time, dan breakdowns oleh respons, file jenis, Googlebot jenis, dan purpose.

Pertama kali diterbitkan: 23 Jun 2026 · Terakhir diperbarui: 8 Agu 2026 · Advanced
Bahasa

Statistik Crawling report (Search Console → Settings → Statistik Crawling) menampilkan bagaimana Google di-crawl Anda situs di atas terakhir 90 days: total crawl permintaan, total download size, dan average respons time, plus breakdowns oleh kode respons, file jenis, Googlebot jenis, dan purpose (penemuan vs Refresh). ini adalah hanya tersedia untuk root-tingkat properties — sebuah Domain property atau sebuah URL-prefix property verified di situs's root — tidak subfolder properties. untuk sebagian besar situs ini tidak sebuah crawl-budget dashboard untuk mengoptimalkan — ini adalah sebuah server-health early-warning sistem. Rising respons times atau 5xx membuat Google back off; sustained robots.txt unavailability dapat halt crawling. ini adalah closest GSC mendapatkan untuk log data, tetapi ini covers Google's crawler hanya dan tidak guaranteed untuk menjadi permintaan-menyelesaikan.

TL;DR — Statistik Crawling (Settings → Statistik Crawling, root-tingkat properties hanya — Domain atau root URL-prefix) reports total crawl permintaan, total download size, dan average respons time di atas ~90 days, plus breakdowns oleh respons, file jenis, Googlebot jenis, dan purpose (penemuan vs Refresh). Baca ini sebagai sebuah server-health monitor, tidak sebuah crawl-budget vanity dashboard: rising respons time atau 5xx membuat Google reduce crawl capacity, dan sebuah sustained robots.txt failure dapat halt crawling. ini adalah closest GSC mendapatkan untuk log data, tetapi ini covers Google’s crawler hanya dan tidak guaranteed untuk menjadi permintaan-menyelesaikan — untuk semua bot, pengguna, dan sebuah menyelesaikan record Anda masih perlu server logs. Google scopes -nya own crawl-budget guidance untuk besar, frequently-mengubah situs; untuk sebagian besar lebih kecil situs, di my experience, ini hampir tidak pernah penting.

Evidence for this claim The Crawl Stats report shows Googlebot request totals, download size, response time, host status, and request breakdowns. Scope: Current Search Console Crawl Stats report. Confidence: high · Verified: Google Search Console: Crawl Stats report Evidence for this claim Google says crawl-budget management is mainly relevant to very large or rapidly changing sites; most sites can rely on normal crawling. Scope: Google's current crawl-budget guidance. Confidence: high · Verified: Google Search Central: Crawl budget management

Apa ini adalah dan di mana ini lives

Google’s own framing adalah direct: “Itu Statistik Crawling report menunjukkan Anda statistics tentang Google’s crawling history pada Anda website.” (terjemahan) “ Statistik Crawling report menampilkan Anda statistics tentang Google’s crawling history pada Anda situs web.” Anda mendapatkan untuk ini di bawah Settings → Statistik Crawling — tidak di main report sidebar, yang trips sebuah lot dari orang up.

single biggest alasan orang think report adalah “missing” (terjemahan) “missing” atau “rusak” (terjemahan) “rusak”: Google hanya menampilkan ini untuk root-tingkat properties. di mereka kata, “This report is available only for root-level properties.” (terjemahan) “Laporan ini hanya tersedia untuk properti tingkat root.” itu covers keduanya sebuah Domain property dan sebuah URL-prefix property verified di situs’s root (misalnya, https:// example.com) — ini tidak limited untuk protocol-lebih sedikit Domain properties. jika Anda verified sebuah URL-prefix property scoped untuk sebuah subfolder atau subpath, re-verify di root tingkat dan ini muncul. ada tidak ada apa pun wrong dengan Anda situs.

Evidence for this claim Crawl Stats is available for root-level properties, including a Domain property or a URL-prefix property at a host root; saying it requires a Domain property or a property without a protocol is too narrow. Scope: root-level properties Confidence: high · Verified: Crawl Stats report

seharusnya Anda care? crawl-budget reframe

sebagian besar situs melakukan tidak perlu untuk mengoptimalkan anggaran crawling, dan report’s nyata nilai adalah health monitoring alih-alih budget tuning. Google scopes -nya own crawl-budget guidance untuk besar situs (1M+ unique halaman) dan medium-atau-lebih besar situs (10k+ halaman dengan daily perubahan). Di bawah itu, ini adalah sebuah diagnostic, tidak sebuah project.

Google juga frames report itself sebagai dibangun untuk advanced pengguna, dan says situs di bawah roughly 1 000 halaman umumnya jangan perlu untuk dig ke ini di ini granularity — sebuah lebih kecil threshold daripada crawl-budget guidance di atas. My own aturan dari thumb adalah looser: untuk sebagian besar situs di bawah tentang 10 000 halaman, I masih tidak akan spend banyak time pada anggaran crawling. Treat itu sebagai practitioner judgment, tidak sebuah official cutoff.

laju crawling adalah governed oleh dua hal berfungsi together — crawl capacity limit dan crawl demand. Capacity adalah apa Anda server dapat tangani. Google defines capacity limit sebagai “The maximum number of simultaneous parallel connections that Google can use to crawl a site, as well as the time delay between fetches.” (terjemahan) “Batas kapasitas adalah jumlah maksimum koneksi paralel simultan yang dapat digunakan Google untuk merayapi situs, beserta jeda waktu antar-pengambilan.” Demand adalah bagaimana banyak Google ingin untuk crawl, driven oleh factors like popularity dan staleness. report adalah di mana consequences dari keduanya tampilkan up. (Lebih pada concept di anggaran crawling.)

sebuah sedikit cakupan detail worth knowing sebelum Anda baca angka: report counts sebenarnya URL Googlebot requested alih-alih canonical ini resolves untuk, dan ini counts duplicate permintaan dan setiap server-side redirect hop secara terpisah (client-side redirects tidak counted sebagai redirect respons di sini). ini adalah scoped untuk property atau host Anda’re viewing — resources pada lainnya domains, dan sometimes sibling atau child domains, dapat menjadi di bawah- atau di atas-represented depending pada property jenis. dan per Google’s own documentation, report reflects sebagian besar crawl permintaan tetapi dapat omit beberapa, so sebuah kecil mismatch terhadap Anda own server logs adalah yang diharapkan, tidak sebuah bug.

ini adalah closest hal Search Console memberikan Anda untuk log-file data — tetapi ini adalah Google’s crawler hanya, aggregated, dan tidak guaranteed untuk menjadi permintaan-menyelesaikan. jika Anda ingin hits dari semua bot dan pengguna, atau sebuah guaranteed menyelesaikan record, Anda perlu Anda server logs. Treat Statistik Crawling sebagai free pertama look sebelum Anda invest di log analysis.

three top-line metrics

Baca ini sebagai trends, tidak targets:

  • Total crawl permintaan“The total number of crawl requests issued for URLs on your site, whether successful or not.” (terjemahan) “Jumlah total permintaan crawling untuk URL di situs Anda, baik yang berhasil maupun tidak.” setiap permintaan counts, including ones itu errored.
  • Total download size“Total number dari bytes downloaded dari Anda site during crawling, untuk itu specified time period.” (terjemahan) “Total angka dari bytes downloaded dari Anda situs selama crawling, untuk specified time period.”
  • Average respons time“Average waktu respons untuk all resources fetched dari Anda site during itu specified time period.” (terjemahan) “Average respons time untuk semua resources fetched dari Anda situs selama specified time period.” ini adalah effectively sebuah server-health proxy. sebuah sustained spike adalah sebuah performa alarm, dan Google dapat respond oleh dropping Anda crawl capacity limit — so SEO harm adalah indirect (lebih lambat, lebih sedikit crawling), terpisah dari apa pun halaman-speed peringkat factor.

Breakdown: oleh respons

ini table, di Google’s kata, menampilkan “itu responses itu Google diterima ketika crawling Anda site, grouped oleh response jenis, sebagai a percentage dari all crawl responses.” (terjemahan) “ respons itu Google diterima ketika crawling Anda situs, grouped oleh respons jenis, sebagai sebuah percentage dari semua crawl respons.” respons jenis sertakan OK (200), Moved permanently (301), Moved temporarily (302), tidak ditemukan (404), server error (5XX), dan robots.txt tidak tersedia.

Bagaimana I baca setiap pattern:

  • 200 seharusnya menjadi besar majority. Google tidak publish sebuah spesifik target percentage, so judge ini terhadap Anda own baseline dan watch untuk sustained shifts alih-alih chasing sebuah tepat angka.
  • Lots dari 404s tidak fatal tetapi sinyal wasted crawl — Google spending permintaan pada URLs itu jangan exist.
  • Lots dari 301s poin di rantai pengalihan atau tautan internal masih aimed di old URLs. Perbaiki tautan untuk poin di akhir destination.
  • sebuah 5xx spike adalah paling damaging pattern di report. Anda server adalah erroring di bawah crawl muat, yang drops capacity limit, yang berarti lebih sedikit crawling. Sustained 5xx dapat effectively throttle Google untuk sebuah crawl.
  • robots.txt tidak tersedia tidak seharusnya tampilkan up di apa pun sustained, bermakna cara. Google tidak publish sebuah fixed target percentage, tetapi sebuah persistent share berarti Google periodically tidak dapat fetch Anda robots.txt. itu penting karena jika Anda robots.txt tetap tidak tersedia, Google akan conservatively pause crawling untuk sebuah sementara alih-alih guess. (untuk apa robots.txt melakukan dan tidak control, see robots.txt.)

Breakdown: oleh file jenis

Google groups crawling oleh file jenis — HTML, image, JavaScript, CSS, JSON, PDF, dan others. ini adalah sebuah diagnostic lead, tidak proof dari waste pada -nya own — bagaimana banyak JS, CSS, image, atau JSON crawling adalah wajar bergantung pada bagaimana Anda situs adalah dibangun (sebuah JS-berat app legitimately perlu lebih resource crawling daripada sebuah static HTML situs). sebuah JS/CSS/image share itu’s tinggi relative untuk Anda own baseline, atau itu jumps suddenly, adalah worth investigating sebagai mungkin render-resource overhead. Unexpected file jenis menunjukkan up dapat reveal sebuah crawl trap — sebuah infinite atau near-infinite URL space generating junk.

Breakdown: oleh Googlebot jenis

ini splits crawling oleh yang Googlebot melakukan fetching — smartphone, desktop, image, video, halaman resource muat, dan AdsBot. Google tidak document sebuah diperlukan mix, tetapi di sebuah mobile-pertama crawl, Smartphone typically leads untuk sebagian besar situs. sebuah desktop-berat profile, atau unexpected volume dari Image atau AdsBot, adalah sebuah lead worth investigating alih-alih sebuah violation oleh itself — ini dapat berarti Google tidak treating Anda situs sebagai mobile-pertama, itu ad/image crawling adalah eating ke budget Anda’d rather spend pada konten, atau hanya itu Anda situs memiliki unusual resource perlu.

Breakdown: oleh purpose — penemuan vs Refresh

Dua categories, dan Google defines them hanya oleh prior crawl history — labels alone jangan tell Anda apakah mix adalah healthy:

  • penemuan“The URL requested was never crawled by Google before.” (terjemahan) “URL yang diminta belum pernah dirayapi Google.”
  • Refresh“A recrawl of a known page.” (terjemahan) “sebuah recrawl dari sebuah known halaman.”

sebuah rise di penemuan adalah yang diharapkan selama sebuah launch atau migration (Google adalah finding Anda baru URLs); yang sama rise adalah sebuah masalah jika ini adalah coming dari infinite-space atau parameter URLs — itu’s anggaran crawling going untuk garbage. sebuah Refresh-berat mix adalah wajar untuk sebuah established situs itu tidak penerbitan banyak baru konten. Judge either terhadap Anda own baseline dan apa Anda know changed, tidak terhadap sebuah fixed “healthy” (terjemahan) “rasio kesehatan yang stabil”.

Host status — paling actionable block

Host status summarizes apakah Google hit availability masalah trying untuk crawl Anda, grouped ke three sub-memeriksa: robots.txt fetch, DNS resolution, dan server connectivity. sebuah red host status adalah satu dari paling actionable sinyal di report — ini biasanya berarti Google adalah blocked atau throttled di infrastructure tingkat, sebelum ini ever mendapat untuk Anda konten, selama itu window. ini adalah sebuah aggregate alert, though, tidak proof itu setiap URL adalah affected atau itu masalah adalah masih happening now — periksa timeline dan konfirmasi saat ini status (sebuah langsung fetch, pemeriksaan URL, atau Anda logs) sebelum Anda pertimbangkan ini fixed. masih, treat sebuah red host status sebagai pertama hal untuk investigate. (Covered di -nya own right di bawah Host status.)

Reading spikes dan drops

mechanism untuk internalize: Anda server’s perilaku feeds back ke bagaimana banyak Google melakukan crawl. jika situs responds quickly dan reliably, Google’s capacity limit dapat rise; jika ini slows down atau dimulai returning kesalahan server, limit drops. So:

  • respons-time spike → capacity limit dapat drop → lebih sedikit crawling.
  • 5xx surge → capacity limit drops → lebih sedikit crawling; sustained, ini dapat throttle Anda hard.
  • robots.txt tidak tersedia → jika ini tetap tidak tersedia, Google pauses crawling conservatively.

None dari ini adalah sebuah peringkat penalty. damage adalah indirect: jika halaman tidak di-crawl dan terindeks, mereka dapat’t peringkat di semua — tetapi extra crawling tidak lift rankings either. (See anggaran crawling concept untuk penuh capacity-plus-demand model.)

Statistik Crawling vs server logs

Statistik Crawling adalah closest GSC mendapatkan untuk logs, tetapi gaps penting:

Statistik Crawling reportserver logs
Siapa ini coversGoogle’s crawler hanyasemua bot dan semua pengguna
GranularityAggregated; dapat omit beberapa permintaansetiap individual permintaan
Retention~90 daysWhatever Anda pertahankan
Per-URL detailTidakYa
CostFree, di GSCStorage + analysis effort

jika Anda outgrow Statistik Crawling — Anda perlu per-URL data, non-Google bot, atau lebih lama history — itu’s ketika Anda graduate untuk log file analysis. Statistik Crawling tells Anda sesuatu’s off; logs tell Anda persis di mana.

Bagaimana ini relates untuk rest dari crawling

Statistik Crawling report adalah Anda view ke crawling setelah fact. untuk pengindeksan side dari apa happens berikutnya, halaman pengindeksan report adalah companion — crawl Stats menampilkan apa Google fetched; halaman pengindeksan menampilkan apa dibuat ini ke indeks. dan Host status, surfaced di dalam ini report, adalah infrastructure-tingkat sinyal worth leading dengan.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.