Blocked oleh robots.txt (GSC Status)

Apa Google Search Console "Blocked by robots.txt" _(terjemahan)_ “Blocked oleh robots.txt” halaman pengindeksan status berarti — sebuah URL excluded dari pengindeksan karena robots.txt disallowed crawling. biasanya intentional. Bagaimana ini differs dari "Indexed, though blocked," _(terjemahan)_ “terindeks, though blocked,” mengapa noindex + disallow conflict, dan cara perbaiki ini jika block adalah sebuah mistake.

Pertama kali diterbitkan: 23 Jun 2026 · Terakhir diperbarui: 8 Agu 2026 · Advanced
Bahasa
1 sinyal bukti di halaman ini

"Blocked by robots.txt" _(terjemahan)_ “Blocked oleh robots.txt” adalah sebuah Google Search Console halaman pengindeksan exclusion: Google ditemukan URL tetapi tidak crawl ini karena Anda robots.txt disallows ini, so ini tidak terindeks di ini state. sebagian besar dari time ini adalah intentional dan fine — robots.txt controls crawling, tidak pengindeksan, so sebuah disallow adalah tidak sebuah deindexing alat. ini adalah sebuah sibling untuk "Indexed, though blocked by robots.txt" _(terjemahan)_ “terindeks, though blocked oleh robots.txt” warning, yang adalah opposite outcome (Google terindeks sebuah blocked URL anyway, biasanya melalui tautan). big gotcha: noindex + disallow conflict — Google dapat't crawl sebuah disallowed halaman, so ini tidak pernah sees noindex. untuk hapus sebuah halaman, izinkan crawling dan sajikan noindex. hanya "perbaiki" _(terjemahan)_ “perbaiki” ini status ketika Anda blocked sesuatu Anda sebenarnya wanted terindeks.

TL;DR — “Blocked by robots.txt” (terjemahan) “Blocked oleh robots.txt” adalah sebuah halaman pengindeksan exclusion: Google ditemukan URL tetapi tidak crawl ini karena robots.txt disallows ini, so ini tidak terindeks di ini state. ini adalah biasanya intentional dan benign — robots.txt governs crawling, tidak pengindeksan, so sebuah disallow adalah tidak pernah sebuah deindexing alat. jangan confuse ini dengan warning “Indexed, though blocked by robots.txt” (terjemahan) “terindeks, though blocked oleh robots.txt” (Google terindeks sebuah blocked URL anyway, biasanya melalui inbound tautan). classic mistake adalah pairing disallow dengan noindex: Google dapat’t crawl halaman, so ini tidak pernah sees noindex dan halaman dapat stay terindeks. untuk hapus sebuah halaman, izinkan crawling dan sajikan noindex. hanya treat ini status sebagai sebuah bug ketika Anda blocked sebuah URL Anda sebenarnya wanted terindeks.

Apa status sebenarnya reports

di Search Console halaman pengindeksan report, “Blocked by robots.txt” (terjemahan) “Blocked oleh robots.txt” adalah sebuah excluded state, tidak sebuah error dan tidak sebuah warning. Google’s own wording adalah plain: halaman “was blocked by your site’s robots.txt file,” (terjemahan) “diblokir oleh berkas robots.txt situs Anda,” dan Google menambahkan penting caveat bahwa “does not guarantee that the page won’t be indexed through some other means.” (terjemahan) “ini tidak menjamin bahwa halaman tidak akan diindeks melalui cara lain.” Evidence for this claim Google reports Blocked by robots.txt when crawling is disallowed and warns that this does not guarantee the URL cannot be indexed by other means. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report Itu caveat adalah seluruh topic di satu line — see di bawah.

Mechanically: Googlebot knows URL ada (ini ditemukan ini melalui sebuah tautan, sebuah sitemap, atau history), tried untuk respect Anda aturan, hit sebuah matching Disallow, dan berhenti. Tidak fetch berarti tanpa konten untuk indeks, so URL sits di ini excluded bucket. ini adalah yang diharapkan hasil dari sebuah disallow — sebagian besar URLs di di sini adalah supposed untuk menjadi di di sini.

crawling adalah tidak pengindeksan — mengapa sebuah disallow tidak deindex

Google documents robots.txt sebagai crawl-access control, tidak sebuah reliable removal mechanism. Evidence for this claim Google says robots.txt manages crawler access and is not a mechanism for keeping a page out of Google. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: robots.txt introduction

ini adalah accuracy spine dari seluruh status. robots.txt adalah sebuah crawl control. Google adalah jelas itu ini “adalah tidak a mechanism untuk mempertahankan a web halaman out dari Google.” (terjemahan) “adalah tidak sebuah mechanism untuk mempertahankan sebuah halaman web out dari Google.” Blocking sebuah URL mencegah fetch; ini melakukan tidak hapus URL dari indeks, dan ini adalah tidak sebuah deindexing alat.

sebagai I’ve put ini di my Ahrefs artikel pada sibling status: “crawling dan indexing adalah dua berbeda hal.” (terjemahan) “crawling dan pengindeksan adalah dua berbeda hal.” sebuah halaman Anda block dapat masih end up terindeks jika lainnya halaman tautan untuk ini — Google hanya dapat’t see konten, dan ini dapat’t see apa pun noindex Anda tried untuk put di sana either. Yang leads untuk single sebagian besar umum mistake orang membuat ketika mereka land pada ini report.

”Blocked by robots.txt” (terjemahan) “Blocked oleh robots.txt” vs “Indexed, though blocked by robots.txt” (terjemahan) “terindeks, though blocked oleh robots.txt”

ini dua mendapatkan conflated constantly, dan mereka’re yang sama penyebab dengan opposite outcomes:

Blocked oleh robots.txtterindeks, though blocked oleh robots.txt
Report bucketExcluded (tidak terindeks)Warning (terindeks)
Apa happenedGoogle ditemukan URL, tidak crawl ini, tidak pengindeksan iniGoogle terindeks URL despite tidak crawling ini
MengapaDisallow worked, tidak ada apa pun forced pengindeksanDisallow worked, tetapi tautan/sinyal terindeks ini anyway
adalah ini biasanya sebuah masalah?Tidak — typically intentionalBergantung — sering fine untuk utility URLs

jika Anda’re staring di warning versi — sebuah blocked URL itu mendapat terindeks anyway, menunjukkan sebagai sebuah bare URL dengan Tidak deskripsi — itu’s terindeks-though-blocked case, dan ini adalah handled di -nya own tulis-up. ini artikel adalah tentang plain exclusion: blocked, dan tidak terindeks.

untuk utility URLs, “indexed anyway” (terjemahan) “terindeks anyway” adalah sering tidak ada apa pun untuk worry tentang. John Mueller, addressing sebuah situs owner milik siapa WooCommerce ?add-to-cart= URLs showed up sebagai terindeks-though-blocked, mengatakan Anda tidak perlu itu URLs terindeks, itu blocking them dengan robots.txt adalah fine, dan itu bahkan jika mereka mendapatkan “indexed” (terjemahan) “terindeks” sementara blocked, mereka’re unlikely untuk sebenarnya surface di penelusuran unless seseorang berjalan sebuah very spesifik kueri untuk itu URLs — yang pengguna nyata jangan.

noindex + disallow conflict ( #1 perbaiki itu backfires)

Di sini’s trap. Seseorang ingin sebuah halaman hilang, so mereka Disallow ini di robots.txt dan tambahkan sebuah noindex meta tag — belt dan suspenders. ini tidak berfungsi, karena dua instructions contradict setiap lainnya.

Google status aturan secara langsung: “For the noindex rule to be effective, the page or resource must not be blocked by a robots.txt file, and it has to be otherwise accessible to the crawler.” (terjemahan) “Agar aturan noindex efektif, halaman atau resource tidak boleh diblokir oleh berkas robots.txt dan harus tetap dapat diakses crawler.” Jika halaman adalah disallowed, Google tidak pernah melakukan crawl ini, tidak pernah sees noindex, dan halaman dapat stay terindeks. sebagai I’ve ditulis di my artikel pada “Indexed, though blocked by robots.txt” (terjemahan) “terindeks, though blocked oleh robots.txt”: unless Google dapat crawl sebuah halaman, ini tidak akan see noindex tag dan dapat masih indeks ini karena ini memiliki tautan.

So deindex sequence adalah opposite dari apa orang reach untuk:

  1. Izinkan crawling dari URL (hapus Disallow).
  2. sajikan noindex (meta robots tag atau X-Robots-Tag header) dan let Google re-crawl untuk see ini.
  3. Leave halaman dapat di-crawl dengan noindex di place setelah ini adalah dropped. Re-blocking ini afterward tidak sebuah safe “finishing move” (terjemahan) “finishing move” — jika Anda disallow URL again, Google dapat lose visibilitas ke noindex aturan pada berikutnya crawl, dan sebuah blocked-tetapi-ditautkan URL dapat mendapatkan terindeks again dari lainnya halaman’ tautan, yang adalah tepat “indexed, though blocked” (terjemahan) “terindeks, though blocked” outcome Anda adalah trying untuk hindari. jika crawl budget pada dihapus halaman adalah sebuah nyata concern, itu’s sebuah case untuk authentication atau deletion (404/410) — tidak sebuah kembalikan trip melalui robots.txt.

untuk urgent removals, Search Console Removals alat, password protection, atau sekadar deleting halaman (returning 404/410) adalah lebih cepat routes.

cara temukan yang aturan adalah blocking URL

Three alat, setiap melakukan sebuah berbeda job — jangan expect satu untuk melakukan others’ berfungsi:

  • pemeriksaan URL (GSC). Paste spesifik URL. ini tells Anda apakah itu URL adalah saat ini blocked dan adalah quickest per-URL periksa.
  • robots.txt report (GSC). sebuah domain-property-tingkat monitoring report — tidak sebuah editable tester — menunjukkan robots.txt files Google ditemukan untuk Anda top hosts, terakhir-fetched time, fetch status, dan apa pun parsing warnings, plus sebuah “request a recrawl” (terjemahan) “permintaan sebuah recrawl” tindakan setelah Anda perubahan file. ini tells Anda Google dapat see Anda file; ini tidak test individual URLs terhadap ini.
  • sebuah robots.txt validator atau Google’s open-sumber robots.txt parser. untuk see yang line matches sebuah diberikan URL, jalankan ini melalui sebuah validator — karena longest, sebagian besar spesifik matching aturan wins (dan sebuah Allow dapat override sebuah lebih luas Disallow).
Evidence for this claim The current Search Console robots.txt report shows fetched files, history, fetch status, and parsing issues and can request a file recrawl; for a specific URL Google points to URL Inspection, a validator, or its open-source robots library rather than an editable legacy GSC tester. Scope: robots.txt diagnosis Confidence: high · Verified: Unblock a page blocked by robots.txt

setelah Anda’ve ditemukan offending line, perbaiki bergantung pada di mana Anda robots.txt lives. jika Anda control file secara langsung, hapus atau correct aturan (dan mind syntax). jika Anda’re pada sebuah hosted platform like Wix, Shopify, atau Squarespace, Anda dapat perlu untuk ikuti itu provider’s spesifik docs untuk perubahan ini, since beberapa platforms manage robots.txt untuk Anda.

My own experiment: apa happens ketika Anda block sebuah halaman Anda wanted terindeks

genuinely berguna pertanyaan adalah: jika Anda accidentally block sebuah halaman itu seharusnya peringkat, bagaimana buruk adalah ini? I ran itu test secara langsung. pada January 30, 2023 I blocked dua dari kami sebenarnya-peringkat halaman — “Top Bing Searches” (terjemahan) “Top Bing Searches” dan “Top YouTube Searches” (terjemahan) “Top YouTube Searches” — dengan robots.txt dan tracked apa happened.

damage adalah nyata tetapi lebih kecil daripada I yang diharapkan. kami lost sebuah position di sini atau di sana (sebuah sedikit keywords slipped satu atau dua spots, sebuah couple bahkan gained), dan kami lost semua featured snippets untuk itu halaman sementara mereka adalah blocked — mereka came back setelah I unblocked. SERP appearance degraded too: Google showed “no information is available for this page” (terjemahan) “Tidak informasi adalah tersedia untuk ini halaman” alih-alih deskripsi meta, dan lost kami custom judul. dan karena listing looked worse, clicks dropped lebih daripada impressions melakukan — CTR took hit.

My summary di time: “We lost a position here or there and all of the featured snippets for the pages. I expected a lot more impact, but the world didn’t end.” (terjemahan) “kami lost sebuah position di sini atau di sana dan semua dari featured snippets untuk halaman. I yang diharapkan sebuah lot lebih impact, tetapi world tidak end.” dan takeaway I’d masih stand behind: jangan block halaman Anda ingin terindeks. ini hurts. Tidak sebagai buruk sebagai Anda mungkin think — tetapi ini masih hurts. itu’s right mental frame untuk ini report. jika semuanya di Anda “Blocked by robots.txt” (terjemahan) “Blocked oleh robots.txt” bucket adalah stuff Anda dimaksudkan untuk block, Anda’re fine. jika sebuah halaman Anda care tentang adalah di di sana, mendapatkan ini out.

Satu cakupan note pada ini experiment: keduanya halaman adalah sudah peringkat dan terindeks sebelum I blocked them, so apa I diukur adalah apa happens ketika sebuah terindeks halaman mendapatkan pushed ke “indexed, though blocked” (terjemahan) “terindeks, though blocked” state — tidak apa happens untuk sebuah URL itu adalah tidak pernah terindeks dan adalah sekadar sitting di ini exclusion bucket. jika sebuah URL di sini adalah tidak pernah terindeks untuk begin dengan, unblocking ini hanya lets Google crawl dan pertimbangkan ini biasanya; ada Tidak featured-snippet atau CTR history untuk lose, karena ini adalah tidak pernah di sana.

decision tree

  • melakukan Anda berarti untuk block ini? → Leave ini. berfungsi sebagai yang dimaksud.
  • Tidak — Anda ingin ini terindeks? → hapus/loosen robots.txt aturan, lalu permintaan pengindeksan.
  • Anda ingin ini hilang dari Google? → jangan gunakan disallow. Izinkan crawling + noindex (atau Removals alat / delete), lalu leave ini dapat di-crawl — re-blocking ini afterward dapat hide noindex aturan again.
  • ini adalah sebuah blocked URL itu mendapat terindeks anyway? → itu’s terindeks-though-blocked case, tidak ini satu — tangani ini di sana.
  • ** halaman memiliki sensitive atau privat konten?** → robots.txt tidak sebuah access control; ini adalah sebuah permintaan bot dapat ignore. gunakan authentication atau password protection, tidak sebuah disallow.

crawl-vs-indeks principle adalah universal, oleh cara: Bing honors robots.txt untuk crawling yang sama cara, dan menghapus sebuah URL dari Bing similarly menggunakan -nya Block URLs alat atau sebuah noindex pada sebuah dapat di-crawl halaman — tidak sebuah bare disallow.

untuk lebih luas file itself — syntax, wildcards, di mana ini lives, dan apa ini dapat dan dapat’t melakukan — see robots.txt guide. untuk bagaimana pengindeksan decisions mendapatkan dibuat upstream, see pengindeksan hub.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.