Google 색인에서 페이지 제거하기(디인덱싱)

noindex, 404/410, 삭제 도구, 비밀번호 보호, 캐노니컬을 상황별로 선택하고 robots.txt가 페이지를 제거하지 못하는 이유를 설명합니다.

최초 게시: 2026년 7월 3일 · 최근 업데이트: 2026년 8월 22일 · Advanced
언어
이 페이지의 근거 신호 1개

디인덱싱은 URL을 Google 검색결과에서 제외하는 일입니다. 소유권, 일시·영구 여부, 콘텐츠 유지 여부에 따라 방법이 달라집니다. robots.txt Disallow는 크롤만 막고 색인을 제거하지 않으며 noindex와 결합하면 Google이 규칙을 볼 수 없어 역효과입니다. GSC 삭제 도구는 약 6개월짜리 긴급 조치이므로 noindex, 404/410, 비밀번호 보호 또는 중복 통합용 캐노니컬과 병행하세요. 이미지는 예외적으로 robots.txt가 공식 제거 방법입니다. 비소유자는 오래된 콘텐츠 새로고침과 Google 개인정보 삭제 도구를 문제에 맞게 구분해야 합니다.

요약 — 디인덱싱 방법은 소유권, 일시·영구 여부, 콘텐츠 유지 여부에 따라 달라집니다. 핵심은 robots.txt의 Disallow가 페이지를 디인덱싱하지 않는다는 것입니다. 이는 색인이 아니라 크롤링을 차단하므로 링크를 통해 URL이 색인될 수 있고 Google은 크롤할 수 없는 페이지의 noindex를 볼 수 없습니다. noindex와 함께 쓰면 역효과입니다. GSC 삭제 도구는 약 6개월짜리 긴급 조치일 뿐이므로 noindex, 404/410, 비밀번호 보호 또는 중복 통합용 캐노니컬과 병행하세요. 예외적으로 이미지 제거에는 robots.txt가 공식 방법입니다. 비소유자는 이미 오래되거나 제거된 콘텐츠에는 오래된 콘텐츠 새로고침을, 개인·민감 정보에는 별도 개인정보 삭제 문제 해결 도구를 사용합니다. 삭제 도구 외의 영구 방법은 모두 재크롤을 기다립니다.

“디인덱싱”의 실제 의미와 아닌 것

“Google에서 삭제”하는 단일 버튼은 없습니다. 디인덱싱은 상황별 작업이며 페이지 소유 여부, 일시 또는 영구 제거 여부, 사용자에게 콘텐츠를 계속 제공할지라는 세 질문으로 상황을 정의합니다. 이를 정하면 알맞은 방법이 대부분 분명해집니다.

처음부터 두 경로를 구분하는 것도 중요합니다.

  • 긴급 경로 — 유출 URL이나 노출된 개인정보를 빨리 숨겨야 합니다. 속성 소유자는 삭제 도구, 비소유자는 오래된 콘텐츠 새로고침 도구로 시간을 벌 수 있습니다.
  • 영구 경로 — 실제 수정은 noindex, 삭제(404/410), 비밀번호 보호, 캐노니컬화입니다. 긴급 도구는 만료되므로 긴급 조치 중이나 직후에 적용해야 합니다.

핵심 오해: robots.txt는 Google에서 페이지를 제거하지 않습니다

A noindex rule can work only when the crawler is allowed to fetch the page and see it. 출처: Google Search Central

Both paths start with a page that contains a noindex directive. When crawling is allowed, the crawler fetches the page, reads noindex, and can remove the URL from results after processing. When robots.txt blocks crawling, the crawler cannot see noindex, so the URL may remain in search results.

© Patrick Stox LLC · CC BY 4.0 ·

이 주제의 핵심이므로 자세히 살펴봅니다.

크롤링과 색인은 다른 시스템입니다

robots.txt크롤링 지시어이고 noindex색인 지시어입니다. 둘은 분리되어 있습니다. Google은 링크에서 발견한 URL을 크롤하지 않고도 색인할 수 있고, 크롤이 차단된 URL의 noindex 규칙은 절대 볼 수 없습니다. Evidence for this claim Blocking crawling with robots.txt is not a reliable way to remove a URL from Google Search. Scope: Google Search; a blocked URL can still be indexed without content when Google discovers it elsewhere. Confidence: high · Verified: Google Search Central: Introduction to robots.txt

Google의 noindex 문서는 “If the page is blocked by a robots.txt file or the crawler can’t access the page, the crawler will never see the noindex rule, and the page can still appear in search results, for example if other pages link to it.” (번역) robots.txt로 차단되거나 크롤러가 접근하지 못하면 noindex를 볼 수 없어 다른 페이지의 링크 등을 통해 검색결과에 나타날 수 있다고 명시합니다. 이유는 “We have to crawl your page in order to see <meta> tags and HTTP headers.” (번역) meta 태그와 HTTP 헤더를 보려면 페이지를 크롤해야 하기 때문입니다.

제 글 *Indexed, though blocked by robots.txt*에서도 같은 점을 설명합니다. 페이지 크롤을 막아도 Google은 링크 때문에 URL을 색인할 수 있으며, 페이지를 크롤할 수 없으면 noindex 메타 태그를 볼 수 없습니다.

Google 삭제 문서의 원문

Google의 사이트에서 호스팅하는 페이지를 Google에서 삭제 문서는 영구 제거 방법으로 콘텐츠 삭제·업데이트, 비밀번호 보호, noindex 추가를 제시한 뒤 “Don’t use robots.txt as a way to block your page.” (번역) 페이지 차단 방법으로 robots.txt를 쓰지 말라고 명시합니다.

“Indexed, though blocked by robots.txt” — Search Console 증상

robots.txt 방식을 시도했다면 Search Console의 “Indexed, though blocked by robots.txt” 상태를 봤을 수 있습니다. Google이 링크로 URL을 발견해 색인했지만 크롤은 허용되지 않은 상황입니다. 제 글은 실제 robots.txt 차단, 간헐적·캐시 차단, 사용자 에이전트별 차단, IP 기반 차단이라는 네 원인을 구분합니다. 추정하지 말고 진단하세요. Google이 UI 문구를 바꿀 수 있으므로 인용 전 실제 Search Console 속성에서 현재 레이블을 확인하세요.

robots.txt Disallow와 noindex를 함께 쓰면 역효과인 이유

가장 흔한 자해성 실패입니다. noindex와 robots.txt Disallow를 함께 추가하면 noindex가 작동하지 않습니다. Google의 *robots 메타 태그 문서*는 “If a page is disallowed from crawling through the robots.txt file, then any information about indexing or serving rules will not be found and will therefore be ignored. If indexing or serving rules must be followed, the URLs containing those rules cannot be disallowed from crawling.” (번역) robots.txt로 크롤이 금지되면 색인·게재 규칙을 찾지 못해 무시하며, 해당 규칙을 적용하려면 URL 크롤을 금지할 수 없다고 명시합니다.

규칙은 간단합니다. 페이지를 제거하려면 크롤 가능하게 두고 noindex를 추가하세요. 색인에서 빠진 것을 확인한 뒤 robots.txt 차단을 고려할 수는 있지만 링크 기반 재색인을 막지는 못합니다.

짧은 역사: 2019년 robots.txt의 noindex 지원 중단

예전에는 비공식 noindex: 지시어를 robots.txt에 넣기도 했습니다. 공식 표준이 아니고 일관되게 지원되지 않았으며 Google은 비공식 처리까지 종료했습니다. Gary Illyes의 2019년 7월 *robots.txt의 지원되지 않는 규칙 안내*는 “we’re retiring all code that handles unsupported and unpublished rules (such as noindex) on September 1, 2019.” (번역) 2019년 9월 1일에 noindex 같은 비공개·비지원 규칙 처리 코드를 모두 종료한다고 밝혔습니다. 제 Ahrefs 글도 같은 점을 설명합니다. Gary는 이 지시어가 “sticks out like a nun in a mosh pit.” (번역) 모시 피트의 수녀처럼 튄다고 표현했습니다.

긴급 제거: Search Console 삭제 도구

지금 바로 숨겨야 할 때 삭제 도구가 가장 빠릅니다. Google은 “For quick removals, use the Removals tool to remove a page hosted on your site from Google’s search results within a day.” (번역) 빠른 제거에는 삭제 도구를 사용해 하루 안에 검색결과에서 페이지를 제거하라고 설명합니다. John Mueller도 확인된 소유자에게 “it works very quickly”. (번역) 매우 빠르게 작동한다고 확인했습니다.

하지만 이는 수정이 아니라 긴급 분류이며 두 가지 한계가 명확합니다.

  • 일시적입니다. “Requests made in the Removals tool last for about 6 months.” (번역) 삭제 도구 요청은 약 6개월 지속됩니다. Search Console 도움말도 “A successful request lasts only about six months.” (번역) 성공한 요청은 약 6개월만 지속된다고 설명합니다. Evidence for this claim Search Console's Removals tool temporarily blocks a URL from Google Search and is not a permanent removal method. Scope: Google Search Console verified properties; permanent removal requires a separate lasting method. Confidence: high · Verified: Google Search Console Help: Removals tool and SafeSearch Reporting Tool
  • 크롤을 막거나 실제로 삭제하지 않습니다. “Blocking a URL does not prevent Google from crawling your page, only from showing it in Search results.” (번역) URL 차단은 페이지 크롤을 막지 않고 검색결과 표시만 막습니다.

따라서 영구 방법을 함께 적용하지 않으면 기간 만료 후 페이지가 돌아올 수 있습니다. 삭제 도구로 시간을 번 뒤 그 기간에 noindex, 삭제 또는 비밀번호 보호를 적용하세요.

Bing의 대응 도구

Bing에는 Block URLs 도구가 있습니다. Bing Webmaster Tools 인터페이스는 “This feature allows you to block a URL from appearing in the Bing search results. This block will remain in place for maximum of 90 days. If the URL still returns a 200 OK code when visited by our crawler after 90 days, it will reappear in our search results.” (번역) Bing 검색결과에서 URL을 최대 90일 차단하며 이후 크롤러 방문 시 200 OK를 반환하면 다시 표시된다고 설명합니다. 만료 8일 전에 경고하고 같은 URL 재차단 횟수 제한은 없습니다. Google은 약 여섯 달, Bing은 약 석 달입니다. Bing의 영구 제거 도움말은 클라이언트 렌더링이라 정확한 본문을 추출하지 못했으므로 아래 IndexNow 권고는 의역입니다.

영구 방법 1 — noindex(메타 태그 / X-Robots-Tag)

크롤이 허용된 경우 noindex는 색인에서 URL을 제거하는 가장 효과적인 방법입니다. 사용자와 직접 방문자에게 페이지를 유지하면서 검색엔진에는 목록에 넣지 말라고 알립니다. noindex 메타 robots 태그나 X-Robots-Tag 응답 헤더가 페이지를 색인에서 제거하라는 신호입니다.

구현 방법은 두 가지입니다.

  • HTML <head>메타 태그: <meta name="robots" content="noindex">.
  • <head>가 없는 PDF 같은 비HTML 파일용 X-Robots-Tag HTTP 헤더. Google은 “Any rule that can be used in a robots meta tag can also be specified as an X-Robots-Tag.” (번역) robots 메타 태그에 쓸 수 있는 규칙은 X-Robots-Tag에도 지정할 수 있다고 설명합니다.

가장 자주 놓치는 요건은 페이지를 계속 크롤 가능하게 두는 것입니다. robots.txt로 차단되면 Google이 태그를 볼 수 없습니다. Search Engine Journal에 소개된 Mueller의 두 단계 모델은 먼저 Google이 페이지에 접근할 수 있는지 확인하고, 그다음 noindex를 추가하라는 것입니다.

사용 시점: 감사 페이지, 내부 검색결과, 필터·패싯 변형, 빈약한 보관 페이지처럼 사용자나 직접·로그인 접근에는 유지하지만 검색에는 표시하지 않을 페이지.

영구 방법 2 — 콘텐츠 삭제(404/410)

콘텐츠가 더는 존재할 필요가 없다면 삭제하고 404(Not Found) 또는 410(Gone)을 반환하세요. Google은 두 상태 코드 모두 “mean that the page does not exist, which will drop such URLs from Google’s index once they’re crawled and processed.” (번역) 페이지가 존재하지 않음을 뜻하며 크롤·처리 후 Google 색인에서 URL을 제거한다고 설명합니다. 다시 크롤된 직후 색인에서 빠집니다.

404와 410: 둘 다 작동합니다. 410은 영구 삭제를 조금 더 명시해 약간 빠를 수 있지만 실무 차이는 작습니다. 410을 반환하면서 사용자에게 페이지를 계속 제공할 수는 없습니다. 사용자가 필요로 한다면 삭제가 아니라 noindex를 쓰세요.

사용 시점: 콘텐츠를 실제로 폐기했고 아무도 더는 필요로 하지 않을 때.

영구 방법 3 — 비밀번호 보호 / 로그인 장벽

인증 뒤에 페이지를 잠그는 것이 가장 확실한 제거 방식입니다. Google은 “Password-protect your page. Limiting access to your page enables the right users to view your page, while preventing Googlebot and other web crawlers from accessing it.” (번역) 적절한 사용자만 보게 하면서 Googlebot과 다른 크롤러의 접근을 막으려면 비밀번호로 보호하라고 설명합니다. 2019년 글도 구독·페이월 마크업을 쓰지 않는 한 로그인 뒤로 숨기면 일반적으로 색인에서 제거된다고 합니다.

모든 검색엔진의 모든 크롤러를 차단하고 인바운드 링크로 우회되지 않는다는 두 장점이 있습니다. 대신 자격 증명이 없는 모든 사용자도 차단합니다. 공개하려는 페이지가 아니라 실제 비공개 콘텐츠에 사용하세요.

사용 시점: 민감하거나 비공개이며 인증한 사용자만 볼 수 있어야 할 때.

캐노니컬 통합 — 관련되지만 제거는 아닙니다

캐노니컬 태그는 제거 도구가 아닙니다. 캐노니컬화는 통합입니다. 실제 중복 또는 거의 중복인 URL이 있을 때 rel="canonical"은 대표 버전을 알리고 순위 신호를 그곳에 합칩니다. 두 URL 모두 라이브이며 크롤 가능합니다.

Google은 사이트 내 중복의 캐노니컬을 관리하려고 noindex를 쓰지 말라고 권합니다. “We don’t recommend using noindex to prevent selection of a canonical page within a single site, because it will completely block the page from Search.” (번역) 페이지를 검색에서 완전히 차단하기 때문입니다. 같은 콘텐츠의 두 URL 중 하나를 유지하려면 캐노니컬을, 페이지 자체를 검색에서 완전히 빼려면 noindex를 쓰세요.

사용 시점: 실제 중복 URL의 신호를 한 URL로 통합할 때. 단순히 색인에서 빼고 싶은 페이지의 noindex 대체물로 쓰지 마세요.

이미지 제거 — 핵심 오해의 예외

이미지에는 robots.txt가 Google의 공식 제거 방법입니다. Google의 *이미지 제거 문서*는 “To prevent images from your site appearing in Google’s search results, add a robots.txt file to the root of the site that hosts the image.” (번역) 이미지가 Google 검색결과에 나타나지 않게 하려면 이미지 호스트 사이트 루트에 robots.txt를 추가하라고 설명합니다. 예시는 다음과 같습니다.

User-agent: Googlebot-Image
Disallow: /images/dogs.jpg

페이지와 달리 작동하는 이유는 Google 이미지 색인이 주로 이미지 파일 자체의 크롤에 의존하고 robots.txt가 이를 직접 차단하기 때문입니다. 일반 웹페이지는 크롤 없이 링크 발견만으로 색인될 수 있습니다. 이 오해는 이미지가 아니라 페이지에 관한 것입니다. Googlebot-Image 사용자 에이전트로 Google 이미지에서만 제거하거나 일반 Googlebot으로 모든 Google 표면에서 제거하세요.

이미지에는 X-Robots-Tag 대안도 있습니다. “Alternatively, you can remove images hosted on your site from Google’s search results by adding the noindex X-Robots-Tag to the HTTP response headers of the images you want to remove” (번역) 제거할 이미지 HTTP 응답 헤더에 noindex X-Robots-Tag를 추가할 수 있습니다. 이 경우 Googlebot이 규칙을 읽도록 이미지 URL 크롤을 허용해야 합니다. 두 방법의 효과는 같으므로 하나만 선택하세요.

페이지 비소유자 — 문제별로 다른 두 도구

앞의 방법은 페이지를 통제한다고 가정합니다. 통제하지 못하면 문제 유형에 따라 두 경로로 나뉩니다. 잘못 고르면 귀중한 긴급 대응 시간을 잃습니다.

페이지 콘텐츠가 오래됐거나 이미 사라졌지만 Google 스냅샷이 갱신되지 않았습니다. 오래된 콘텐츠 새로고침 도구를 사용하세요. Google은 “Use the Refresh Outdated Content tool to have Google update search results for pages or images that no longer exist, or pages that have deleted important (sensitive or critical) content.” (번역) 더는 존재하지 않는 페이지·이미지 또는 중요한 콘텐츠를 삭제한 페이지의 검색결과를 갱신하는 도구라고 설명합니다. 라이브 페이지에서 콘텐츠가 이미 사라졌거나 크게 바뀐 경우에만 작동하며 소유자가 계속 공개하려는 콘텐츠를 강제로 제거하지 못합니다. 로그인은 필요하지만 Search Console 인증은 필요 없습니다.

개인·민감 정보 문제이고 페이지가 여전히 라이브입니다. Google의 현재 지침은 다른 경로를 안내합니다. “If you don’t own the page, see Remove your personal information from Google instead.” (번역) 페이지를 소유하지 않으면 Google에서 개인 정보 삭제를 참고하라고 합니다. “if you don’t own the page” (번역) 페이지 비소유자라는 조건이 핵심입니다. 신상 털기, 노출된 ID·금융 정보, 비동의 노골적 이미지 등 개인정보 삭제 요청용 별도 문제 해결 도구입니다. 단순히 오래된 정보가 아니라 본인 정보가 노출됐다면 오래된 콘텐츠 새로고침보다 이 경로가 우선입니다. 현재 페이지 자체 푸터 기준 2025-12-10 업데이트 버전의 안내이므로 향후 표지 방식이 바뀔 수 있어 다시 확인하세요.

개인정보 문제가 아니라 실제로 오래됐거나 제거된 콘텐츠라면 오래된 콘텐츠 새로고침이 올바른 비소유자 도구입니다.

상황별 의사결정 체계

상황사용사용하지 말 것
사용자에게 유지하되 검색에서만 제외크롤 가능한 noindexrobots.txt
콘텐츠를 영구 폐기404 또는 410noindex
민감·비공개, 인증 사용자만 접근비밀번호 보호noindex
실제 중복 URL 둘 이상, 하나 유지rel="canonical"noindex
소유 페이지를 오늘 긴급히 숨김삭제 도구 → 영구 방법robots.txt
비소유 페이지의 오래되거나 제거된 콘텐츠오래된 콘텐츠 새로고침다른 도구
비소유 페이지의 개인·민감 정보“Google에서 개인 정보 삭제”오래된 콘텐츠 새로고침
이미지 제거robots.txt(Googlebot-Image 차단)페이지용 noindex 관행

대화형 안내는 의사결정 트리 탭을 참고하세요.

디인덱싱에 실제로 걸리는 시간

영구 방법은 즉시 적용되지 않습니다. Google이 URL을 다시 크롤해 noindex 태그나 404/410 상태를 확인해야 합니다. Google 문서상 하루 안에 숨기는 삭제 도구만 실제로 빠르며, 그래서 일시적이어도 긴급 선택지입니다. noindex 페이지가 계속 보이면 Google 설명대로 “probably because we haven’t crawled the page since you added the noindex rule.” (번역) 규칙을 추가한 뒤 아직 페이지를 크롤하지 않았을 가능성이 큽니다. URL 검사에서 색인·재크롤을 요청하면 앞당길 수 있습니다.

이 글의 위치

이 페이지는 색인 제어 클러스터의 실무 허브입니다. 각 지시어는 noindex, meta-robots, x-robots-tag, robots-txt, removals-tool, canonicalization, 404-vs-410, 410-gone 심층 글을 참고하세요. 발견부터 크롤링, 렌더링, 색인, 게재까지 전체 파이프라인은 검색 작동 방식 클러스터를 확인하세요. robots.txt 차단 뒤에도 색인된 경우 Indexed, though blocked by robots.txt가 직접적인 문제 해결 자료입니다.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.