발견됨 - 현재 색인이 생성되지 않음

Google Search Console의 발견됨 상태 의미, 크롤링됨 상태와의 차이, 크롤 용량·수요 원인과 확장 가능한 해결 방법을 설명합니다.

최초 게시: 2026년 6월 23일 · 최근 업데이트: 2026년 8월 9일 · Advanced
언어
이 페이지의 근거 신호 1개

발견됨 - 현재 색인이 생성되지 않음은 Google이 URL을 알지만 아직 크롤링하지 않은 상태이며 마지막 크롤 날짜가 비어 있습니다. 크롤링됨 상태는 이미 가져온 뒤 색인을 평가한다는 점이 다릅니다. 원인은 서버의 크롤 용량이나 페이지·사이트의 크롤 수요이며 내부 링크, 콘텐츠 품질, 크롤 낭비, 서버 안정성을 자체 데이터로 진단해야 합니다. 색인 생성 요청은 몇 URL을 재촉할 뿐 원인을 고치지 않고 크롤링돼도 색인은 보장되지 않습니다.

요약 — “발견됨 - 현재 색인이 생성되지 않음”은 Google이 URL을 찾았지만 크롤링하지 않은 상태입니다. 마지막 크롤 날짜가 비어 있다는 점이 가져온 뒤 보관하지 않은 “크롤링됨” 상태와 구분됩니다. Google이 설명하는 두 동인은 지금 크롤하면 서버에 부담이 생겨 미루는 크롤 용량과 사이트·페이지를 크롤할 가치가 낮다고 보는 크롤 수요입니다. 페이지별 버그보다 사이트 전체 패턴인 경우가 많습니다. 내부 링크, 콘텐츠 품질, 크롤 낭비 제거, 중요 페이지 링크로 수요를 먼저 고치고 대형 사이트는 서버 속도·안정성도 개선하세요. 색인 생성 요청은 몇 URL을 재촉할 뿐 확장되지 않고 원인을 해결하지 않습니다. 크롤링돼도 색인이 보장되지는 않습니다.

Google의 실제 정의

페이지 색인 생성 보고서는 “The page was found by Google, but not crawled yet. Typically, Google wanted to crawl the URL but this was expected to overload the site; therefore Google rescheduled the crawl. This is why the last crawl date is empty on the report.” (번역) Google이 페이지를 찾았지만 아직 크롤링하지 않았고 사이트 과부하가 예상돼 일정을 미뤘으므로 마지막 크롤 날짜가 비어 있다고 정의합니다. Evidence for this claim Google defines Discovered - currently not indexed as a page it found but has not yet crawled, with an empty last crawl date. Scope: Google Search Console Page Indexing status. Confidence: high · Verified: Google: Page indexing report 핵심 신호는 빈 마지막 크롤 날짜 = 한 번도 가져오지 않음입니다.

이는 크롤 전 대기열 상태입니다. 색인됐다가 제거된 것도 아니고 페널티를 받은 것도 아닙니다. 사이트맵, 내부 링크, 외부 링크에서 URL을 알게 됐지만 아직 가져오지 않았습니다.

발견됨과 크롤링됨 - 현재 색인이 생성되지 않음

두 상태는 근본 원인과 해결책이 반대이므로 정확히 구분해야 합니다. 비교표는 치트 시트 탭에 있으며 요약은 다음과 같습니다.

  • “Discovered – currently not indexed” (번역) 발견됨 - 현재 색인이 생성되지 않음 = 아직 가져오지 않음. 마지막 크롤 날짜가 비어 있으며 Google이 아직 크롤 비용을 쓰지 않은 우선순위·용량 신호입니다.
  • “Crawled – currently not indexed,” (번역) 크롤링됨 - 현재 색인이 생성되지 않음 = 가져왔지만 보관하지 않음. 마지막 크롤 날짜가 있고 중복, 얕은 콘텐츠, 다른 URL로의 캐노니컬 등 여러 원인이 가능한 색인 평가이지 단일 “품질 판정”은 아닙니다.
Evidence for this claim Google defines Discovered - currently not indexed as a page it found but has not yet crawled, with an empty last crawl date. Scope: Google Search Console Page Indexing status. Confidence: high · Verified: Google: Page indexing report

발견됨에서 벗어나도 색인이 보장되지 않습니다. 크롤링됨 - 현재 색인이 생성되지 않음으로 이동해 계속 머물 수 있습니다. 크롤링은 관문이지 보장이 아닙니다. Evidence for this claim Google says repeated recrawl requests for the same URL do not make crawling faster and recommends sitemaps for many URLs. Scope: URL Inspection request indexing; crawling still does not guarantee indexing. Confidence: high · Verified: Google: Ask Google to recrawl URLs

An empty Last Crawl field points upstream: Google knows the URL but has not spent a crawl on it yet. 출처: Google Search Console Help

Google knows the URL. On the highlighted Discovered currently not indexed branch, Google has not fetched it, the Last Crawl field is empty, and diagnosis focuses on crawl priority or capacity. On the Crawled currently not indexed branch, Google fetched the page but did not index it, the Last Crawl field has a date, and diagnosis focuses on index selection, page value, duplication, rendering, and conflicting signals.

© Patrick Stox LLC · CC BY 4.0 ·

페이지가 “발견됨”에 남는 이유

Google은 크롤 예산을 두 부분으로 설명하며 발견됨은 어느 한쪽 문제의 대표 증상입니다.

크롤 용량 — 서버

Google은 사이트에서 사용할 최대 동시 연결 수인 크롤 용량 한도를 서버 응답에 맞춰 계산합니다. 문서는 “Google’s crawlers calculate a crawl capacity limit, which is the maximum number of simultaneous parallel connections that Google can use to crawl a site,” (번역) Google 크롤러가 최대 병렬 연결 수를 계산한다고 설명하며, “if the site slows down or responds with server errors, the limit goes down and Google crawls less.” (번역) 사이트가 느려지거나 서버 오류를 반환하면 한도가 낮아진다고 합니다. 느린 응답, 시간 초과, 5xx 오류가 크롤을 제한하면 가져올 여유가 없어 URL이 발견됨에 쌓입니다.

크롤 수요 — 사이트 품질과 구조

다른 절반은 Google이 URL을 크롤하려는지입니다. 대부분의 발견됨 문제는 여기에 있습니다. 시스템은 URL 패턴, 내부 링크, 사이트 전체 품질에서 우선순위를 추정합니다. 페이지가 깊이 묻혀 있거나 고아이거나 저가치 유사 페이지 집합의 또 다른 사본처럼 보이면 수요가 약해 대기열에 남습니다.

Google의 대형 사이트 크롤 예산 안내는 “Sites with a large portion of their total URLs classified by Search Console as Discovered - currently not indexed.” (번역) 전체 URL 중 발견됨 비중이 큰 사이트를 명시적 대상으로 듭니다. 즉 발견됨을 용량+수요 제약과 연결합니다. 대상은 URL이 수백만 개인 사이트, 약 10 000-plus pages 규모로 빠르게 변하는 사이트, 발견됨 비중이 큰 사이트지만 이 수치는 정확한 기준이 아닌 대략적 분류입니다. 규모가 훨씬 작다면 하드 용량 한도의 증거가 아니라 배경 지식으로 보세요.

페이지별 버그보다 사이트 전체 신호인 경우가 많음

이는 Google이 빈도를 공개한 사실이 아니라 제가 관찰한 유용한 사고 모델입니다. 발견됨은 고립된 “페이지 X 결함”보다 URL 패턴과 사이트 품질을 바탕으로 한 페이지 범주의 낮은 크롤 우선순위를 뜻하는 경우가 많습니다. 다만 템플릿 동작에서 얻은 실무 추론이며 개별 페이지 상태가 이를 입증하지는 않습니다. John Mueller는 서버 과부하를 피한 용량 문제와 크롤할 가치가 낮다고 본 사이트 전체 품질을 주요 동인으로 설명했고, 자동 생성 URL 과다, 나쁜 내부 링크, 중요 페이지의 우선순위를 높이기 위한 사이트 강화도 언급했습니다. 이는 업계 보도를 통해 전달된 office-hours 발언의 의역이며 축자 녹취는 아닙니다.

규모도 영향을 줍니다. Gary Illyes가 약 90%의 사이트는 크롤 예산을 걱정할 필요가 없다고 말했다는 업계 인용이 널리 퍼져 있지만 저는 원본 녹음에서 독립 검증하지 않았으므로 확인된 통계가 아닌 근사로 보세요. 방향은 여전히 유용합니다. 소형·중형 사이트의 지속적인 발견됨 적체는 서버 벽보다 품질, 내부 링크, 크롤 낭비 같은 수요 문제일 가능성이 큽니다. 규모만으로 추정하지 말고 Crawl Stats와 로그로 확인하세요.

원인 진단 방법

수정 전에 용량 제약인지 수요 제약인지 구분하세요.

  • 용량 확인. GSC Crawl Stats의 평균 응답 시간, 호스트 상태, 응답 코드와 서버 로그의 느린 응답, 5xx, 시간 초과 급증을 봅니다. 서버가 Google을 제한한다면 용량 문제입니다.
  • 수요 확인. 내부 링크 깊이, 고아 페이지, 얕거나 중복·자동 생성된 사이트 전체 URL 패턴을 봅니다. 발견됨 URL이 깊고 고아이거나 유사 집합이면 수요 문제입니다.

“대부분 사이트는 X” 같은 빈도로 수정안을 고르지 마세요. URL 패턴 그룹, 서버 로그, Crawl Stats, 내부 링크 수, 사이트맵·인벤토리 범위, 비즈니스 중요도를 근거로 결정합니다. 보통 소형·중형은 수요, 초대형·전자상거래·프로그래매틱 사이트는 둘 다인 경우가 많지만 자체 데이터로 확인해야 합니다.

해결 방법

대부분 사이트에서 영향이 큰 순서로 정리합니다.

내부 링크 강화와 고아 페이지 수정

내부 링크는 통제 가능한 가장 강한 수요 지렛대입니다. 링크가 없거나 클릭 깊이가 큰 페이지가 발견됨에 많이 쌓입니다. 홈페이지, 허브, 주요 탐색 등 Google이 자주 크롤링하는 페이지에서 중요 URL을 연결하고 구조상 더 얕게 배치하세요.

콘텐츠 품질 개선, 얕고 중복된 페이지 통합

URL 패턴이 “낮은 가치”로 보인다면 페이지를 만드는 것은 도움이 되지 않습니다. Mueller의 요지는 사이트 품질을 개선하지 않고 색인 가능 페이지 수만 줄여도 사이트가 좋아지지는 않는다는 것입니다. 이는 축자 인용이 아닌 office-hours 답변의 의역입니다. 얕고 유사한 페이지를 통합하고 남길 페이지를 실제로 크롤할 가치가 있게 만드세요.

크롤 낭비 줄이기

패싯 탐색, URL 매개변수, 세션 ID, 소프트 404s, 무한 공간은 정크 URL에 크롤 용량을 써 실제 콘텐츠에 도달하지 못하게 하는 전형적인 “발견됨 공장”입니다. 전자상거래·프로그래매틱 사이트에서 특히 큽니다. 낭비를 줄이면 용량이 풀리고 URL 패턴의 품질 신호도 선명해집니다. 크롤 예산스파이더 트랩을 참고하세요.

서버 속도와 안정성 개선

용량 측면에서는 빠르고 안정적인 응답이 크롤 용량 한도를 높입니다. Google 문서대로 사이트가 느리거나 오류를 반환하면 크롤이 줄어듭니다. 5xx 오류와 시간 초과를 없애고 응답 시간을 줄이세요.

중요 페이지 링크 확보

외부 링크는 연결된 페이지의 크롤 수요를 천천히 높입니다. 실제로 중요한 페이지에 유효한 지렛대지만 즉시 작동하지 않으므로 백링크 하나가 하룻밤 사이 상태를 바꿀 것으로 기대하지 마세요.

”색인 생성 요청”을 쓸 때와 쓰지 않을 때

더 빨리 크롤되길 원하는 소수의 중요한 URL에 사용하세요. 수천 URL의 해결책으로 쓰면 안 됩니다. 확장되지 않으며 Google도 재제출할 필요가 없다고 명시합니다. 형제 상태인 크롤링됨에도 재크롤 제출이 필요 없고 발견됨도 같은 원리입니다. 요청은 대기열을 재촉할 뿐 우선순위가 낮아진 이유를 바꾸지 않습니다.

아무것도 하지 않아도 되는 경우

일부 발견됨은 정상적인 분류입니다. Google이 URL을 찾았지만 아직 우선순위를 주지 않았고 나중에 자체적으로 크롤할 수 있습니다. 저가치 URL 몇 개라면 그대로 둬도 됩니다. 크거나 중요한 비중이 발견됨에 갇혔을 때 아래의 용량·수요 문제를 고쳐야 합니다.

“크거나 중요한 비중”을 측정하려면 분모부터 정하세요. 페이지 색인 생성 보고서의 상태별 예시 목록은 1 000 URLs로 제한되고 전체를 보장하지 않습니다. 표본 내보내기만 쓰지 말고 보고서 수를 자체 사이트맵·URL 인벤토리와 비교하며 행 수보다 비즈니스 중요도와 트래픽 잠재력으로 우선순위를 정하세요.

대형·전자상거래·프로그래매틱 사이트의 특수 상황

수백만 URL, 패싯 탐색, 유사 제품 페이지, 무한 매개변수 공간은 Google이 크롤하려는 양보다 훨씬 많은 URL을 만들므로 많은 부분이 의도적으로 발견됨에 남습니다. 먼저 저가치 공간을 적절히 차단·통합하고 매개변수 폭증을 고쳐 크롤 낭비를 줄인 뒤, 내부 링크와 품질로 중요 URL 수요를 높이고 마지막으로 서버 용량을 개선하세요. 권위가 약한 신규 사이트도 낮은 수요 때문에 약한 페이지가 기다리는 완화된 형태를 겪습니다.

검색 파이프라인에서의 위치

발견됨은 페이지 색인 생성 보고서의 크롤 단계 상태이므로 해결책이 크롤 예산, 내부 링크, 색인 기본에 집중됩니다. 형제 상태인 크롤링됨 - 현재 색인이 생성되지 않음은 같은 좌절의 품질 단계 버전입니다. 상류의 URL 발견·가져오기는 크롤링, 하류는 색인을 참고하세요.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.