발견됨 - 현재 색인이 생성되지 않음
Google Search Console의 발견됨 상태 의미, 크롤링됨 상태와의 차이, 크롤 용량·수요 원인과 확장 가능한 해결 방법을 설명합니다.
언어
이 페이지의 근거 신호 1개
- 관련 라이브 도구Log File Analyzer
발견됨 - 현재 색인이 생성되지 않음은 Google이 URL을 알지만 아직 크롤링하지 않은 상태이며 마지막 크롤 날짜가 비어 있습니다. 크롤링됨 상태는 이미 가져온 뒤 색인을 평가한다는 점이 다릅니다. 원인은 서버의 크롤 용량이나 페이지·사이트의 크롤 수요이며 내부 링크, 콘텐츠 품질, 크롤 낭비, 서버 안정성을 자체 데이터로 진단해야 합니다. 색인 생성 요청은 몇 URL을 재촉할 뿐 원인을 고치지 않고 크롤링돼도 색인은 보장되지 않습니다.
Evidence for this claim Google defines Discovered - currently not indexed as a page it found but has not yet crawled, with an empty last crawl date. Scope: Google Search Console Page Indexing status. Confidence: high · Verified: Google: Page indexing report요약 — Google Search Console의 “Discovered – currently not indexed” (번역) “발견됨 - 현재 색인이 생성되지 않음”은 Google이 페이지를 찾았지만 아직 다운로드(크롤링)하지 않았다는 뜻이므로 검색에 표시될 수 없습니다. 마지막 크롤 날짜가 비어 있습니다. 보통 지금 크롤할 가치가 낮다고 판단했거나 서버에 부담을 줄 수 있어 미룬 상태입니다. 중요한 페이지에 쉽게 도달하고 크롤할 가치가 분명하도록 고쳐야지 “색인 생성 요청”을 반복해서 누르는 것으로는 해결되지 않습니다.
이 상태의 의미
Google Search Console의 페이지 색인 생성 보고서는 페이지를 상태별로 묶습니다. **“발견됨 - 현재 색인이 생성되지 않음”**은 Google이 URL을 알지만 실제로 크롤링하지 않은 항목입니다. Evidence for this claim Google defines Discovered - currently not indexed as a page it found but has not yet crawled, with an empty last crawl date. Scope: Google Search Console Page Indexing status. Confidence: high · Verified: Google: Page indexing report
페이지가 검색에 표시되기까지 거치는 세 단계를 기억하세요.
- 크롤 — Google이 페이지를 다운로드합니다.
- 색인 — 데이터베이스에 저장합니다.
- 게재(순위) — 검색할 때 표시합니다.
“발견됨” 페이지는 첫 단계 이전에 멈춰 있습니다. Google은 보통 사이트맵이나 링크에서 URL을 찾아 할 일 목록에 넣었지만 가져오지 않았습니다. URL 검사 도구에서 마지막 크롤 날짜가 비어 있는 것이 가장 분명한 신호입니다.
Evidence for this claim Google defines Discovered - currently not indexed as a page it found but has not yet crawled, with an empty last crawl date. Scope: Google Search Console Page Indexing status. Confidence: high · Verified: Google: Page indexing reportGoogle이 페이지를 “발견됨”으로 남기는 이유
쉽게 말하면 두 가지입니다.
- 사이트 과부하를 피하려고 합니다. 지금 더 크롤링하면 서버가 느려질 수 있으면 나중으로 일정을 미룹니다.
- 페이지가 지금 크롤할 가치가 낮다고 판단합니다. 사이트나 섹션이 얕고 중복되거나 도달하기 어려워 보이면 우선순위를 낮춥니다. 이는 가능한 진단일 뿐 상태만으로 입증되는 사실은 아닙니다.
”크롤링됨 - 현재 색인이 생성되지 않음”과의 차이
두 상태는 비슷해 자주 혼동되지만 차이는 크롤링 여부입니다.
- 발견됨 — Google이 아직 페이지를 가져오지 않았고 마지막 크롤 날짜가 비어 있습니다.
- 크롤링됨 - 현재 색인이 생성되지 않음 — Google이 가져왔지만 보관하지 않았고 마지막 크롤 날짜가 있습니다.
따라서 발견됨은 “아직 처리하지 않음”, 크롤링됨은 “검토했지만 보류” 문제입니다. 단계가 다르므로 해결책도 다릅니다.
실제로 도움이 되는 조치
- 이미 자주 크롤링되는 페이지에서 링크하세요. 홈페이지, 주요 탐색, 인기 글에서 연결합니다. 아무 링크도 없는 고아 페이지가 원인일 수 있습니다.
- 페이지를 실제로 유용하게 만들고 다른 페이지의 유사 사본이 되지 않게 합니다.
- XML 사이트맵에 제출하세요. 발견에는 도움되지만 우선순위를 보장하지 않습니다.
- 서버를 빠르고 안정적으로 유지하세요.
가장 흔한 오해
“색인 생성 요청”을 계속 누르는 것은 해결책이 아닙니다. 중요한 URL 몇 개를 재촉할 수는 있지만 수백·수천 페이지에는 확장되지 않고 Google이 우선순위를 낮춘 이유도 고치지 않습니다. 섹션 전체가 발견됨이라면 버튼 문제가 아니라 사이트 품질, 구조, 서버에 관한 신호입니다. Evidence for this claim Google says repeated recrawl requests for the same URL do not make crawling faster and recommends sitemaps for many URLs. Scope: URL Inspection request indexing; crawling still does not guarantee indexing. Confidence: high · Verified: Google: Ask Google to recrawl URLs
서버 문제와 품질 문제를 구분하고 확장 가능한 해결책을 보려면 고급 탭으로 전환하세요.
요약 — “발견됨 - 현재 색인이 생성되지 않음”은 Google이 URL을 찾았지만 크롤링하지 않은 상태입니다. 마지막 크롤 날짜가 비어 있다는 점이 가져온 뒤 보관하지 않은 “크롤링됨” 상태와 구분됩니다. Google이 설명하는 두 동인은 지금 크롤하면 서버에 부담이 생겨 미루는 크롤 용량과 사이트·페이지를 크롤할 가치가 낮다고 보는 크롤 수요입니다. 페이지별 버그보다 사이트 전체 패턴인 경우가 많습니다. 내부 링크, 콘텐츠 품질, 크롤 낭비 제거, 중요 페이지 링크로 수요를 먼저 고치고 대형 사이트는 서버 속도·안정성도 개선하세요. 색인 생성 요청은 몇 URL을 재촉할 뿐 확장되지 않고 원인을 해결하지 않습니다. 크롤링돼도 색인이 보장되지는 않습니다.
Google의 실제 정의
페이지 색인 생성 보고서는 “The page was found by Google, but not crawled yet. Typically, Google wanted to crawl the URL but this was expected to overload the site; therefore Google rescheduled the crawl. This is why the last crawl date is empty on the report.” (번역) Google이 페이지를 찾았지만 아직 크롤링하지 않았고 사이트 과부하가 예상돼 일정을 미뤘으므로 마지막 크롤 날짜가 비어 있다고 정의합니다. Evidence for this claim Google defines Discovered - currently not indexed as a page it found but has not yet crawled, with an empty last crawl date. Scope: Google Search Console Page Indexing status. Confidence: high · Verified: Google: Page indexing report 핵심 신호는 빈 마지막 크롤 날짜 = 한 번도 가져오지 않음입니다.
이는 크롤 전 대기열 상태입니다. 색인됐다가 제거된 것도 아니고 페널티를 받은 것도 아닙니다. 사이트맵, 내부 링크, 외부 링크에서 URL을 알게 됐지만 아직 가져오지 않았습니다.
발견됨과 크롤링됨 - 현재 색인이 생성되지 않음
두 상태는 근본 원인과 해결책이 반대이므로 정확히 구분해야 합니다. 비교표는 치트 시트 탭에 있으며 요약은 다음과 같습니다.
- “Discovered – currently not indexed” (번역) 발견됨 - 현재 색인이 생성되지 않음 = 아직 가져오지 않음. 마지막 크롤 날짜가 비어 있으며 Google이 아직 크롤 비용을 쓰지 않은 우선순위·용량 신호입니다.
- “Crawled – currently not indexed,” (번역) 크롤링됨 - 현재 색인이 생성되지 않음 = 가져왔지만 보관하지 않음. 마지막 크롤 날짜가 있고 중복, 얕은 콘텐츠, 다른 URL로의 캐노니컬 등 여러 원인이 가능한 색인 평가이지 단일 “품질 판정”은 아닙니다.
발견됨에서 벗어나도 색인이 보장되지 않습니다. 크롤링됨 - 현재 색인이 생성되지 않음으로 이동해 계속 머물 수 있습니다. 크롤링은 관문이지 보장이 아닙니다. Evidence for this claim Google says repeated recrawl requests for the same URL do not make crawling faster and recommends sitemaps for many URLs. Scope: URL Inspection request indexing; crawling still does not guarantee indexing. Confidence: high · Verified: Google: Ask Google to recrawl URLs
Google knows the URL. On the highlighted Discovered currently not indexed branch, Google has not fetched it, the Last Crawl field is empty, and diagnosis focuses on crawl priority or capacity. On the Crawled currently not indexed branch, Google fetched the page but did not index it, the Last Crawl field has a date, and diagnosis focuses on index selection, page value, duplication, rendering, and conflicting signals.
© Patrick Stox LLC · CC BY 4.0 ·
페이지가 “발견됨”에 남는 이유
Google은 크롤 예산을 두 부분으로 설명하며 발견됨은 어느 한쪽 문제의 대표 증상입니다.
크롤 용량 — 서버
Google은 사이트에서 사용할 최대 동시 연결 수인 크롤 용량 한도를 서버 응답에 맞춰 계산합니다. 문서는 “Google’s crawlers calculate a crawl capacity limit, which is the maximum number of simultaneous parallel connections that Google can use to crawl a site,” (번역) Google 크롤러가 최대 병렬 연결 수를 계산한다고 설명하며, “if the site slows down or responds with server errors, the limit goes down and Google crawls less.” (번역) 사이트가 느려지거나 서버 오류를 반환하면 한도가 낮아진다고 합니다. 느린 응답, 시간 초과, 5xx 오류가 크롤을 제한하면 가져올 여유가 없어 URL이 발견됨에 쌓입니다.
크롤 수요 — 사이트 품질과 구조
다른 절반은 Google이 URL을 크롤하려는지입니다. 대부분의 발견됨 문제는 여기에 있습니다. 시스템은 URL 패턴, 내부 링크, 사이트 전체 품질에서 우선순위를 추정합니다. 페이지가 깊이 묻혀 있거나 고아이거나 저가치 유사 페이지 집합의 또 다른 사본처럼 보이면 수요가 약해 대기열에 남습니다.
Google의 대형 사이트 크롤 예산 안내는 “Sites with a large portion of their total URLs classified by Search Console as Discovered - currently not indexed.” (번역) 전체 URL 중 발견됨 비중이 큰 사이트를 명시적 대상으로 듭니다. 즉 발견됨을 용량+수요 제약과 연결합니다. 대상은 URL이 수백만 개인 사이트, 약 10 000-plus pages 규모로 빠르게 변하는 사이트, 발견됨 비중이 큰 사이트지만 이 수치는 정확한 기준이 아닌 대략적 분류입니다. 규모가 훨씬 작다면 하드 용량 한도의 증거가 아니라 배경 지식으로 보세요.
페이지별 버그보다 사이트 전체 신호인 경우가 많음
이는 Google이 빈도를 공개한 사실이 아니라 제가 관찰한 유용한 사고 모델입니다. 발견됨은 고립된 “페이지 X 결함”보다 URL 패턴과 사이트 품질을 바탕으로 한 페이지 범주의 낮은 크롤 우선순위를 뜻하는 경우가 많습니다. 다만 템플릿 동작에서 얻은 실무 추론이며 개별 페이지 상태가 이를 입증하지는 않습니다. John Mueller는 서버 과부하를 피한 용량 문제와 크롤할 가치가 낮다고 본 사이트 전체 품질을 주요 동인으로 설명했고, 자동 생성 URL 과다, 나쁜 내부 링크, 중요 페이지의 우선순위를 높이기 위한 사이트 강화도 언급했습니다. 이는 업계 보도를 통해 전달된 office-hours 발언의 의역이며 축자 녹취는 아닙니다.
규모도 영향을 줍니다. Gary Illyes가 약 90%의 사이트는 크롤 예산을 걱정할 필요가 없다고 말했다는 업계 인용이 널리 퍼져 있지만 저는 원본 녹음에서 독립 검증하지 않았으므로 확인된 통계가 아닌 근사로 보세요. 방향은 여전히 유용합니다. 소형·중형 사이트의 지속적인 발견됨 적체는 서버 벽보다 품질, 내부 링크, 크롤 낭비 같은 수요 문제일 가능성이 큽니다. 규모만으로 추정하지 말고 Crawl Stats와 로그로 확인하세요.
원인 진단 방법
수정 전에 용량 제약인지 수요 제약인지 구분하세요.
- 용량 확인. GSC Crawl Stats의 평균 응답 시간, 호스트 상태, 응답 코드와 서버 로그의 느린 응답,
5xx, 시간 초과 급증을 봅니다. 서버가 Google을 제한한다면 용량 문제입니다. - 수요 확인. 내부 링크 깊이, 고아 페이지, 얕거나 중복·자동 생성된 사이트 전체 URL 패턴을 봅니다. 발견됨 URL이 깊고 고아이거나 유사 집합이면 수요 문제입니다.
“대부분 사이트는 X” 같은 빈도로 수정안을 고르지 마세요. URL 패턴 그룹, 서버 로그, Crawl Stats, 내부 링크 수, 사이트맵·인벤토리 범위, 비즈니스 중요도를 근거로 결정합니다. 보통 소형·중형은 수요, 초대형·전자상거래·프로그래매틱 사이트는 둘 다인 경우가 많지만 자체 데이터로 확인해야 합니다.
해결 방법
대부분 사이트에서 영향이 큰 순서로 정리합니다.
내부 링크 강화와 고아 페이지 수정
내부 링크는 통제 가능한 가장 강한 수요 지렛대입니다. 링크가 없거나 클릭 깊이가 큰 페이지가 발견됨에 많이 쌓입니다. 홈페이지, 허브, 주요 탐색 등 Google이 자주 크롤링하는 페이지에서 중요 URL을 연결하고 구조상 더 얕게 배치하세요.
콘텐츠 품질 개선, 얕고 중복된 페이지 통합
URL 패턴이 “낮은 가치”로 보인다면 페이지를 더 만드는 것은 도움이 되지 않습니다. Mueller의 요지는 사이트 품질을 개선하지 않고 색인 가능 페이지 수만 줄여도 사이트가 좋아지지는 않는다는 것입니다. 이는 축자 인용이 아닌 office-hours 답변의 의역입니다. 얕고 유사한 페이지를 통합하고 남길 페이지를 실제로 크롤할 가치가 있게 만드세요.
크롤 낭비 줄이기
패싯 탐색, URL 매개변수, 세션 ID, 소프트 404s, 무한 공간은 정크 URL에 크롤 용량을 써 실제 콘텐츠에 도달하지 못하게 하는 전형적인 “발견됨 공장”입니다. 전자상거래·프로그래매틱 사이트에서 특히 큽니다. 낭비를 줄이면 용량이 풀리고 URL 패턴의 품질 신호도 선명해집니다. 크롤 예산과 스파이더 트랩을 참고하세요.
서버 속도와 안정성 개선
용량 측면에서는 빠르고 안정적인 응답이 크롤 용량 한도를 높입니다. Google 문서대로 사이트가 느리거나 오류를 반환하면 크롤이 줄어듭니다. 5xx 오류와 시간 초과를 없애고 응답 시간을 줄이세요.
중요 페이지 링크 확보
외부 링크는 연결된 페이지의 크롤 수요를 천천히 높입니다. 실제로 중요한 페이지에 유효한 지렛대지만 즉시 작동하지 않으므로 백링크 하나가 하룻밤 사이 상태를 바꿀 것으로 기대하지 마세요.
”색인 생성 요청”을 쓸 때와 쓰지 않을 때
더 빨리 크롤되길 원하는 소수의 중요한 URL에 사용하세요. 수천 URL의 해결책으로 쓰면 안 됩니다. 확장되지 않으며 Google도 재제출할 필요가 없다고 명시합니다. 형제 상태인 크롤링됨에도 재크롤 제출이 필요 없고 발견됨도 같은 원리입니다. 요청은 대기열을 재촉할 뿐 우선순위가 낮아진 이유를 바꾸지 않습니다.
아무것도 하지 않아도 되는 경우
일부 발견됨은 정상적인 분류입니다. Google이 URL을 찾았지만 아직 우선순위를 주지 않았고 나중에 자체적으로 크롤할 수 있습니다. 저가치 URL 몇 개라면 그대로 둬도 됩니다. 크거나 중요한 비중이 발견됨에 갇혔을 때 아래의 용량·수요 문제를 고쳐야 합니다.
“크거나 중요한 비중”을 측정하려면 분모부터 정하세요. 페이지 색인 생성 보고서의 상태별 예시 목록은 1 000 URLs로 제한되고 전체를 보장하지 않습니다. 표본 내보내기만 쓰지 말고 보고서 수를 자체 사이트맵·URL 인벤토리와 비교하며 행 수보다 비즈니스 중요도와 트래픽 잠재력으로 우선순위를 정하세요.
대형·전자상거래·프로그래매틱 사이트의 특수 상황
수백만 URL, 패싯 탐색, 유사 제품 페이지, 무한 매개변수 공간은 Google이 크롤하려는 양보다 훨씬 많은 URL을 만들므로 많은 부분이 의도적으로 발견됨에 남습니다. 먼저 저가치 공간을 적절히 차단·통합하고 매개변수 폭증을 고쳐 크롤 낭비를 줄인 뒤, 내부 링크와 품질로 중요 URL 수요를 높이고 마지막으로 서버 용량을 개선하세요. 권위가 약한 신규 사이트도 낮은 수요 때문에 약한 페이지가 기다리는 완화된 형태를 겪습니다.
검색 파이프라인에서의 위치
발견됨은 페이지 색인 생성 보고서의 크롤 단계 상태이므로 해결책이 크롤 예산, 내부 링크, 색인 기본에 집중됩니다. 형제 상태인 크롤링됨 - 현재 색인이 생성되지 않음은 같은 좌절의 품질 단계 버전입니다. 상류의 URL 발견·가져오기는 크롤링, 하류는 색인을 참고하세요.
AI 요약
고급 버전을 압축하면 다음과 같습니다.
- 의미: Google이 URL을 찾았지만 크롤링하지 않은 GSC 상태이며 마지막 크롤 날짜가 비어 있습니다. 페널티가 아닌 크롤 전 대기열 상태입니다.
- 크롤링됨 상태와 차이: 발견됨은 아직 가져오지 않음인 우선순위·용량 신호, 크롤링됨은 가져온 뒤 여러 가능한 이유로 색인을 평가 중인 상태입니다. 발견됨에서 벗어나도 색인이 보장되지 않습니다.
- 두 근본 원인: 지금 크롤하면 서버 과부하가 생기는 크롤 용량과 페이지를 크롤할 가치가 낮은 크롤 수요입니다. Google의 크롤 예산 가이드는 대형·급변 사이트를 대상으로 하며 규모 수치는 정확한 컷오프가 아닌 근사입니다.
- 사이트 전체 패턴인 경우가 많습니다. URL 패턴과 전체 품질에서 우선순위를 추정한다는 실무 관찰이지 개별 URL 상태가 입증하는 사실은 아닙니다.
- 진단: 용량은 Crawl Stats와 로그, 수요는 내부 링크 깊이·고아·전체 품질로 확인합니다. Illyes의 약 90% 통계는 원본을 독립 검증하지 않은 업계 인용이므로 규모만 추정하지 말고 자체 데이터를 보세요.
- 수정: 내부 링크와 고아, 얕고 중복된 콘텐츠, 패싯·매개변수·소프트 404s·무한 공간의 크롤 낭비, 서버 속도, 중요 페이지 링크를 개선합니다.
- 색인 생성 요청은 몇 URL만 재촉하고 원인을 고치지 않으며 확장되지 않습니다. 품질 개선 없이 페이지 수만 줄이는 것도 도움이 되지 않습니다.
- 적체 측정: 보고서 예시는 상태별 1 000개로 제한되고 완전하지 않으므로 자체 URL 인벤토리를 분모로 비중을 계산하세요.
공식 문서
검색엔진의 1차 출처 문서입니다.
- 페이지 색인 생성 보고서 — “Discovered – currently not indexed” (번역) 발견됨과 “Crawled – currently not indexed,” (번역) 크롤링됨 등 모든 상태 정의.
- 크롤 예산 최적화 — 크롤 용량+수요 및 발견됨 비중이 큰 사이트를 명시한 문서.
- Google 검색 작동 방식 심층 가이드 — 크롤 → 색인 → 게재, URL 발견, 모든 페이지가 각 단계를 통과하지 않는 이유.
- 크롤링 및 색인 생성 — robots, 사이트맵, 크롤 낭비 제어 허브.
Bing / Microsoft
- Bing Webmaster Tools 도움말 — Bing은 동일한 발견됨 라벨을 쓰지 않으며 URL Inspection / Site Explorer에서 색인을 보고하고 크롤 할당량·콘텐츠 가치로 제어합니다. 인용 전 현재 용어를 확인하세요.
출처 인용문
Google의 공개 발언입니다. 각 링크는 출처의 인용 구절로 이동합니다.
Google — 정의(페이지 색인 생성 보고서)
- “Discovered - currently not indexed: The page was found by Google, but not crawled yet. Typically, Google wanted to crawl the URL but this was expected to overload the site; therefore Google rescheduled the crawl. This is why the last crawl date is empty on the report.” (번역) Google이 찾았지만 아직 크롤링하지 않았고 과부하 우려로 일정을 미뤘으므로 마지막 크롤 날짜가 비어 있습니다. — Google Search Console 도움말, 페이지 색인 생성 보고서. 인용문으로 이동
Google — 비교할 형제 상태
- “Crawled - currently not indexed: The page was crawled by Google but not indexed. It may or may not be indexed in the future; no need to resubmit this URL for crawling.” (번역) Google이 크롤링했지만 색인하지 않았으며 나중에 색인될 수도 있고 아닐 수도 있으므로 재제출할 필요가 없습니다. — Google Search Console 도움말, 페이지 색인 생성 보고서. 인용문으로 이동
Google — 크롤 용량(서버 측 제한 이유)
- “Google’s crawlers calculate a crawl capacity limit, which is the maximum number of simultaneous parallel connections that Google can use to crawl a site.” (번역) Google 크롤러는 사이트 크롤에 사용할 최대 동시 병렬 연결 수인 용량 한도를 계산합니다. — Google Search Central, 크롤 예산 최적화. 인용문으로 이동
- 같은 가이드는 “Sites with a large portion of their total URLs classified by Search Console as Discovered - currently not indexed.” (번역) 전체 URL 중 발견됨으로 분류된 비중이 큰 사이트에도 적용됩니다. 인용문으로 이동
”발견됨 - 현재 색인이 생성되지 않음” 분류 체크리스트
수정 전에 문제 유형을 확인하며 위에서 아래로 진행하세요.
- GSC URL 검사에서 상태를 확인합니다. 마지막 크롤 날짜가 비었나요? 비었다면 실제 발견됨입니다.
- 용량 확인: Crawl Stats의 평균 응답 시간·호스트 상태와 로그의 느린 응답, 시간 초과,
5xx급증을 검토합니다. - 수요 확인: URL이 고아이거나 구조상 깊은지 내부 링크 깊이를 매핑합니다.
- 품질 확인: 실제로 구별되는 페이지가 아니라 얕고 유사하거나 자동 생성된 URL 패턴인지 봅니다.
- 크롤 낭비 확인: 패싯 탐색, 매개변수, 세션 ID, 소프트 404s, 무한 공간이 URL 수를 부풀리는지 봅니다.
- 내부 링크: 중요 발견됨 페이지가 홈페이지·허브·탐색처럼 자주 크롤되는 곳에서 연결되고 깊지 않습니다.
- 사이트맵: 영향받은 URL이 XML 사이트맵에 있습니다. 발견에는 도움이 되지만 우선순위 지렛대는 아닙니다.
- 서버 상태: 빠르고 안정적인 응답이며
5xx/시간 초과를 최소화했습니다. - 범위 결정: 저가치 URL 몇 개면 둬도 되지만 크거나 중요한 비중이면 수요·용량 원인을 고칩니다.
- 색인 생성 요청은 대량 수정이 아니라 소수의 중요한 URL에만 씁니다.
사고 모델
1. 발견됨 = 찾았지만 가져오지 않음. 빈 마지막 크롤 날짜가 진단의 핵심입니다. 가져왔다면 발견됨이 아니라 크롤링됨입니다. 이후 판단이 모두 여기에 달렸으므로 먼저 정확히 구분하세요.
2. 용량과 수요. 발견됨에 머무는 이유는 Google이 서버 용량 때문에 크롤할 수 없었거나, 품질·링크·우선순위가 낮아 크롤하려 하지 않았기 때문입니다. 수정 전에 Crawl Stats·로그로 용량을, 링크 깊이·고아·사이트 품질로 수요를 진단하세요.
3. 페이지별 버그보다 사이트 전체 신호인 경우가 많음. Google이 URL 패턴과 전체 품질에서 크롤 우선순위를 추정한다는 것은 패턴 동작에 따른 실무 추론이지 상태가 개별 URL에 대해 입증하는 사실은 아닙니다. 한 페이지보다 페이지 범주의 신호인 경우가 많으므로 자체 데이터로 패턴을 확인한 뒤 패턴을 고치세요.
4. 크롤링은 관문이지 보장이 아님. 발견됨에서 벗어나도 한 번 가져올 기회를 얻을 뿐입니다. 크롤링됨 상태로 이동해 색인되지 않을 수 있으므로 크롤 단계뿐 아니라 품질 단계까지 계획하세요.
5. 소형·중형 사이트는 수요 제약인 경우가 더 많음. 실제 크롤 용량 한도는 주로 매우 큰 사이트에 영향을 줍니다. 작은 사이트라면 먼저 내부 링크와 품질을 확인하되 규모만 가정하지 말고 Crawl Stats와 로그로 검증하세요.
6. 색인 생성 요청은 재촉이지 치료가 아님. 몇 URL을 대기열 앞쪽으로 옮길 뿐 우선순위가 낮아진 이유를 바꾸지 않고 확장되지 않습니다. 구조적 지렛대로 원인을 해결하세요.
발견됨과 크롤링됨 — 수정 지도
발견됨과 크롤링됨 - 현재 색인이 생성되지 않음
| 발견됨 - 현재 색인이 생성되지 않음 | 크롤링됨 - 현재 색인이 생성되지 않음 | |
|---|---|---|
| 발생한 일 | 찾았지만 아직 가져오지 않음 | 가져왔지만 보관하지 않음 |
| 마지막 크롤 날짜 | 비어 있음 | 있음 |
| 단계 | 크롤 전(대기열) | 크롤 후(색인 결정) |
| 주요 신호 | 크롤 우선순위 / 용량 | 여러 원인이 가능한 색인 평가 |
| 일반 원인 | 약한 내부 링크, 크롤 낭비, 서버 부하, 낮은 수요 | 중복, 얕은 콘텐츠, 다른 URL로의 캐노니컬 등 |
| 첫 지렛대 | 내부 링크, 낭비 제거, 서버 속도 | 페이지 자체 개선·통합 |
| 재제출 필요? | 아니요(중요 URL 몇 개만 재촉) | 아니요 |
용량과 수요 — 어떤 문제인가요?
| 증상 | 가능한 원인 | 첫 수정 |
|---|---|---|
느린 Crawl Stats, 로그의 5xx/시간 초과 급증 | 크롤 용량 | 서버 속도·안정성 개선 |
| 고아이거나 깊이 묻힌 URL | 크롤 수요 | 내부 링크와 구조 개선 |
| 얕고 유사하며 자동 생성된 패턴 | 크롤 수요(품질) | 통합, 개선, 정리 |
| 수백만 패싯·매개변수 URL | 크롤 낭비 | 무한 공간과 매개변수 관리 |
| 작은 사이트, 발견됨 URL 몇 개 | 정상 분류 | 보통 그대로 둬도 됨 |
빠른 사실
- 발견됨은 두 상태를 구분하는 빈 마지막 크롤 날짜를 뜻합니다.
- Google의 두 동인은 크롤 용량 + 크롤 수요입니다.
- Gary Illyes가 약 90%의 사이트는 크롤 예산을 걱정할 필요가 없다고 말했다는 업계 인용은 독립 검증되지 않은 방향성 근사입니다. 소형·중형의 지속적인 발견됨은 용량보다 품질·링크 문제인 경우가 많습니다.
- 색인 생성 요청은 확장되지 않고 원인을 고치지 않으며 재제출할 필요가 없습니다.
- 크롤링돼도 색인이 보장되지 않습니다.
- 페이지 색인 생성 보고서 예시는 상태별 1 000개로 제한되고 완전하지 않으므로 표본이 아닌 자체 URL 인벤토리로 비중을 계산하세요.
Google이 이 URL을 크롤링하지 않은 이유는 무엇인가요?
Discovered – currently not indexed diagnosis
용량과 수요를 구분하는 도구
- 로그 파일 분석기 — Googlebot 요청 감소, 요청을 소비하는 URL 패턴, 오류 존재 여부를 확인합니다.
- Robots.txt 테스터 — 크롤 일정 문제로 보기 전에 접근 차단을 배제합니다.
- 사이트맵 검증기 — 중요 캐노니컬 URL 포함, 사이트맵 접근성과 구조를 검증합니다.
- 링크 분석기 — 페이지가 사이트맵에만 있지 않고 크롤 가능한 내부 경로를 갖는지 확인합니다.
검증 테스트
테스트: 내부 링크·사이트맵 수정 뒤 크롤 발생
테스트 — 내부 링크와 사이트맵 수정을 게시한 뒤 서버 로그 이력과 URL 검사 상태를 봅니다. 예상 결과 — Googlebot이 캐노니컬 URL을 요청하고 마지막 크롤 필드가 더 이상 비어 있지 않습니다. 실패 해석 — 발견·우선순위 신호가 여전히 약하거나 충돌 변형 또는 더 넓은 수요 문제가 있습니다. 관찰 기간 — 사이트의 정상 크롤 주기를 쓰고 비슷한 중요 페이지와 비교하며 즉시 방문을 가정하지 않습니다. 롤백 조건 — 새 링크가 의도치 않은 탐색이나 중복 URL 경로를 만들 때만 제거하고, 그렇지 않으면 발견을 되돌리지 말고 남은 신호를 진단합니다.
테스트: 서버 용량 수정 뒤 크롤 복구
테스트 — 서버 수정을 배포하고 로그의 Googlebot 요청량, 응답 시간, 오류 응답을 비교합니다. 예상 결과 — 이전 오류·지연 없이 성공 요청이 회복됩니다. 실패 해석 — 용량 제약이 남았거나 제한 요인이 용량이 아니라 수요입니다. 관찰 기간 — 여러 크롤 주기와 수정 전 기준선의 같은 요일·시간을 비교합니다. 롤백 조건 — 배포가 크롤러 대상 오류나 지연을 늘리면 되돌립니다.
문제 측정 방법
발견됨 - 색인되지 않음 수
지표 — 보고서 표본이 아니라 자체 사이트맵·URL 인벤토리를 분모로 한 제출 캐노니컬 URL의 수와 비중. 의미 — 적체가 Google의 크롤보다 빠르게 늘어나는지 보여 줍니다. 수집 — 페이지 색인 생성 보고서를 내보내 사이트맵·템플릿별로 나눕니다. 예시 목록은 상태별 1 000 URLs 제한이며 완전하지 않으므로 인구가 아닌 표본으로 봅니다. 기준/현실적 범위 — 템플릿별 기준선을 만들고 보편 비율보다 중요 인벤토리의 적체 감소를 목표로 합니다. 주기 — 수정 중 매주, 이후 매월.
발견부터 첫 크롤까지 걸린 시간
지표 — 게시·사이트맵 포함 시각부터 첫 Googlebot 요청까지의 경과 시간. 의미 — 우선순위·용량 변경이 일정을 개선하는지 보여 줍니다. 수집 — 게시·사이트맵 시각과 서버 로그 첫 요청을 결합합니다. 기준/현실적 범위 — 크롤 주기는 매우 달라 보편 기준 대신 자체 사이트의 같은 페이지 유형을 비교합니다. 주기 — 매월 또는 중요한 템플릿·서버 변경 뒤.
크롤러 성공과 낭비
지표 — 중요 URL 성공 요청 대비 오류와 저가치 URL 패턴. 의미 — 크롤 용량이 중요한 인벤토리에 쓰이는지 보여 줍니다. 수집 — 서버 로그를 상태 코드와 URL 패턴으로 나눕니다. 기준/현실적 범위 — 변경 전 구성을 기준으로 오류를 늘리지 않으면서 중요 비중이 개선돼야 합니다. 주기 — 진단 중 매주, 안정 후 매월.
적체 분석 프롬프트
템플릿 수준 원인 찾기
“발견됨 - 현재 색인이 생성되지 않음” URL 내보내기를 템플릿과 URL 패턴별로 묶으세요. 각 그룹의 사이트맵 포함, 내부 링크 수, 게시일, 서버 로그 최초 확인 데이터를 비교하고 용량, 크롤 낭비, 크롤 수요 가설을 근거순으로 정렬하세요. 필요한 근거가 없으면 원인을 단정하지 마세요.
수정 표본 우선순위 정하기
영향받은 URL에서 중요·저중요 페이지, 최신·오래된 페이지, 주요 템플릿을 포함한 대표 테스트 집합을 고르세요. 가설당 한 변경과 관찰 가능한 통과 신호·롤백 조건을 제안하세요. 데이터: [행 붙여넣기].
테스트
시간을 들일 가치가 있는 자료
제 관련 글
- “발견됨 - 현재 색인이 생성되지 않음” 수정 방법 — 크롤 예산, 콘텐츠 품질, 내부 링크, 백링크, 기술 문제의 다섯 진단 영역과 해결책을 검토한 Ahrefs 가이드.
- 기술 SEO 초보자 가이드 — 크롤링과 색인의 큰 그림.
공식 자료
- 페이지 색인 생성 보고서(Google) — 두 상태 정의의 출처.
- 크롤 예산 최적화(Google) — 크롤 용량+수요와 이 상태를 명시한 문서.
다른 자료
- Google의 “발견됨 - 현재 색인이 생성되지 않음” 수정 조언(Search Engine Journal) — Mueller의 용량 대 품질 설명 보도.
- “발견됨 - 현재 색인이 생성되지 않음” 이해와 해결(Search Engine Land) — Dan Taylor의 진단 절차.
- “발견됨 - 현재 색인이 생성되지 않음” 수정 방법(Onely) — 서버 로그를 포함한 용량 대 품질 심층 진단.
- Google의 발견됨 상태 설명(Search Engine Roundtable) — Google 담당자 발언에 관한 Barry Schwartz의 보도.
- r/TechSEO — 크롤·색인 디버깅 커뮤니티.
변경 내역
2026년 8월 9일에 업데이트됨.
편집 요약 및 기록된 변경 세부 정보입니다.변경 세부 정보
-
변경 세부 정보는 현재 영어로 제공됩니다.
전체 비교를 사용할 수 없음 — 이 수정에 대한 이전 스냅샷이 보관되지 않았습니다.
2026년 7월 17일에 업데이트됨.
편집 요약 및 기록된 변경 세부 정보입니다.변경 세부 정보
-
변경 세부 정보는 현재 영어로 제공됩니다.
-
변경 세부 정보는 현재 영어로 제공됩니다.
전체 비교를 사용할 수 없음 — 이 수정에 대한 이전 스냅샷이 보관되지 않았습니다.