Google에 색인되는 방법

사이트맵, 내부 링크, URL 검사 색인 요청, Indexing API와 IndexNow의 실제 범위, 그리고 콘텐츠 품질이 진짜 색인 관문인 이유를 설명합니다.

최초 게시: 2026년 7월 3일 · 최근 업데이트: 2026년 8월 9일 · Advanced
언어
이 페이지의 근거 신호 1개

색인된다는 것은 Google이 URL을 크롤하고 가치 있다고 판단해 결과에 사용할 수 있도록 저장했다는 뜻이며 순위의 전제 조건이지 순위 요소는 아닙니다. 크롤링과 색인은 별도 단계이고 일반적인 병목은 버튼이 아니라 품질입니다. 여러분은 깨끗한 XML 사이트맵, 실제 내부 링크, 소수 우선 URL의 색인 생성 요청으로 발견과 우선순위만 통제합니다. Indexing API는 JobPosting과 VideoObject 안의 BroadcastEvent만 공식 지원하고 기본 게시 요청은 하루 200건이며, IndexNow는 Google이 사용하지 않는 Bing/Yandex 프로토콜입니다. 어떤 것도 색인을 보장하지 않습니다.

요약 — 색인은 크롤 → 판단 → 저장이며 판단이 가장 어렵습니다. Google은 품질·유용성 기준을 통과한 URL만 색인하므로 색인 실패는 대개 기계적 문제가 아니라 콘텐츠 문제입니다. 여러분은 내부 링크, 깨끗한 XML 사이트맵, 우선 URL 몇 개의 URL 검사 색인 요청으로 발견과 크롤 우선순위에 영향을 줄 뿐 색인 결정을 통제하지 못합니다. 재제출은 필요 없고 품질 판단을 앞당기지도 않습니다. Google Indexing API는 공식적으로 JobPostingVideoObject 안의 BroadcastEvent만 지원하며 기본 게시 요청은 하루 200건입니다. IndexNow는 Bing/Yandex 프로토콜이며 Google은 사용하지 않습니다. 어떤 것도 색인을 보장하지 않습니다.

크롤링 ≠ 색인 — 전체 글의 핵심 관점

Discovery can earn a crawl; a successful crawl still does not guarantee indexing or ranking. 출처: Google Search Central

The pipeline moves from crawl, where a bot discovers and downloads a URL, to index, where the engine processes the page and decides whether to store it, to serve or rank, where indexed pages may be selected for a query. Indexing is highlighted as a separate decision between crawling and ranking.

© Patrick Stox LLC · CC BY 4.0 ·

대부분의 답답함은 두 단계를 하나로 생각하는 데서 옵니다. Google 파이프라인은 크롤, 색인, 게재의 세 단계이며 Google 표현대로 “not all pages make it through each stage.” (번역) 모든 페이지가 각 단계를 통과하지는 않습니다. URL은 크롤되고도 색인되지 않을 수 있으며 이는 오류가 아니라 Google의 편집 판단입니다. Evidence for this claim Google separates crawling, indexing, and serving and states that not every page makes it through each stage. Scope: Google Search; crawling does not guarantee indexing. Confidence: high · Verified: Google: How Search works

색인은 억지로 들어갈 수 있는 기계적 대기열이 아니라 품질 관문입니다. 색인됨은 순위의 전제 조건이지 순위 요소가 아닙니다. 색인 페이지도 순위가 낮거나 아무 검색에도 나오지 않을 수 있지만 비색인 페이지는 나타날 수 없습니다. 아래에서는 여러분이 통제하는 발견·크롤 우선순위와 Google이 통제하는 색인 결정을 구분합니다.

페이지가 색인되지 않는 이유: 빠른 진단

도구를 쓰기 전 기계적 차단을 배제하세요. 다음 경우 색인되지 않습니다.

  • noindex 메타 태그나 X-Robots-Tag 헤더가 있습니다.
  • robots.txt로 차단되어 Google이 콘텐츠를 읽지 못합니다. 링크가 있으면 콘텐츠 없이 URL만 색인될 수 있습니다.
  • rel="canonical"이 다른 URL을 가리켜 Google이 그 캐노니컬로 통합합니다. GSC에는 “적절한 캐노니컬 태그가 있는 대체 페이지” 또는 “중복, Google이 사용자와 다른 캐노니컬 선택”으로 나옵니다.
  • 내부 링크가 없는 고립 페이지입니다.
  • 4xx/5xx를 반환하거나 soft-404s입니다.
  • 주요 콘텐츠·링크가 JavaScript에 의존하고 Google 렌더러가 차단된 스크립트/CSS, 렌더 오류, 빈 앱 셸 때문에 실행하지 못합니다. 렌더링은 최초 크롤 뒤 별도 대기 단계라 가져왔어도 실제 콘텐츠를 못 볼 수 있습니다.
  • 콘텐츠가 빈약하거나 중복되거나 가치가 낮습니다. “크롤링됨 - 현재 색인이 생성되지 않음”의 가장 흔한 원인입니다.

앞의 여섯 문제가 아니라면 거의 확실히 품질 영역이며 반복 제출로 바뀌지 않습니다.

색인 생성 요청(URL 검사) — 개별 우선 URL용

Search Console URL 검사는 Google에 URL 하나의 재크롤을 요청합니다. Google은 “To request a crawl of individual URLs, use the URL Inspection tool. You must be an owner or full user of the Search Console property to be able to request indexing in the URL Inspection tool.” (번역) 개별 URL은 URL 검사 도구를 사용하며 속성 소유자 또는 전체 사용자여야 한다고 설명합니다.

Evidence for this claim Google's URL Inspection request is for individual URLs, has a quota, does not crawl faster when repeated, and does not guarantee inclusion. Scope: Google Search Console request indexing workflow. Confidence: high · Verified: Google: Ask Google to recrawl URLs

세 가지를 기억하세요.

  • 할당량이 있고 반복해도 소용없습니다. “There’s a quota for submitting individual URLs and requesting a recrawl multiple times for the same URL won’t get it crawled any faster.” (번역) 개별 URL 제출에는 할당량이 있으며 같은 URL 재크롤을 반복 요청해도 빨라지지 않습니다. Google은 2018년 기존 도구에서 남은 제출 수 표시를 없앴고 정확한 일일 숫자는 비공개입니다. 신뢰가 낮은 속성에서 10–15건 정도라는 실무 관찰은 공식 수치가 아닌 일화입니다.
  • 아무것도 보장하지 않습니다. “Requesting a crawl does not guarantee that inclusion in search results will happen instantly or even at all. Our systems prioritize the fast inclusion of high quality, useful content.” (번역) 크롤 요청은 즉시 또는 향후 검색 포함을 보장하지 않으며 고품질 유용한 콘텐츠를 우선합니다. 크롤에는 며칠에서 몇 주가 걸릴 수 있습니다. Evidence for this claim Google's URL Inspection request is for individual URLs, has a quota, does not crawl faster when repeated, and does not guarantee inclusion. Scope: Google Search Console request indexing workflow. Confidence: high · Verified: Google: Ask Google to recrawl URLs
  • 소수 URL용이지 대량용이 아닙니다. Google은 많은 페이지라면 사이트맵을 제출하라고 안내합니다. “크롤링됨 - 현재 색인이 생성되지 않음” 상태에는 “no need to resubmit.” (번역) 재제출할 필요가 없다고 명시합니다.

Google 담당자들이 반복해 온 결론은 버튼을 강박적으로 누르기보다 사이트맵과 내부 링크 같은 비수동 채널을 우선하라는 것입니다.

깨끗한 XML 사이트맵 제출·유지

사이트맵은 발견 보조 수단일 뿐입니다. Google은 “A sitemap helps search engines discover URLs on your site, but it doesn’t guarantee that all the items in your sitemap will be crawled and indexed.” (번역) 사이트맵은 URL 발견을 돕지만 모든 항목의 크롤·색인을 보장하지 않는다고 설명합니다.

Evidence for this claim A sitemap can help discovery but does not guarantee that listed URLs will be crawled or indexed. Scope: official Google documentation, Search Console and production URL verification Confidence: high · Verified: What is a sitemap

실제로 필요한 경우. 사이트가 크거나, 새로워 외부 링크가 적거나, 미디어·동영상·뉴스가 많다면 필요할 가능성이 큽니다. 홈페이지 링크를 따라 모든 중요 페이지에 도달할 수 있고 약 500페이지 이하이며 미디어·뉴스가 많지 않다면 없어도 될 수 있습니다. 새 사이트는 Googlebot이 기존 페이지와 백링크에 의존해 새 URL을 발견하므로 구조적으로 느립니다.

크기 제한. 사이트맵 한 파일은 압축 해제 기준 50MB 또는 URL 50 000개까지입니다. 넘으면 여러 파일로 나누고 사이트맵 색인 파일에서 참조하세요.

색인율 감사. 페이지 색인 보고서를 사이트맵으로 필터링해 제출 URL 중 실제 색인 수를 봅니다. 큰 차이는 재제출 이유가 아니라 품질·구조 신호입니다. 비캐노니컬·저가치 URL을 넣으면 크롤 관심을 낭비하고 보고가 흐려지므로 캐노니컬이며 색인 가능한 URL만 나열하세요.

내부 링크 수정

가장 기초적이지만 가장 자주 놓치는 수단입니다. Google은 “Every page you care about should have a link from at least one other page on your site.” (번역) 중요한 모든 페이지에는 사이트의 다른 페이지에서 링크가 하나 이상 있어야 한다고 말합니다. 고립 페이지는 신규·대형 사이트 모두에서 비색인의 대표 원인입니다.

색인에 중요한 세부 사항은 다음과 같습니다.

  • 링크는 크롤 가능해야 합니다. onClick이나 JS 전용 탐색이 아니라 실제 <a href>여야 합니다.
  • 중요 페이지를 얕게 두세요. 크롤러는 사람처럼 검색창이나 메뉴를 해석하지 않으므로 홈페이지에서 몇 번의 클릭 안에 도달해야 합니다.
  • 중복이 아니라 캐노니컬 URL에 링크하세요. 선호 버전으로 일관된 내부 링크는 Google의 캐노니컬 이해를 강화합니다.
  • 앵커 텍스트가 도움 됩니다. Google은 “Paying more attention to the anchor text used for internal links can help both people and Google make sense of your site more easily and find other pages on your site.” (번역) 내부 링크 앵커를 신경 쓰면 사람과 Google이 사이트를 이해하고 다른 페이지를 찾기 쉽다고 설명합니다.

Google Indexing API의 실제 용도

가장 오해가 큰 도구입니다. Indexing API는 범용 빠른 색인 엔드포인트가 아닙니다. Google 문서는 “The Indexing API can only be used to crawl pages with either JobPosting or BroadcastEvent embedded in a VideoObject.” (번역) 채용 공고 또는 동영상 객체 안의 실시간 이벤트 페이지만 크롤할 수 있다고 명시합니다.

  • 범위: 채용 공고와 실시간 스트림 이벤트 페이지뿐입니다. 일반 글·제품·카테고리는 범위 밖입니다.
  • 할당량: 프로젝트당 기본 게시 요청은 하루 200건(URL_UPDATEDURL_DELETED 합산), 읽기 전용은 분당 180건, 전체 엔드포인트는 분당 380건입니다. Google 원문은 “the quota may increase or decrease based on the document quality,” (번역) 문서 품질에 따라 할당량이 늘거나 줄 수 있다고 설명하며 증액 요청도 두 지원 사례로 제한합니다.
  • 다른 콘텐츠에 쓰는 위험: 비지원 페이지에서 일시 작동해 보여도 언제든 중단될 수 있습니다. Search Relations 팀은 지원되지 않으며 비지원 형식 접근을 예고 없이 끊을 수 있다고 했습니다. 이를 색인 전략으로 삼는 것은 불안정합니다.

실제 채용 공고나 실시간 스트림을 게시한다면 두 유형에는 훌륭하고 빠르지만 나머지에는 잘못된 도구입니다.

IndexNow — 실제로 유용하지만 Google 도구는 아님

IndexNow에는 Google이 포함되지 않습니다. Microsoft Bing과 Yandex가 2021년 10월 시작한 개방 프로토콜로 URL 변경 시 참여 엔드포인트에 알리고 엔진끼리 공유합니다. Bing은 Yandex, LinkedIn, Yahoo, eBay, Etsy, GitHub, Wix, Cloudflare, Yoast, RankMath 등을 참여자로 나열하지만 Google은 없습니다.

IndexNow는 Bing, Yandex 및 참여 엔진이 변경 URL을 더 빨리 발견하게 합니다. Google 색인에는 직접 효과가 전혀 없습니다. IndexNow 제출 뒤 Google이 색인하지 않는 것은 오류가 아니라 범주 착오입니다.

참여 엔진에서도 발견 알림일 뿐 색인 보장은 아닙니다. 문서는 “The HTTP 200 response code only indicates that the search engine has received your URL.” (번역) HTTP 200은 검색엔진이 URL을 받았다는 뜻일 뿐이라고 설명합니다. 색인됐다는 뜻이 아닙니다.

구현할 가치는 있습니다. 키 파일을 호스팅하고 엔드포인트에 알리면 되어 비용이 낮고 Bing/Yandex 발견을 실제로 앞당깁니다. Google 효과만 기대하지 마세요.

진짜 관문: 콘텐츠 품질

도구를 걷어내면 병목은 거의 항상 품질입니다. Google의 비색인 상태 설명은 기계적이라기보다 편집 판단입니다.

  • “Crawled – currently not indexed: The page was crawled by Google but not indexed. It may or may not be indexed in the future; no need to resubmit this URL for crawling.” (번역) 페이지는 크롤됐지만 색인되지 않았으며 향후 색인될 수도 있고 아닐 수도 있으므로 재제출할 필요가 없습니다.
  • “Discovered – currently not indexed: The page was found by Google, but not crawled yet. Typically, Google wanted to crawl the URL but this was expected to overload the site; therefore Google rescheduled the crawl.” (번역) URL을 발견했지만 아직 크롤하지 않았고 사이트 과부하가 예상되어 크롤을 다시 예약한 경우가 일반적입니다.

Google 담당자들은 “발견됨/크롤링됨 - 현재 색인이 생성되지 않음”을 가치 판단으로 설명해 왔습니다. John Mueller의 요지는 Google이 더 많이 색인할 가치가 있다고 확신하게 해야 하며, 아직 색인되지 않은 URL을 이해하지 못하므로 사이트 나머지를 통해 잠재적 맥락을 판단한다는 것입니다. 여러 공개 발언에서 필요한 것을 “awesomeness”, 즉 실제로 훌륭한 페이지라고 압축했습니다.

실무에서는 빈약함, 거의 중복, 공이 적거나 대량 생성된 페이지, 기존의 더 좋은 페이지와 크게 겹치는 페이지가 주된 원인입니다. 재제출 대신 통합하거나 개선하세요.

크롤 예산은?

대부분 사이트에서 크롤 예산은 색인 문제의 잘못된 단서입니다. Gary Illyes는 대부분 걱정할 필요가 없으며 매주 바뀌는 약 1M+ 페이지 또는 매일 10k+ 페이지 같은 대규모에서 실제 제약이 된다고 설명했습니다. 소·중규모 사이트의 비색인은 예산보다 품질·구조일 가능성이 큽니다.

색인 소요 시간과 관찰

며칠에서 몇 주가 정상입니다. 새롭거나 권위가 낮은 사이트는 Google이 기존 페이지와 백링크로 URL을 발견·평가하므로 더 느립니다. 초기에는 품질 백링크 몇 개와 깨끗한 사이트맵의 효과가 큽니다. 버튼을 반복 누르지 말고 페이지 색인 보고서로 전체를, URL 검사로 개별 URL을 관찰하세요. 인내와 개선이 더 낫습니다.

이 글의 위치

이 글은 비색인 상태를 읽는 페이지 색인 보고서의 실행 안내입니다. 검색 작동 방식 중 색인 단계에 속하며 캐노니컬화는 중복 클러스터에서 어떤 URL을 색인할지, XML 사이트맵과 내부 링크는 발견 경로를, 크롤 예산은 드물게 겹치는 효율 문제를 다룹니다. 발견, 크롤링, 렌더링, 색인, 게재 전체는 검색 작동 방식 클러스터를 참고하세요.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.