Meta Robots 태그
robots 메타 태그의 모든 지시문, 크롤링 후 준수 원칙, 충돌 해결, 메타 태그와 X-Robots-Tag의 차이를 설명합니다.
언어
이 페이지의 근거 신호 1개
- 관련 라이브 도구HTTP Header Checker
robots 메타 태그는 <head>의 <meta name="robots" content="noindex">처럼 검색엔진에 페이지 하나를 색인하고 검색결과에 제공하는 방법을 알립니다. 가장 중요한 원칙은 먼저 크롤링한 뒤 따른다는 것입니다. robots.txt로 차단된 페이지는 가져오지 않아 noindex를 보지 못합니다. 태그가 없으면 기본값은 index, follow입니다. 충돌하는 규칙은 가장 제한적인 규칙으로 해결되며 googlebot 태그와 일반 robots 태그가 함께 있으면 부정적 규칙의 합이 적용됩니다. HTML 전용 태그이므로 PDF, 이미지, 비 HTML 파일에는 X-Robots-Tag 헤더를 사용합니다.
요약 — robots 메타 태그는 페이지의
<head>에 넣어 검색엔진에 해당 페이지 하나를 어떻게 처리할지 알리는 HTML 한 줄입니다. 가장 흔한 예는 검색결과에서 제외하는<meta name="robots" content="noindex">입니다. 여기서 자주 놓치는 점은 Google이 태그를 읽으려면 페이지를 크롤링할 수 있어야 한다는 것입니다. 페이지를robots.txt에서도 차단하면 Google은 태그를 보지 못해 페이지가 검색결과에 남을 수 있습니다. 태그가 없을 때의 기본값은 “색인하고 링크를 따라가기”입니다.
robots 메타 태그란?
robots 메타 태그는 페이지의 <head>에 들어가는 작은 HTML 요소입니다.
<meta name="robots" content="noindex">검색엔진에 이 특정 페이지를 어떻게 처리할지, 즉 검색결과에 표시할지, 페이지의 링크를 따라갈지, 스니펫을 표시할지 등을 알립니다. name="robots"는 “이 태그를 읽는 모든 검색엔진”을 뜻합니다. name="googlebot"처럼 크롤러 이름으로 바꾸면 특정 검색엔진에만 지시할 수 있습니다.
페이지에 robots 메타 태그가 없으면 기본값은 index, follow, 즉 검색결과에 표시하고 링크를 따라가는 것입니다. 따라서 기본 동작을 바꾸려는 경우에만 태그가 필요합니다. Evidence for this claim For Google, the default robots meta behavior is index, follow when no restrictive rule is present. Scope: Google-supported robots meta rules; other crawlers publish their own support and defaults. Confidence: high · Verified: Google Search Central: Robots meta tag specifications
가장 중요한 원칙: noindex하려는 페이지를 차단하지 마세요
제가 가장 자주 보는 실수입니다. 페이지를 Google에서 제외하려고 다음 두 작업을 동시에 합니다.
- 페이지에
noindex를 추가하고 동시에 robots.txt에서 페이지를 차단합니다.
두 번째 작업은 첫 번째 작업을 무력화합니다. robots.txt에서 URL을 차단하면 Google에 *“이 페이지를 가져오지 말라”*고 지시하는 것입니다. 그러면 Google은 페이지를 내려받지 못하고 noindex도 읽지 못해 페이지가 색인에 남을 수 있습니다. 해결책은 페이지를 크롤링 가능하게 유지하여 Google이 noindex를 읽게 하는 것입니다. Evidence for this claim Google can read and follow page-level robots rules only when it is allowed to access the page. Scope: Google-supported robots meta and X-Robots-Tag rules; robots.txt blocking can prevent rule discovery. Confidence: high · Verified: Google Search Central: Robots meta tag specifications
서로 다른 두 가지 역할로 생각하면 쉽습니다.
- **
robots.txt**는 크롤링, 즉 봇이 페이지를 가져올 수 있는지를 제어합니다. - robots 메타 태그는 색인과 검색결과 제공, 즉 페이지를 가져온 뒤 어떻게 처리할지를 제어합니다.
두 수단은 서로 바꿔 쓸 수 없습니다. 검색결과에서 제거하는 것이 목적이라면 같은 URL에 둘을 함께 사용해서는 안 됩니다.
The same page contains a meta robots noindex directive. In the first path, crawling is allowed, so the crawler fetches the page, reads noindex, and can remove the URL from results after processing. In the second path, robots.txt blocks crawling, so the crawler cannot fetch the page or see noindex, and the URL may remain in results. Crawl control and index control are separate jobs.
© Patrick Stox LLC · CC BY 4.0 ·
자주 사용하는 지시문
실제로 자주 쓰는 지시문은 다음과 같습니다.
noindex— 이 페이지를 검색결과에서 제외합니다.nofollow— 이 페이지의 링크를 따라가지 않습니다. 링크 하나에rel="nofollow"를 넣는 것과 달리 페이지의 모든 링크에 적용됩니다.none—noindex, nofollow의 축약형입니다.nosnippet— 검색결과에서 이 페이지의 텍스트 스니펫을 표시하지 않습니다.
쉼표로 결합할 수 있습니다. 예: <meta name="robots" content="noindex, nofollow">.
알아야 할 몇 가지 함정
noindex는 페이지를 비공개로 만들지 않습니다. 페이지는 여전히 공개되어 있고 크롤링할 수 있지만 검색결과에 표시되지 않을 뿐입니다. 실제 비공개 콘텐츠에는 로그인을 사용하세요.noindex는 크롤링 예산을 아끼지 않습니다. Google은 태그를 확인하려고 페이지를 계속 가져와야 합니다.- PDF나 이미지에는
<meta>태그를 추가할 수 없습니다. HTML<head>가 없기 때문입니다. 이때 X-Robots-Tag HTTP 헤더를 사용합니다. 자세한 내용은 고급 버전에서 다룹니다. noindex페이지가 Google에서 사라지는 고정 기간은 없습니다. Google은 우선순위가 낮은 페이지를 다시 크롤링하고 처리하는 데 몇 달이 걸릴 수 있다고 설명합니다. 고객에게 “2~4주”라고 약속하지 마세요.
전체 지시문 목록, Google의 충돌 규칙 처리 방식, googlebot과 robots의 예외 상황, X-Robots-Tag 헤더를 자세히 보려면 고급 탭으로 전환하세요.
퀴즈: robots 메타 지시문
원하는 결과에 맞는 제어 선택
Which robots control should I use?
의도한 목적을 달성하지 못하는 robots 제어
noindex와 robots.txt 차단을 함께 사용. 차단 때문에 크롤러가 제거 지시문을 보지 못합니다.disallow를 색인 해제 보장으로 사용. 가져오기는 막지만 링크된 URL은 페이지 콘텐츠 없이도 색인될 수 있습니다.- 본문에 들어간 robots 메타 태그가 조용히 무시된다고 가정. Google은 본문의 robots 메타 태그도 따른다고 설명하므로 템플릿이 본문에 삽입해도 Google에서는 작동합니다. 다만 다른 크롤러와 검증 도구가 확실히 기대하는 위치는
<head>뿐이므로 그곳에 넣으세요. - Google이 읽지 않는 크롤러 이름 토큰 사용(예:
name="bingbot") 후 Google에도 범위가 적용된다고 가정. Google은googlebot과googlebot-news만 인식하며 다른 name 값은 완전히 무시합니다. - PDF에 HTML 메타 태그 사용. 비 HTML 파일은 HTTP 응답에
X-Robots-Tag를 제공하세요. nofollow를noindex처럼 취급. 링크 처리 지시문은 현재 페이지를 검색결과에서 제거하지 않습니다.- 일반 태그와 크롤러별 태그를 함께 배포하고 합산 결과를 확인하지 않음.
robots,googlebot, 헤더의 모든 지시문을 함께 감사하세요. 두 번째 위치에 제한적인 규칙이 남아 있을 수 있습니다. - robots 규칙을 보안 수단으로 사용. 누구나 공개 URL을 요청하거나
robots.txt를 읽을 수 있습니다. 기밀 콘텐츠에는 인증이 필요합니다.
noindex를 안전하게 배포하기
- 의도한 결과가 크롤링 감소, canonical 통합, 접근 제어가 아니라 검색결과 제거인지 확인했습니다.
- HTML에는
<meta name="robots" content="noindex">, 비 HTML 리소스에는X-Robots-Tag: noindex응답 헤더를 사용했습니다. - 대상 크롤러가 URL을 크롤링하고 접근할 수 있게 유지했습니다.
- 템플릿, CMS, CDN, 크롤러별 지시문의 모순을 제거했습니다.
- 소스 템플릿뿐 아니라 렌더링된 head와 실제 응답을 확인했습니다.
- canonical URL과 의미 있는 변형 또는 리디렉션을 모두 테스트했습니다.
- 나중에 비교할 수 있도록 영향받는 URL 집합과 배포 시간을 기록했습니다.
- URL 검사에서 규칙을 확인하고 재크롤링 후 페이지 색인 보고서를 모니터링했습니다.
- 콘텐츠가 비공개여야 한다면 인증을 사용했습니다.
메타 태그, 헤더, 크롤링 접근 검사
다음 셸 감사 명령에서 URL을 바꾸세요.
url="https://example.com/page/"
curl -sSI "$url" | grep -iE '^(HTTP/|x-robots-tag:|location:)'
curl -sS "$url" | grep -oiE '<meta[^>]+name=["'"'](robots|googlebot)["'"'][^>]*>'
curl -sS "https://example.com/robots.txt"DevTools Console에서는 첫 번째 결과에서 멈추지 말고 파싱된 모든 robots 태그를 조사하세요.
console.table([...document.querySelectorAll('meta[name]')]
.filter((meta) => /^(robots|googlebot|bingbot)$/i.test(meta.name))
.map((meta) => ({ crawler: meta.name, content: meta.content })));헤더는 DOM에 보이지 않으므로 콘솔 결과와 실제 응답을 비교하세요. 리디렉션도 따라가야 합니다. 중간 응답의 지시문이 최종 목적지에도 같은 규칙이 있음을 입증하지는 않습니다.
각 계층을 따로 테스트하기
- HTTP Header Checker — 상태 코드, 리디렉션, PDF를 포함한 실제
X-Robots-Tag헤더를 모두 검사합니다. - Robots.txt Tester — 대상 크롤러가 URL을 가져와 robots 지시문을 발견할 수 있는지 확인합니다.
검색결과에서 사라지지 않는 URL을 진단할 때는 두 도구를 함께 사용하세요. robots.txt가 가져오기를 막으면 올바른 noindex 응답도 처리할 수 없고, 크롤링이 허용된다고 해서 페이지가 실제로 noindex를 제공한다는 뜻도 아닙니다.
배포 후 지시문이 작동하는지 입증하기
테스트 1 — 실제 전달
- 가설: 의도한 모든 URL이 하나의 유효한
noindex규칙을 제공합니다. - 방법: URL 집합을 표본 추출하고 리디렉션을 따라가며 렌더링된 메타 태그와 응답 헤더를 검사합니다.
- 통과 조건: 최종 응답을 크롤링할 수 있고 충돌하는 전달 경로 없이 대상 크롤러에
noindex를 노출합니다. - 실패 조건: 리디렉션, CDN 헤더, 크롤러별 태그가 규칙을 바꿉니다.
- 다음 조치: 원인이 되는 계층을 수정하고 같은 표본을 다시 테스트합니다.
테스트 2 — 검색엔진 처리
- 가설: Google이 페이지를 크롤링할 수 있고 제거 규칙을 처리했습니다.
- 방법: URL 검사의 실시간 테스트를 실행한 뒤 재크롤링 후 페이지 색인 보고서를 모니터링합니다.
- 통과 조건: 실시간 테스트가 noindex를 감지하고 해당 이유로 URL이 색인되지 않은 상태가 됩니다.
- 실패 조건: URL이 차단됐거나 지시문이 없거나 새 크롤링 없이 이전 색인 상태가 지속됩니다.
- 다음 조치: 크롤링 접근을 복원하거나 재크롤링을 요청하세요. disallow를 추가하지 마세요.
보편적 벤치마크가 아니라 의도를 측정하세요
의도한 noindex 적용 범위
URLs serving the intended noindex ÷ URLs in the approved noindex set
자체 제거 목록으로 분모를 만든 뒤 배포 전후의 크롤링 결과를 비교하세요. 목표는 업계 평균 비율이 아니라 승인된 집합 전체에 완전히 적용하는 것입니다.
의도하지 않은 색인 제어 충돌
noindex하려는 URL 중 여전히 색인됐거나 robots.txt로 차단됐거나 모순되는 메타·헤더 규칙을 제공하는 수를 추적하세요. 템플릿, CDN 규칙, 파일 형식별로 나눠 하나의 구현 오류가 사이트 전체 합계에 가려지지 않게 합니다.
Google Search Console의 페이지 색인 보고서와 URL 검사를 처리 증거로 사용하되 색인 해제는 재크롤링에 달려 있음을 기억하세요. 변경 전 개수와 배포 날짜를 보존하지 않으면 감소하는 합계를 비교할 신뢰할 만한 기준선이 없습니다.
Evidence for this claim Google can read and follow page-level robots rules only when it is allowed to access the page. Scope: Google-supported robots meta and X-Robots-Tag rules; robots.txt blocking can prevent rule discovery. Confidence: high · Verified: Google Search Central: Robots meta tag specifications요약 —
<head>의<meta name="robots" content="…">는 페이지 하나가 색인되고 검색결과에 제공되는 방식을 제어하며, 태그가 없을 때 기본값은index, follow입니다. 먼저 크롤링한 뒤 따르는 구조이므로 크롤러가 페이지에 접근할 수 있을 때만 설정을 읽고 따를 수 있습니다. 따라서robots.txt로 차단한 URL은 가져오지 않아noindex도 보지 못합니다. 충돌하는 규칙은 가장 제한적인 규칙으로 해결됩니다.googlebot태그와 일반robots태그가 함께 있으면 Googlebot에는 부정적 규칙의 합이 적용됩니다. 이 태그는 HTML 전용이므로 비 HTML 파일과 대규모 적용에는 X-Robots-Tag 헤더를 사용하세요. Google은 크롤러 이름 토큰 중googlebot과googlebot-news만 읽고bingbot같은 다른 검색엔진 토큰을 포함한 나머지는 무시합니다.
정의, 위치, 기본값
Google의 표현을 빌리면 robots 메타 태그는 “use a granular, page-specific approach to controlling how an individual HTML page should be indexed and served to users in Google Search results.” (번역) 「개별 HTML 페이지가 Google 검색결과에서 색인되고 사용자에게 제공되는 방식을 세밀하게 페이지별로 제어」하게 합니다. 일반적이고 호환성 높은 위치는 <head>입니다.
<meta name="robots" content="noindex, nofollow">head 배치는 모든 검색엔진이 기대하는 작성 관례지만 Google 검색에 반드시 필요한 조건은 아닙니다. Google은 “Google Search doesn’t enforce placement of meta robots in the HTML head and will respect robots meta tags in the body section of an HTML document as well.” (번역) 「Google 검색은 HTML head에 robots 메타 태그를 넣도록 강제하지 않으며 HTML 문서의 body에 있는 태그도 따른다」고 명시합니다. 이를 Google의 허용 범위로만 보고 보편적인 작성 지침으로 받아들이지는 마세요. 표준 위치를 기대하는 모든 크롤러와 검증 도구가 올바르게 읽도록 여전히 <head>에 작성해야 합니다.
name 속성은 대상을 정합니다. 많은 안내서가 이 지점에서 Google 지원 범위를 과장합니다. name="robots"는 태그를 읽는 모든 크롤러를 대상으로 합니다. 그 밖에 Google은 정확히 두 개의 크롤러 이름 토큰만 지원하고 나머지는 무시합니다. Google은 “Google supports two user agent tokens in the robots meta tag; other values are ignored: googlebot for all text results, and googlebot-news for news results.” (번역) 「robots meta 태그에서 두 사용자 에이전트 토큰을 지원하며 다른 값은 무시한다. 모든 텍스트 결과에는 googlebot, 뉴스 결과에는 googlebot-news를 쓴다」고 설명합니다. name="bingbot" 태그는 문서화된 Google 제어가 아닙니다. Bing은 자체 조건에 따라 자기 토큰을 읽지만 Google은 인식하지 못하는 모든 name 값을 건너뜁니다. Google에서는 name과 content 속성, X-Robots-Tag 헤더 이름과 값 모두 대소문자를 구분하지 않습니다.
**robots 메타 태그가 없을 때 기본값은 index, follow**입니다. 이는 all 규칙이며 Google은 명시적으로 적어도 효과가 없다고 설명합니다. Evidence for this claim For Google, the default robots meta behavior is index, follow when no restrictive rule is present. Scope: Google-supported robots meta rules; other crawlers publish their own support and defaults. Confidence: high · Verified: Google Search Central: Robots meta tag specifications 기본값을 바꾸려는 경우에만 태그가 필요합니다.
규칙은 한 태그에서 쉼표로 구분하거나(noindex, nofollow) 여러 <meta> 태그로 결합할 수 있습니다. Google은 “create a multi-rule instruction by combining robots meta tag rules with commas or by using multiple meta tags.” (번역) 「robots meta 태그 규칙을 쉼표로 결합하거나 여러 meta 태그를 사용해 다중 규칙 지시문을 만들 수 있다」고 설명합니다.
모든 것을 망가뜨리는 원칙: Google이 태그를 보려면 페이지를 크롤링해야 합니다
이 글의 핵심입니다. robots 메타 태그는 먼저 크롤링한 뒤 따르는 방식입니다. Google이 태그를 읽으려면 페이지를 가져와야 하므로 가져오기를 막는 것은 태그의 적용도 막습니다. 사양의 표현은 다음과 같습니다.
Evidence for this claim Google can read and follow page-level robots rules only when it is allowed to access the page. Scope: Google-supported robots meta and X-Robots-Tag rules; robots.txt blocking can prevent rule discovery. Confidence: high · Verified: Google Search Central: Robots meta tag specifications“Keep in mind that these settings can be read and followed only if crawlers are allowed to access the pages that include these settings.” (번역) 「크롤러가 이러한 설정이 있는 페이지에 접근할 수 있을 때만 설정을 읽고 따를 수 있다는 점을 기억하세요.」
그 결과도 명확히 설명돼 있습니다.
“If a page is disallowed from crawling through the robots.txt file, then any information about indexing or serving rules will not be found and will therefore be ignored.” (번역) 「robots.txt 파일에서 페이지 크롤링을 허용하지 않으면 색인 또는 제공 규칙 정보를 찾을 수 없어 무시됩니다.」
따라서 같은 URL에 robots.txt의 Disallow와 noindex를 함께 쓰는 전형적인 실수는 조용히 noindex를 무력화합니다. Google은 페이지를 크롤링하지 못하고 태그를 보지 못해 URL이 색인에 오래 남을 수 있습니다. 링크가 있다면 콘텐츠 없는 스니펫 형태로 남기도 합니다. Google의 “검색 색인 차단” 문서도 같은 내용을 더 쉽게 설명합니다. noindex가 작동하려면 페이지가 “must not be blocked by a robots.txt file… If the page is blocked by a robots.txt file or the crawler can’t access the page, the crawler will never see the noindex rule, and the page can still appear in search results.” (번역) 「robots.txt 파일로 차단되어서는 안 되며, 페이지가 차단됐거나 크롤러가 접근할 수 없으면 noindex 규칙을 보지 못해 검색결과에 계속 표시될 수 있습니다.」
실제 데이터에서 이 원리의 반대쪽도 확인했습니다. 제 실험 *robots.txt로 순위가 높은 2개 페이지를 차단한 이야기*에서는 순위가 있던 2개 페이지를 일부러 robots.txt에서 차단했습니다. Google이 더는 페이지를 크롤링할 수 없어 정보를 갱신하지 못했고 페이지 순위는 대부분 유지됐습니다. “We lost a position here or there and all of the featured snippets for the pages.” (번역) 「몇몇 순위와 페이지의 모든 추천 스니펫을 잃었습니다.」 제 결론은 “Accidentally blocking pages (that Google already ranks) from being crawled using robots.txt probably isn’t going to have much impact on your rankings, and they will likely still show in the search results.” (번역) 「이미 순위가 있는 페이지를 robots.txt로 실수로 차단해도 순위에 큰 영향이 없고 검색결과에 계속 표시될 가능성이 높다」는 것이었습니다. noindex 문제와 같은 원리입니다. 차단된 URL은 갱신이 멈춥니다. 차단은 제거가 아닙니다. 페이지를 정말 없애려면 이 태그의 핵심인 **크롤링 가능한 noindex**가 필요합니다.
각 도구의 역할에 관해 제가 공개적으로 그은 선도 같습니다. Google이 robots.txt에서 noindex를 지원해야 하느냐는 질문에 “Google was clear they want robots.txt for crawl control only.” (번역) 「Google은 robots.txt를 크롤링 제어에만 쓰길 원한다고 분명히 밝혔다」고 답했습니다. 크롤링은 robots.txt의 역할이고 색인은 메타 태그 또는 헤더의 역할입니다. 둘은 겹치지 않습니다. robots.txt의 noindex 지시문은 공식 지원된 적이 없으며 Google은 2019년 9월 1일 파싱을 중단했습니다.
모든 robots 메타 지시문
Google이 지원하는 값과 사양의 원문 설명은 다음과 같습니다.
색인
all— “There are no restrictions for indexing or serving. This rule is the default value and has no effect if explicitly listed.” (번역) 「색인 또는 제공에 제한이 없습니다. 기본값이며 명시해도 효과가 없습니다.」noindex— “Do not show this page, media, or resource in search results.” (번역) 「이 페이지, 미디어, 리소스를 검색결과에 표시하지 않습니다.」none— “Equivalent tonoindex, nofollow.” (번역) 「noindex, nofollow와 같습니다.」indexifembedded— “Google is allowed to index the content of a page if it’s embedded in another page through iframes or similar HTML tags, in spite of anoindexrule.” (번역) 「noindex 규칙이 있어도 iframe이나 유사한 HTML 태그로 다른 페이지에 삽입된 경우 Google이 페이지 콘텐츠를 색인할 수 있습니다.」 삽입 콘텐츠에서noindex를 재정의하는 유일한 지시문입니다.
링크
nofollow— “Do not follow the links on this page.” (번역) 「이 페이지의 링크를 따라가지 않습니다.」 페이지 수준 규칙이며 링크 하나에 적용하는rel="nofollow"와 범위가 다릅니다.
검색결과 제공과 스니펫
nosnippet— “Do not show a text snippet or video preview in the search results for this page.” (번역) 「검색결과에서 이 페이지의 텍스트 스니펫이나 동영상 미리보기를 표시하지 않습니다.」 범위는 전통적인 텍스트 스니펫보다 넓습니다. Google은 “applies to all forms of search results (at Google: web search, Google Images, Discover, AI Overviews, AI Mode) and will also prevent the content from being used as a direct input for AI Overviews and AI Mode.” (번역) 「Google 웹 검색, Google 이미지, Discover, AI Overviews, AI Mode 등 모든 검색결과에 적용되며 콘텐츠가 AI Overviews와 AI Mode의 직접 입력으로 사용되는 것도 막는다」고 설명합니다.max-snippet:[number]— “Use a maximum of [number] characters as a textual snippet for this search result.” (번역) 「이 검색결과의 텍스트 스니펫에 최대 [number]자를 사용합니다.」nosnippet과 같은 확장 범위이며 “applies to all forms of search results (such as Google web search, Google Images, Discover, Assistant, AI Overviews, AI Mode) and will also limit how much of the content may be used as a direct input for AI Overviews and AI Mode.” (번역) 「Google 웹 검색, Google 이미지, Discover, Assistant, AI Overviews, AI Mode 같은 모든 검색결과에 적용되며 콘텐츠가 AI Overviews와 AI Mode의 직접 입력으로 사용될 수 있는 양도 제한한다」고 설명합니다. 이는 Google 자체 AI 검색 기능의 직접 입력 자격 제어이지 일반적인 AI 학습 제외가 아닙니다. 모델 학습에서 제외하는 Google-Extended나 Search Console의 별도 생성형 AI 속성 수준 제어는 범위가 다른 시스템입니다.nosnippet과max-snippet이 둘까지 포괄한다고 생각하지 마세요.max-image-preview:[setting]— “Set the maximum size of an image preview for this page in search results.” (번역) 「검색결과에서 이 페이지의 이미지 미리보기 최대 크기를 설정합니다.」 값은none,standard,large이며 large는 “A larger image preview, up to the width of the viewport, may be shown.” (번역) 「뷰포트 너비까지 더 큰 이미지 미리보기가 표시될 수 있음」을 뜻합니다.max-video-preview:[number]— “Use a maximum of [number] seconds as a video snippet for videos on this page in search results.” (번역) 「검색결과에서 이 페이지 동영상의 동영상 스니펫을 최대 [number]초 사용합니다.」notranslate— “Don’t offer translation of this page in search results.” (번역) 「검색결과에서 이 페이지의 번역을 제공하지 않습니다.」noimageindex— “Do not index images on this page.” (번역) 「이 페이지의 이미지를 색인하지 않습니다.」unavailable_after:[date/time]— “Do not show this page in search results after the specified date/time.” (번역) 「지정한 날짜와 시간 이후에는 검색결과에 이 페이지를 표시하지 않습니다.」
과거 지시문 — 더는 유효한 Google 제어가 아님
오래된 안내서에 여전히 등장하지만 Google이 더는 사용하지 않는다고 밝힌 지시문이 있습니다. 효과를 기대하며 추가하지 마세요.
noarchive— “Thenoarchiverule is no longer used by Google Search to control whether a cached link is shown in search results, as the cached link feature no longer exists.” (번역) 「캐시 링크 기능이 더는 존재하지 않으므로 Google 검색은 검색결과의 캐시 링크 표시를 제어하는 데 noarchive 규칙을 사용하지 않습니다.」nocache— 일부 검색엔진이noarchive의 동의어로 사용했지만 “Thenocacherule isn’t used by Google Search.” (번역) 「Google 검색에서는 nocache 규칙을 사용하지 않습니다.」nositelinkssearchbox— “Thenositelinkssearchboxrule is no longer used by Google Search to control whether the sitelink search box is shown for a given page, as the feature no longer exists.” (번역) 「기능이 더는 존재하지 않으므로 Google 검색은 특정 페이지의 사이트링크 검색창 표시를 제어하는 데 이 규칙을 사용하지 않습니다.」
문단 수준 제어(메타 태그가 아님)
페이지 안의 일부만 제어하는 data-nosnippet 속성이 있습니다. Google은 span, div, section 요소에서 “designate textual parts of an HTML page not to be used as a snippet…” (번역) 「HTML 페이지의 텍스트 일부를 스니펫에 사용하지 않도록 지정」할 수 있다고 설명합니다. 메타 태그의 규칙은 페이지 전체에 적용됩니다. 나머지는 건드리지 않고 한 구절만 스니펫에서 제외할 때 nosnippet / data-nosnippet을 구분해 사용합니다.
지시문 결합과 충돌 해결
지시문이 충돌할 때 적용되는 원칙은 두 가지입니다.
1. 더 제한적인 규칙이 이깁니다. “In the case of conflicting robots rules, the more restrictive rule applies. For example, if a page has both max-snippet:50 and nosnippet rules, the nosnippet rule will apply.” (번역) 「robots 규칙이 충돌하면 더 제한적인 규칙이 적용됩니다. 페이지에 max-snippet:50과 nosnippet이 모두 있으면 nosnippet이 적용됩니다.」 nosnippet이 50자 상한보다 엄격하므로 최종 결과는 nosnippet입니다.
2. googlebot과 robots — 부정적 규칙의 합. 많은 안내서가 틀리는 부분입니다. 이름이 googlebot인 태그가 일반 robots 태그를 단순히 대체하지 않습니다. 겹치는 범위에서는 Googlebot에 제한 규칙의 합집합이 적용됩니다. Google은 “For situations where multiple crawlers are specified along with different rules, the search engine will use the sum of the negative rules.” (번역) 「여러 크롤러에 서로 다른 규칙을 지정하면 검색엔진은 부정적 규칙의 합을 사용한다」고 설명합니다. 문서의 예시는 다음과 같습니다.
<meta name="robots" content="nofollow">
<meta name="googlebot" content="noindex">“The page containing these meta tags will be interpreted as having a noindex, nofollow rule when crawled by Googlebot.” (번역) 「Googlebot이 크롤링할 때 이 페이지에는 noindex와 nofollow가 함께 적용됩니다.」 robots의 nofollow와 googlebot의 noindex가 합쳐져 Googlebot에 noindex, nofollow가 적용됩니다. googlebot 태그와 robots 태그가 같은 지시문을 서로 다르게 설정하면 크롤러 이름을 지정한 태그가 해당 크롤러에 적용됩니다.
Meta robots 태그와 X-Robots-Tag HTTP 헤더
robots 메타 태그는 <head>가 필요한 HTML 전용 제어입니다. HTML이 아닌 리소스에는 HTTP 응답 헤더로 같은 규칙 어휘를 전달하는 X-Robots-Tag를 사용합니다. Google은 “The X-Robots-Tag can be used as an element of the HTTP header response for a given URL. Any rule that can be used in a robots meta tag can also be specified as an X-Robots-Tag.” (번역) 「X-Robots-Tag는 특정 URL의 HTTP 헤더 응답 요소로 사용할 수 있으며 robots meta 태그에 쓸 수 있는 모든 규칙을 지정할 수 있다」고 설명합니다. 존재 이유도 “You can use the X-Robots-Tag for non-HTML files like image files where the usage of robots meta tags in HTML is not possible.” (번역) 「HTML robots meta 태그를 사용할 수 없는 이미지 같은 비 HTML 파일에 쓸 수 있다」고 밝힙니다.
따라서 다음처럼 선택합니다.
- PDF, 이미지, 기타 비 HTML 파일인가요?
<meta>태그를 추가할 수 없으므로X-Robots-Tag: noindex같은 헤더를 사용하세요. - 디렉터리나 패턴 전체인가요? 헤더는 서버·CDN 수준에서 설정하므로 하나의 구성 규칙으로 전체 경로에 확장할 수 있습니다.
- 검색엔진 하나만 대상으로 하나요? 헤더도
X-Robots-Tag: googlebot: noindex, nofollow처럼 크롤러를 지정할 수 있고 한 응답에서 여러 X-Robots-Tag 헤더를 결합할 수 있습니다.
규칙은 같고 전달 방식은 두 가지입니다. HTML 페이지에는 메타 태그를, 그 밖의 파일과 대규모 적용에는 헤더를 사용합니다.
Bing과 다른 검색엔진이 지원하는 지시문
지시문 집합이 모든 검색엔진에서 같다고 가정하지 마세요. 실제로 다릅니다. Bing은 핵심 색인·제공 규칙인 noindex, nofollow, noarchive(nocache는 동의어), nosnippet을 지원하고 비 HTML 리소스의 X-Robots-Tag도 따릅니다. 하지만 Bing은 none 축약형을 지원하지 않으므로 여러 검색엔진에서 안전하게 쓰려면 none 대신 noindex, nofollow를 명시하세요. max-snippet, max-image-preview, max-video-preview 미리보기 제어군과 noimageindex, notranslate, indexifembedded, unavailable_after는 사실상 Google 전용입니다. 확실하지 않으면 지시문을 풀어 쓰고 max-* 제어는 Google 기능으로 취급하세요.
흔한 실수와 해결책
- 같은 URL에
Disallow와noindex사용.noindex가 보이지 않습니다. 페이지를 크롤링 가능하게 두고noindex만 유지하세요. noindex와 다른 페이지를 가리키는rel=canonical사용. 한편으로 페이지를 버리고 다른 한편으로 다른 페이지에 통합하라는 충돌 신호입니다. 하나를 선택하세요. 자세한 내용은 canonicalization을 참고하세요.- 스테이징 전체의
noindex를 프로덕션에 배포. 사이트 전체 색인 해제를 일으키는 치명적인 실수입니다. 출시 전에 확인하세요. - 클라이언트 JavaScript로만
noindex삽입. Google이 태그를 보려면 페이지를 렌더링해야 하며 렌더링 HTML이 예상과 다르면 동작도 달라집니다. 원시 HTML이나 헤더를 권장합니다. rendering을 참고하세요. - Bing이 Google 전용 지시문을 따른다고 기대 (
none,max-*계열). - robots 지시문이 담당하지 않는 결과를 기대.
noindex나nosnippet만으로 크롤링 예산 절감, 보안, 순위 변화, 검색엔진 간 동일한 동작, 특정 제거 기간, 모든 AI·검색 표면 제외를 보장할 수 없습니다. 보안은 인증, 크롤링은robots.txt, 검색엔진 간 차이는 각 문서, AI 범위는 Search Console이나 Google-Extended처럼 목적에 맞는 제어가 담당합니다. Google은noindex페이지가 사라지는 고정 기간을 제시하지 않으며 재크롤링 우선순위에 따라 중요도가 낮은 페이지는 “몇 달이 걸릴 수” 있습니다.
큰 그림에서 robots.txt와 crawling은 크롤링 제어, noindex와 indexing은 색인 제어입니다. 페이지는 색인하되 표시 방식을 조정하려면 nosnippet / data-nosnippet, max-snippet, max-image-preview 같은 검색결과 제공 제어를 사용합니다. X-Robots-Tag는 비 HTML에 쓰는 같은 태그의 HTTP 헤더 버전입니다.
AI 요약
고급 버전을 압축하면 다음과 같습니다.
- robots 메타 태그, 즉
<head>의<meta name="robots" content="…">는 HTML 페이지 하나가 색인되고 검색결과에 제공되는 방식을 제어합니다. 태그가 없으면 기본값은index, follow입니다. - 먼저 크롤링한 뒤 따릅니다. Google이 태그를 읽으려면 페이지를 크롤링해야 합니다. 따라서 robots.txt로 차단한 URL의
noindex는 보이지 않습니다. Patrick의 페이지 차단 실험에서 차단된 페이지가 색인과 순위를 대부분 유지한 것이 이 원리를 보여 줍니다. 차단은 제거가 아닙니다. - robots.txt는 크롤링 제어, 메타 태그 또는 X-Robots-Tag는 색인·제공 제어입니다. 서로 바꿔 쓸 수 없습니다. robots.txt의
noindex는 2019년 9월 1일 폐기됐습니다. - 지시문: 색인(
noindex,none,indexifembedded), 링크(nofollow, 페이지 전체), 제공(nosnippet,max-snippet,max-image-preview,max-video-preview,notranslate,noimageindex,unavailable_after), 문단 수준의data-nosnippet속성이 있습니다.noarchive,nocache,nositelinkssearchbox는 Google이 더는 사용하지 않는 과거 지시문입니다. nosnippet과max-snippet은 AI Overviews와 AI Mode 입력도 제한합니다. 일반 AI 학습 제외는 아니며 Google-Extended와 검색의 별도 생성형 AI 속성 제어는 다른 시스템입니다.- 충돌 시 가장 제한적인 규칙이 이깁니다.
nosnippet은max-snippet:50보다 강합니다.googlebot태그와 일반robots태그가 함께 있으면 부정적 규칙의 합이 적용되어robots: nofollow와googlebot: noindex는noindex, nofollow가 됩니다. Google은googlebot과googlebot-news이름만 인식하고bingbot같은 다른 값은 무시합니다. - 메타 태그는 관례상
<head>에 둡니다. Google은 본문 배치도 허용하지만 Google만의 동작입니다. X-Robots-Tag는 PDF, 이미지, 비 HTML 파일, 전체 디렉터리에 같은 규칙을 HTTP 헤더로 전달합니다. - 검색엔진 간 차이: Bing은
noindex,nofollow,noarchive(nocache),nosnippet을 지원하지만none은 지원하지 않습니다.max-*계열은 사실상 Google 전용이므로 규칙을 명시적으로 쓰세요. - 보장하지 않는 것: robots 지시문만으로 크롤링 예산 절감, 보안, 순위 변화, 검색엔진 간 동일 동작, 고정된 제거 기간을 약속할 수 없습니다. Google은
noindex적용에 정해진 기간을 제시하지 않습니다.
공식 문서
검색엔진의 1차 문서입니다.
- Robots 메타 태그, data-nosnippet, X-Robots-Tag 사양 — 모든 지시문, 결합 규칙, 충돌 해결,
googlebot과robots의 합, X-Robots-Tag 헤더를 다루는 권위 있는 사양입니다. - noindex로 검색 색인 차단 —
noindex동작, 메타 태그와 헤더 전달 방식, 크롤링 의존성을 쉽게 설명합니다. - robots.txt 소개 — 두 역할을 혼동하지 않도록 크롤링 제어 측면을 설명합니다.
- 크롤링과 색인 — robots, 사이트맵, canonical, 크롤링 제어 문서 허브입니다.
Bing / Microsoft
- Bing이 지원하는 robots 메타 태그와 속성 — Bing 지원 지시문입니다. JavaScript로 렌더링되므로 실제 페이지에서 정확한 목록을 확인하세요.
참고 자료
- MDN —
<meta name="robots">—noarchive와nocache를 사용하는 검색엔진을 포함한 검색엔진 간 지시문 참고 자료입니다.
출처 인용
Google의 공식 발언입니다. 각 링크는 출처 페이지의 인용 구절로 바로 이동합니다.
Google — 태그의 정의와 기본값
- “The robots
metatag lets you use a granular, page-specific approach to controlling how an individual HTML page should be indexed and served to users in Google Search results.” (번역) 「robots meta 태그를 사용하면 개별 HTML 페이지가 Google 검색결과에서 색인되고 제공되는 방식을 세밀하게 페이지별로 제어할 수 있습니다.」 — Google Search Central 문서. 인용으로 이동
Google — 크롤링 후 준수라는 의존성
- “Keep in mind that these settings can be read and followed only if crawlers are allowed to access the pages that include these settings.” (번역) 「크롤러가 설정이 있는 페이지에 접근할 수 있을 때만 설정을 읽고 따를 수 있습니다.」 인용으로 이동
- “If a page is disallowed from crawling through the robots.txt file, then any information about indexing or serving rules will not be found and will therefore be ignored.” (번역) 「robots.txt에서 페이지 크롤링을 허용하지 않으면 색인 또는 제공 규칙 정보를 찾을 수 없어 무시됩니다.」 인용으로 이동
- “For the
noindexrule to be effective, the page or resource must not be blocked by a robots.txt file, and it has to be otherwise accessible to the crawler.” (번역) 「noindex 규칙이 유효하려면 페이지나 리소스가 robots.txt로 차단되지 않고 크롤러가 접근할 수 있어야 합니다.」 — Google, “noindex로 검색 색인 차단.” 인용으로 이동
Google — 지시문 원문 설명
- “Do not show this page, media, or resource in search results.” (번역) 「이 페이지, 미디어, 리소스를 검색결과에 표시하지 않습니다.」 —
noindex. 인용으로 이동 - “Equivalent to
noindex, nofollow.” (번역) 「noindex, nofollow와 같습니다.」 —none. 인용으로 이동 - “Do not show a text snippet or video preview in the search results for this page.” (번역) 「검색결과에서 이 페이지의 텍스트 스니펫이나 동영상 미리보기를 표시하지 않습니다.」 —
nosnippet. 인용으로 이동 - “Google is allowed to index the content of a page if it’s embedded in another page through iframes or similar HTML tags, in spite of a
noindexrule.” (번역) 「noindex 규칙이 있어도 iframe이나 유사한 HTML 태그로 다른 페이지에 삽입되면 Google이 콘텐츠를 색인할 수 있습니다.」 —indexifembedded. 인용으로 이동 - “A larger image preview, up to the width of the viewport, may be shown.” (번역) 「뷰포트 너비까지 더 큰 이미지 미리보기가 표시될 수 있습니다.」 —
max-image-preview:large. 인용으로 이동 - “Do not index images on this page.” (번역) 「이 페이지의 이미지를 색인하지 않습니다.」 —
noimageindex. 인용으로 이동 - “You can designate textual parts of an HTML page not to be used as a snippet.” (번역) 「HTML 페이지의 텍스트 일부를 스니펫에 사용하지 않도록 지정할 수 있습니다.」 —
data-nosnippet. 인용으로 이동
Google — 규칙 결합과 충돌 해결
- “You can create a multi-rule instruction by combining robots
metatag rules with commas or by using multiplemetatags.” (번역) 「robots meta 태그 규칙을 쉼표로 결합하거나 여러 meta 태그를 사용해 다중 규칙 지시문을 만들 수 있습니다.」 인용으로 이동 - “In the case of conflicting robots rules, the more restrictive rule applies. For example, if a page has both
max-snippet:50andnosnippetrules, thenosnippetrule will apply.” (번역) 「충돌하는 robots 규칙 중 제약이 강한 쪽이 우선합니다. 예를 들어 max-snippet:50과 nosnippet이 함께 있으면 nosnippet을 따릅니다.」 인용으로 이동 - “For situations where multiple crawlers are specified along with different rules, the search engine will use the sum of the negative rules.” (번역) 「여러 크롤러에 서로 다른 규칙이 지정되면 검색엔진은 부정적 규칙의 합을 사용합니다.」 인용으로 이동
Google — 배치, 크롤러 토큰, 대소문자 구분
- “Google Search doesn’t enforce placement of meta robots in the HTML head and will respect robots meta tags in the body section of an HTML document as well.” (번역) 「Google 검색은 HTML head 배치를 강제하지 않으며 body의 robots 메타 태그도 따릅니다.」 인용으로 이동
- “Google supports two user agent tokens in the robots
metatag; other values are ignored.” (번역) 「Google은 robots meta 태그에서 두 사용자 에이전트 토큰을 지원하며 다른 값은 무시합니다.」 인용으로 이동 - “Both the
nameand thecontentattributes are case-insensitive.” (번역) 「name과 content 속성은 모두 대소문자를 구분하지 않습니다.」 인용으로 이동
Google — noarchive와 과거 지시문
- “The
noarchiverule is no longer used by Google Search to control whether a cached link is shown in search results, as the cached link feature no longer exists.” (번역) 「캐시 링크 기능이 더는 존재하지 않아 Google 검색은 캐시 링크 표시 제어에 noarchive를 사용하지 않습니다.」 인용으로 이동 - “The
nocacherule isn’t used by Google Search.” (번역) 「Google 검색은 nocache 규칙을 사용하지 않습니다.」 인용으로 이동
Google — nosnippet과 max-snippet의 AI Overviews·AI Mode 범위
- “[nosnippet] applies to all forms of search results (at Google: web search, Google Images, Discover, AI Overviews, AI Mode) and will also prevent the content from being used as a direct input for AI Overviews and AI Mode.” (번역) 「[nosnippet]은 모든 형태의 검색결과에 적용되며 콘텐츠가 AI Overviews와 AI Mode의 직접 입력으로 사용되는 것도 막습니다.」 인용으로 이동
- “[max-snippet] applies to all forms of search results (such as Google web search, Google Images, Discover, Assistant, AI Overviews, AI Mode) and will also limit how much of the content may be used as a direct input for AI Overviews and AI Mode.” (번역) 「[max-snippet]은 모든 형태의 검색결과에 적용되며 콘텐츠가 AI Overviews와 AI Mode의 직접 입력으로 쓰일 수 있는 양도 제한합니다.」 인용으로 이동
Google — noindex 적용에 고정된 기간은 없음
- “If a page is still appearing in results, it’s probably because we haven’t crawled the page since you added the
noindexrule. Depending on the importance of the page on the internet, it may take months for Googlebot to revisit a page.” (번역) 「페이지가 계속 검색결과에 보인다면 noindex 추가 후 아직 크롤링하지 않았기 때문일 수 있습니다. 웹에서 페이지의 중요도에 따라 Googlebot이 다시 방문하는 데 몇 달이 걸릴 수 있습니다.」 — Google, “noindex로 검색 색인 차단.” 인용으로 이동
Google — X-Robots-Tag
- “The
X-Robots-Tagcan be used as an element of the HTTP header response for a given URL. Any rule that can be used in a robotsmetatag can also be specified as anX-Robots-Tag.” (번역) 「X-Robots-Tag는 URL의 HTTP 헤더 응답 요소로 쓸 수 있으며 robots meta 태그의 모든 규칙을 지정할 수 있습니다.」 인용으로 이동 - “You can use the
X-Robots-Tagfor non-HTML files like image files where the usage of robotsmetatags in HTML is not possible.” (번역) 「HTML robots meta 태그를 쓸 수 없는 이미지 같은 비 HTML 파일에 X-Robots-Tag를 사용할 수 있습니다.」 인용으로 이동
Patrick Stox — robots.txt는 크롤링 제어 전용
- “Google was clear they want robots.txt for crawl control only. The biggest downside will probably be all the people who accidentally take their entire site out of the index.” (번역) 「Google은 robots.txt를 크롤링 제어에만 쓰길 원한다고 분명히 했습니다. 가장 큰 단점은 실수로 사이트 전체를 색인에서 빼는 사람이 생기는 것입니다.」
— Search Engine Land에서 Google이 robots.txt에
noindex를 추가해야 하는지에 관한 Patrick Stox의 답변. 인용으로 이동
Patrick Stox — robots.txt로 순위 페이지 차단(크롤링과 색인의 차이 입증)
- “Accidentally blocking pages (that Google already ranks) from being crawled using robots.txt probably isn’t going to have much impact on your rankings, and they will likely still show in the search results.” (번역) 「이미 순위가 있는 페이지를 robots.txt로 실수로 차단해도 순위에 큰 영향이 없고 검색결과에 계속 표시될 가능성이 높습니다.」 인용으로 이동
- “We lost a position here or there and all of the featured snippets for the pages.” (번역) 「몇몇 순위와 페이지의 모든 추천 스니펫을 잃었습니다.」 인용으로 이동
모든 robots 메타 지시문 요약표
Google이 지원하는 content 값 전체와 동작, 기본값입니다.
| 지시문 | 동작 | 기본값? |
|---|---|---|
all | 색인·제공 제한 없음 — 암묵적 기본값 | 예(태그가 없을 때) |
index | 페이지를 검색결과에 허용(기본값, 거의 명시하지 않음) | 암묵적 |
noindex | 페이지·미디어·리소스를 검색결과에서 제외 | 아니요 |
follow | 페이지의 링크를 따라감(기본값, 거의 명시하지 않음) | 암묵적 |
nofollow | 페이지의 모든 링크를 따라가지 않음 | 아니요 |
none | noindex, nofollow의 축약형(Bing은 미지원) | 아니요 |
nosnippet | 텍스트 스니펫·동영상 미리보기 미표시, AI Overviews·AI Mode 직접 입력도 차단 | 아니요 |
max-snippet:[n] | 텍스트 스니펫을 [n]자로 제한(0=없음, -1=제한 없음), AI Overviews·AI Mode 직접 입력량도 제한 | 아니요 |
max-image-preview:[setting] | 이미지 미리보기 크기를 none / standard / large로 제한 | 아니요 |
max-video-preview:[n] | 동영상 미리보기를 [n]초로 제한(0=없음, -1=제한 없음) | 아니요 |
notranslate | 검색결과에서 페이지 번역을 제공하지 않음 | 아니요 |
noimageindex | 페이지의 이미지를 색인하지 않음 | 아니요 |
unavailable_after:[date/time] | 지정 날짜·시간 이후 검색결과에서 제거 | 아니요 |
indexifembedded | noindex가 있어도 iframe으로 삽입된 콘텐츠의 색인을 허용 | 아니요 |
과거 지시문 — Google은 더는 사용하지 않음:
| 지시문 | 상태 |
|---|---|
noarchive | 더는 사용하지 않음 — 제어하던 캐시 링크 기능이 사라짐 |
nocache | Google 검색에서 사용하지 않음(일부 검색엔진은 noarchive 동의어로 사용) |
nositelinkssearchbox | 더는 사용하지 않음 — 제어하던 사이트링크 검색창 기능이 사라짐 |
문단 수준 제어(content 값이 아니라 HTML 속성):
| 속성 | 동작 | 적용 요소 |
|---|---|---|
data-nosnippet | 특정 구절을 스니펫에서 제외 | span, div, section |
구문
<!-- one tag, comma-separated -->
<meta name="robots" content="noindex, nofollow">
<!-- target one engine -->
<meta name="googlebot" content="noindex">
<!-- the HTTP-header equivalent, for non-HTML / at scale -->
X-Robots-Tag: noindex
X-Robots-Tag: googlebot: noindex, nofollow빠른 사실 확인
- 태그 없음 → 기본값
index, follow. none=noindex, nofollow이지만 Bing은none을 지원하지 않으므로 풀어 쓰세요.max-*,noimageindex,notranslate,indexifembedded,unavailable_after는 사실상 Google 전용입니다.- 태그는 HTML 전용이며
X-Robots-Tag헤더가 PDF, 이미지, 전체 디렉터리에 같은 규칙을 전달합니다. - Google은
googlebot과googlebot-news두 크롤러 이름만 읽고bingbot같은 다른 검색엔진 토큰을 포함한 나머지를 무시합니다. - head 배치가 호환성 높은 관례지만 Google은
<body>의 robots 메타 태그도 따릅니다. - Google에서는
name,content,X-Robots-Tag값이 대소문자를 구분하지 않습니다.
핵심 사고방식
1. 먼저 크롤링한 뒤 준수 — 페이지를 가져올 수 있어야 태그가 작동합니다.
Google은 태그를 읽으려고 페이지를 크롤링해야 합니다. robots.txt disallow, 인증, 서버 오류처럼 가져오기를 막는 요소가 있으면 태그를 보지 못합니다. noindex를 신뢰하기 전에 URL을 크롤링할 수 있는지 확인하세요. 따라서 noindex하려는 URL을 Disallow하면 안 됩니다.
2. 도구 세 개, 역할 세 개 — 혼동하지 마세요.
robots.txt= 크롤링 제어(봇이 페이지를 가져오는지).- Robots 메타 태그 / X-Robots-Tag = 색인·제공 제어(가져온 뒤의 처리).
- 인증 = 보안(
noindex페이지는 여전히 공개됨). 역할에 맞는 도구를 선택하세요. 가장 흔한 실패는 색인 해제에robots.txt를 쓰는 것이며 이는 메타 태그의 역할입니다.
3. 페이지 제거를 위한 결정 규칙.
검색결과에서 제외하려면 페이지를 크롤링 가능하게 두고 **noindex**를 추가하세요. 동시에 robots.txt로 차단하거나 다른 URL로 canonical하지 마세요. 봇이 공간 전체를 건너뛰게 하고 색인 여부는 중요하지 않다면 robots.txt disallow를 사용합니다. 둘은 서로 바꿀 수 없습니다.
4. 충돌 해결 — 가장 제한적인 규칙이 이깁니다.
규칙이 충돌하면 더 엄격한 규칙이 적용됩니다. nosnippet은 max-snippet:50보다 강합니다. 조합으로 우회하려 하지 말고 가장 엄격한 규칙이 적용된다고 가정하세요.
5. googlebot과 robots — 재정의가 아니라 부정적 규칙의 합.
겹치는 범위에서 Googlebot은 일반 robots 태그와 이름이 googlebot인 태그 중 하나를 고르지 않고 제한을 합산합니다. robots: nofollow + googlebot: noindex ⇒ Googlebot에는 noindex, nofollow가 적용됩니다. 크롤러 이름 태그와 일반 태그가 같은 지시문을 다르게 설정하면 크롤러별 태그가 우선하지만 기억할 핵심은 제한의 합집합입니다.
6. HTML 페이지는 메타 태그, 그 밖에는 헤더.
<head>가 있으면 <meta> 태그를 사용하세요. PDF, 이미지, 비 HTML 파일이거나 전체 디렉터리에 적용해야 한다면 같은 규칙 어휘를 다른 방식으로 전달하는 X-Robots-Tag 헤더를 사용합니다.
변경 내역
2026년 8월 9일에 업데이트됨.
편집 요약 및 기록된 변경 세부 정보입니다.변경 세부 정보
-
변경 세부 정보는 현재 영어로 제공됩니다.
전체 비교를 사용할 수 없음 — 이 수정에 대한 이전 스냅샷이 보관되지 않았습니다.
2026년 8월 8일에 업데이트됨.
편집 요약 및 기록된 변경 세부 정보입니다.변경 세부 정보
-
변경 세부 정보는 현재 영어로 제공됩니다.
전체 비교를 사용할 수 없음 — 이 수정에 대한 이전 스냅샷이 보관되지 않았습니다.
2026년 7월 18일에 업데이트됨.
편집 요약 및 기록된 변경 세부 정보입니다.변경 세부 정보
-
변경 세부 정보는 현재 영어로 제공됩니다.
-
변경 세부 정보는 현재 영어로 제공됩니다.
-
변경 세부 정보는 현재 영어로 제공됩니다.
-
변경 세부 정보는 현재 영어로 제공됩니다.
-
변경 세부 정보는 현재 영어로 제공됩니다.
전체 비교를 사용할 수 없음 — 이 수정에 대한 이전 스냅샷이 보관되지 않았습니다.