검색 노출 · 문제 · 검증됨

robots.txt에 의해 차단됨

Google Search Console에서 페이지 URL이 robots.txt 규칙에 의해 크롤링이 막혔다고 보고되는 상태입니다.

핵심 답변

"robots.txt에 의해 차단됨"은 Google 크롤러가 robots.txt의 disallow 규칙 때문에 해당 URL을 크롤링하지 못했다는 뜻입니다. robots.txt는 크롤링을 제어할 뿐 색인을 막는 수단이 아니므로, 색인 자체를 원치 않으면 disallow가 아니라 noindex 같은 별도 방법을 사용해야 합니다.

상세 설명

**"robots.txt에 의해 차단됨"**은 Google 크롤러가 robots.txt의 규칙 때문에 해당 URL을 크롤링하지 못했다고 Google Search Console이 보고하는 상태입니다. robots.txt는 사이트의 어떤 URL에 크롤러가 접근할 수 있는지 알려 크롤러 트래픽을 관리하는 파일입니다.

핵심은 robots.txt가 크롤링을 제어할 뿐 색인을 직접 막는 수단이 아니라는 점입니다.

크롤링 차단과 색인은 다릅니다

Google 문서는 robots.txt에 대해 "웹 페이지를 Google에서 제외하기 위한 수단이 아니다"라고 명시합니다. disallow로 크롤링이 막힌 페이지라도 다른 사이트에서 링크되면 URL과 앵커 텍스트 같은 공개 정보가 검색 결과에 나타날 수 있으며, 이때 결과에는 설명(스니펫)이 없습니다.

목적적절한 방법
크롤러의 접근·트래픽 제어robots.txt의 disallow
검색 결과 색인 자체를 막기noindex 또는 접근 제한

즉 색인을 원치 않는다는 이유로 disallow를 사용하면, Google이 페이지 내용을 크롤링하지 못해 noindex를 읽을 수도 없게 되어 오히려 검색 결과에서 URL이 남는 결과로 이어질 수 있습니다.

disallow 규칙이 어떻게 일치하는지 확인합니다

robots.txt의 규칙은 user-agent로 적용 대상 크롤러를 지정하고 disallow로 접근을 막을 경로를 지정합니다. 경로는 접두사 방식으로 일치하며 대소문자를 구분합니다. 예를 들어 disallow: /fish/fish, /fish.html, /fishheads/를 막지만 /Fish.asp는 막지 않습니다. *(0개 이상 문자)와 $(URL 끝) 와일드카드를 제한적으로 지원하며, 규칙이 충돌하면 Google은 가장 덜 제한적인 규칙을 적용합니다.

문제 URL이 어떤 disallow 규칙과 일치하는지 먼저 특정한 뒤에 조치를 결정해야 합니다.

상황별 조치

크롤링되어야 하는데 막힌 경우라면, 대상 경로를 막는 disallow 규칙을 제거하거나 범위를 좁혀 해당 URL이 더 이상 규칙에 일치하지 않도록 합니다. 규칙을 넓게 바꾸면 의도하지 않은 하위 경로까지 영향을 받을 수 있으므로, 변경 전에 어떤 경로가 일치하는지 확인하고 기존 규칙을 보관해 되돌릴 수 있게 합니다.

색인 자체를 원치 않는 경우라면 disallow만으로는 부족합니다. Google 문서는 색인을 막으려면 robots.txt 규칙과 별개로 noindex 같은 방법을 사용하라고 안내합니다.

++규칙을 수정한 뒤에는 색인 재검사 목록을 따라 대상 URL이 의도한 크롤링·색인 상태가 되는지 다시 확인합니다.++

현재 증상

  • robots.txt 차단

확인 순서

  1. robots.txt 파일에서 해당 경로를 막는 disallow 규칙과 적용 대상 user-agent가 있는지 확인합니다. 기대 결과는 문제 URL이 어떤 규칙과 일치하는지 특정되는 것입니다.
  2. 크롤링을 허용해야 하는 URL이라면 disallow 규칙을 제거하거나 경로를 좁힌 뒤, 대상 URL이 더 이상 규칙에 일치하지 않는지 확인합니다.
  3. 반대로 색인을 원치 않는 URL이라면 disallow만으로는 검색 결과 노출을 막지 못하므로, noindex 또는 접근 제한이 적용됐는지 확인합니다.

주의할 조치

  • disallow 규칙을 넓게 잡으면 의도하지 않은 하위 경로까지 크롤링이 막힐 수 있으므로, 규칙 변경 전 어떤 경로가 일치하는지 확인하고 이전 규칙을 보관해 되돌릴 수 있게 합니다.
  • 색인을 막으려는 목적으로 disallow를 사용하지 않습니다. 크롤링이 막힌 URL은 외부 링크가 있으면 설명 없이 검색 결과에 계속 나타날 수 있습니다.
  • robots.txt는 비공개나 보안 목적의 수단이 아니므로, 민감한 페이지 보호에는 접근 제한 같은 다른 방법을 사용합니다.

색인 상태 점검 후 확인

색인 상태를 점검한 뒤에는 URL 검사 도구의 색인 판정, 실제 페이지 버전의 색인 가능 여부, 사이트맵 반영 상태, 그리고 시간이 지난 후 재검사 결과를 확인해야 합니다. 색인 요청이나 사이트맵 등록만으로 색인이 보장되지 않으므로 한 번의 확인으로 단정하지 않습니다.

  • Google Search Console의 URL 검사 도구에서 대상 URL이 "URL is on Google"로 표시됩니다.
  • 라이브 테스트에서 현재 페이지 버전이 색인 가능한 상태로 확인됩니다.
  • 사이트맵에 대상 URL이 포함되어 있고 Search Console이 사이트맵을 정상적으로 읽었습니다.
  • 색인 요청 또는 설정 수정 이후 시간이 지난 뒤 재검사에서 동일한 색인 판정이 유지됩니다.

근거와 출처

Google 공식 문서

확인 범위: definition, crawl-not-index, still-appears-in-results, not-a-blocking-mechanism · 확인일: 2026-07-23

Google 공식 문서

확인 범위: disallow-syntax, crawl-not-index, use-noindex-to-block-indexing · 확인일: 2026-07-23