robots.txt 체커
어떤 사이트의 robots.txt를 가져와 특정 크롤러가 경로에 접근할 수 있는지 테스트 — 실제 크롤 규칙에 따라 평가하고 결정한 규칙을 표시합니다.
⚠️ 이 사이트를 확인할 수 없습니다
- 테스트 경로
- 규칙 그룹
- 결정한 규칙
원본 robots.txt
자주 묻는 질문
결과는 실제로 무엇을 의미하나요?
판정은 하나의 (크롤러, 경로) 조합에 대한 것입니다: 사이트의 실제 robots.txt에 따라 "허용" 또는 "차단". 페이지에는 규칙이 어느 user-agent 그룹에서 왔는지, 어떤 규칙이 결정했는지가 표시됩니다. 평가는 RFC 9309를 정확히 따릅니다: 가장 긴 일치 패턴이 이기고, 같은 길이면 Allow가 우선이며, 별표는 슬래시를 포함한 모든 문자, 끝의 $는 고정, 일치 규칙이 없으면 모두 허용. 빈 값의 Disallow는 효과가 없습니다(주요 검색엔진과 동일).
왜 Googlebot이 Googlebot-News, Googlebot-Image도 포함하나요?
RFC 9309는 user-agent 그룹이 봇 토큰의 대소문자 구분 없는 PREFIX로 일치한다고 규정합니다. "Googlebot"용 그룹은 Googlebot-News, Googlebot-Image, Googlebot-Video 등에도 적용됩니다. 사이트는 이를 이용해 한 규칙으로 패밀리 전체를 다룹니다. 정확한 이름("GPTBot", "Baiduspider-image" 등)을 입력할 수도 있습니다. 해당 그룹이 있으면 그 규칙만 적용됩니다.
이 도구가 제 페이지를 로드하나요? robots.txt는 어디서 오나요?
대상의 /robots.txt만 가져오고 페이지 자체는 절대 로드하지 않습니다. 브라우저는 다른 오리진의 robots.txt를 직접 읽을 수 없으므로(CORS) 이 사이트의 서버가 대신 가져옵니다. 가져오기는 속도 제한, 512KB 상한, 최대 3회 리다이렉트, 사설/예약 주소 거부를 적용합니다. 파일은 전부 브라우저에서 분석되며, 계정이 필요 없고 URL이 저장되지 않습니다.
체커가 검증하는 항목
- 가져오기 상태 — 파싱 전에 상태 코드, 리디렉션 체인, content-type을 확인합니다. /robots.txt 위치에서 HTML 페이지가 응답하면 명확하게 실패를 알립니다.
- 지시문 감사 — 알 수 없는 지시문은 표시되고(크롤러가 무시함) crawl-delay는 주요 봇 한도 기준으로 타당성이 점검됩니다.
- URL 시뮬레이션 — 경로를 붙여넣으면 각각 허용/차단 판정과 함께 일치한 규칙 줄을 그대로 인용해 보여줍니다.
- Sitemap 존재 확인 — Sitemap 선언을 추출해 접근 가능 여부까지 확인합니다.
봇이 보는 방식 그대로 robots.txt 보기
가져오기, 파싱, 시뮬레이션 — 모든 Disallow 규칙을 사용자 URL에 대해 테스트하고 경로별 판정을 보여줍니다.
실제 규칙으로 실제 판정
실제 robots.txt를 가져와 검색엔진과 동일한 기준으로 평가 — RFC 9309 최장 매칭, 길이 같으면 Allow 우선, 접두사 그룹. 추측 없음.
결정한 줄을 표시
"허용 / 차단" 배지뿐 아니라 판정의 근거가 된 규칙과 user-agent 그룹까지 보여줘 이유와 수정점을 알 수 있습니다.
페이지 로드 없음·가입 없음·무료
공개 robots.txt만 가져옵니다(귀하의 페이지는 절대). 속도 제한·512KB 상한·사설 주소 거부 리더를 사용하며 계정도 크레딧도 필요 없습니다.
관련 도구
robots.txt 체커란?
robots.txt 체커는 사이트의 robots.txt를 가져와 크롤 에이전트가 무엇을 가져올 수 있는지 정확히 알려줍니다 — 주요 검색엔진과 동일한 평가 방식입니다. robots.txt는 모든 사이트가 게시할 수 있는 작은 공개 텍스트 파일로, 어떤 경로를 크롤러가 가져올 수 있는지/없는지를 선언합니다(예: "Disallow: /admin/", "Allow: /public/", User-agent 줄 아래 크롤러별로 그룹화). 보안 경계는 아니지만 검색엔진과 봇에 크롤 선호도를 전하는 수단이며, 규칙을 잘못 쓰면 페이지가 실수로 Google에서 숨겨지는 흔한 원인이 됩니다. 이 도구는 그 파일을 읽고 RFC 9309 매칭 규칙을 적용합니다: 가장 긴 패턴 우선, 같은 길이 Allow 우선, 별표는 모든 문자, 끝 $는 고정, 그룹은 봇 이름의 대소문자 무시 접두사로 적용.
이 도구가 표시하는 것
- 정확한 (경로, 크롤러) 쌍에 대한 즉시 "허용 / 차단" 판정
- 결정한 규칙과 그 user-agent 그룹
- robots.txt 응답의 HTTP 상태(404 = 전부 허용)
- 그룹·일치 규칙·sitemap 줄 수 집계
- 확인용 원본 robots.txt
언제 사용할까
- 새 섹션 출시 전에 Googlebot이 크롤 가능한지 확인
- 검색결과에서 사라진 페이지 디버깅 — robots 규칙이 차단하는지
- Allow 덮어쓰기가 이전 Disallow보다 실제로 우선하는지 검증(흔한 실수)
- 새 봇(AI 크롤러, 이미지 봇) 추가 시 사용 가능한 경로 확인
개인정보 안내: 이 도구는 입력한 URL을 이 사이트 서버로 보내 대상의 공개 robots.txt만 가져옵니다 — 귀하의 페이지는 절대 로드되지 않습니다. 분석은 브라우저에서 완료되며, 결과는 대역폭 절약을 위해 잠깐 캐시되고, 계정이 필요 없으며 귀하에 대해 아무것도 저장하지 않습니다.