이런 분께 유용합니다
- 새 사이트의 기본 robots.txt를 작성하려는 운영자
- 관리자·검색 결과·임시 경로의 크롤링 규칙을 정리하려는 개발자
- Sitemap 위치와 User-agent별 Allow·Disallow 규칙을 한 번에 확인하려는 사용자
Developer SEO Utility
검색엔진 크롤러의 접근 허용·차단 경로와 Sitemap 주소를 입력해 robots.txt 파일 내용을 자동으로 생성할 수 있습니다.
사이트 주소, 크롤러 대상, 허용 경로, 차단 경로, Sitemap 주소를 입력하세요.
일반적으로 공개 페이지는 허용하고, 관리자·검색 결과·비공개 경로는 차단합니다. 단, robots.txt는 보안 장치가 아니므로 민감한 페이지는 반드시 서버 권한으로 보호해야 합니다.
Sitemap 주소 자동 생성에 사용됩니다. 예: https://win-j.com
전체 검색봇에 적용하려면 * 를 사용합니다.
일부 검색엔진만 지원하는 선택 규칙입니다. Googlebot은 Crawl-delay를 지원하지 않습니다.
한 줄에 하나씩 입력하세요. 예: /utility/
검색엔진에 노출하지 않을 경로를 입력하세요.
비워두면 사이트 주소 기준으로 /sitemap.xml을 자동 생성합니다.
자주 사용하는 robots.txt 규칙을 체크만으로 추가할 수 있습니다.
아래 내용을 사이트 루트 경로의 robots.txt 파일로 저장하면 됩니다.
설정을 입력한 뒤 robots.txt 생성하기 버튼을 눌러주세요.
robots.txt 파일은 사이트 루트 경로에 위치해야 합니다. 예를 들어 https://example.com/robots.txt 형태로 접근 가능해야 합니다.
robots.txt는 검색엔진 크롤러에게 안내하는 규칙일 뿐, 보안 장치가 아닙니다. 민감한 관리자 페이지나 비공개 데이터는 반드시 서버 인증과 권한 제어로 보호해야 합니다.
robots.txt는 크롤링을 제한하는 규칙입니다. 이미 색인된 페이지를 제거하려면 noindex, 삭제 요청, canonical 정리 등을 함께 고려해야 합니다.
필수는 아니지만 검색엔진이 사이트 구조를 파악하는 데 도움이 되므로 robots.txt에 Sitemap 주소를 함께 넣는 것을 권장합니다.
robots.txt는 검색봇이 어느 경로를 수집해도 되는지 알려주는 공개 규칙 파일입니다. 접근 권한이나 검색 결과 제외를 보장하지 않으므로, 생성 결과를 적용하기 전에 크롤링·색인·보안을 서로 다른 문제로 구분해야 합니다.
사이트의 공개 URL, 검색 결과, 관리자와 임시 경로를 먼저 분류합니다.
전체 검색봇에는 *를, 특정 검색봇에는 해당 봇의 공식 product token을 입력합니다.
한 줄에 한 경로씩 Allow와 Disallow를 작성하고 중복 규칙을 제거합니다.
Crawl-delay가 필요한 경우 대상 검색엔진이 실제로 지원하는지 공식 문서에서 확인합니다.
Sitemap은 접근 가능한 절대 URL로 입력하고 생성 결과를 사이트 루트의 robots.txt와 비교합니다.
배포 후 각 검색엔진의 검사 도구와 서버 로그에서 의도한 크롤링 동작을 다시 확인합니다.
Disallow는 접근 제어나 완전한 검색 제외 명령이 아니므로 민감 정보는 인증으로 보호해야 합니다.
Sitemap 줄은 검색봇이 사이트맵 위치를 찾도록 돕지만 사이트맵의 URL 품질까지 검증하지는 않습니다.
User-agent는 * 또는 영문자로 시작하는 영문·숫자·하이픈·밑줄 토큰인지 확인합니다. Allow와 Disallow는 공백 줄을 제거하고 각 목록 안에서 중복을 제거하며 합계 10,000줄까지만 처리합니다. 사이트와 Sitemap 주소는 http 또는 https 절대 URL인지 검사한 뒤 입력된 순서대로 텍스트를 조합합니다.
입력한 사이트 주소와 경로는 현재 브라우저에서만 조합되며 서버에 저장하지 않습니다. 경로 이름 자체가 내부 시스템 구조를 드러낼 수 있으므로 공개하면 안 되는 비밀 식별자는 입력하지 마세요.
검색 노출이 필요한 대표 URL을 사이트맵 XML로 정리합니다.
붙여넣은 HTML에서 대표 URL 신호의 누락과 중복을 확인합니다.
아닙니다. robots.txt는 크롤링을 제어하지만 색인 제외를 보장하지 않습니다. 검색 제외가 목적이라면 페이지 접근을 허용한 상태의 noindex, 삭제 또는 인증 같은 적절한 방법을 검토하세요.
Googlebot은 robots.txt의 Crawl-delay를 지원하지 않습니다. 서버 부하 문제는 캐시·응답 성능과 Google이 제공하는 별도 설정 가능 여부를 함께 확인해야 합니다.
아닙니다. robots.txt는 공개되고 규칙 준수도 크롤러에 달려 있습니다. 관리자와 비공개 데이터는 로그인, 권한 검사와 네트워크 정책으로 보호해야 합니다.