Skip to content
Robots.txt 생성기
Tools

Robots.txt 생성기

신규

허용/차단 규칙과 사이트맵 줄이 있는 유효한 robots.txt 생성.

Quick presets
Generated robots.txt
Test a URL Check whether your rules allow or block a path — same longest-match logic Google uses.

Disallow blocks crawling, not indexing. A blocked URL can still appear in Google if other sites link to it. To remove a page from search results, keep it crawlable and add a noindex meta tag or X-Robots-Tag header. robots.txt is also a public file and is not a security measure — protect private pages with real authentication.

robots.txt syntax cheat-sheet
Directive What it does
User-agent: *Which crawler the rules apply to (* = all bots).
Disallow: /pathAsk crawlers not to crawl URLs that start with this path.
Allow: /pathPermit a path, typically an exception inside a disallowed area.
Crawl-delay: 10Seconds between requests. Bing & Yandex honor it; Google ignores it.
Sitemap: https://…Absolute URL of your sitemap. Can appear anywhere in the file.
*Wildcard — matches any sequence of characters in a path.
$Anchors a rule to the end of the URL, e.g. /*.pdf$.
#A comment — the rest of the line is ignored by crawlers.

Runs entirely in your browser. Nothing is uploaded.

브라우저에서 바로 실행되는 무료 robots.txt 생성기

robots.txt 생성기는 간단한 폼 입력만으로 유효한 robots.txt 파일을 만들어 줍니다 — 문법을 외울 필요도, 설치할 것도 없습니다. 프리셋을 선택하거나 직접 크롤링 규칙을 작성하면 파일이 실시간으로 조립되며, 완성 후에는 복사하거나 다운로드해 사이트 루트에 올리면 됩니다. 모든 작업이 브라우저 내에서 로컬로 처리되므로 작성한 규칙이 서버로 전송되는 일이 없습니다.

빠르게 참고할 수 있는 robots.txt 예시가 필요하든, 특정 크롤러용 커스텀 robots.txt가 필요하든, WordPress·Blogger용 파일이나 AI 학습 봇을 차단하는 설정이 필요하든 몇 초 안에 완성할 수 있습니다. 내장된 경로 테스터로 배포 전에 규칙을 검증할 수 있어 대부분의 경쟁 생성기와 차별화됩니다.

문법 암기 없이 크롤링 규칙 작성하기

각 규칙 그룹은 User-agentAllow 또는 Disallow할 경로, 선택적으로 Crawl-delay를 묶어서 구성합니다. *를 사용하면 모든 크롤러를 대상으로 하고, Googlebot이나 Bingbot 같은 특정 봇 이름을 입력하면 자동 완성으로 주요 크롤러를 추천해 줍니다. 봇마다 다른 규칙을 적용하려면 그룹을 여러 개 추가하면 됩니다.

경로는 한 줄에 하나씩 입력하면 도구가 올바른 Disallow: 또는 Allow: 지시어로 변환하고 그룹을 올바른 순서로 연결합니다. 사이트맵 URL을 입력하면 절대 경로 Sitemap: 줄로 추가되어 크롤러가 색인화할 모든 페이지를 찾을 수 있도록 안내합니다. Google 크롤러는 이 정보를 Search Console에 직접 제출한 사이트맵과 함께 활용합니다.

WordPress, Blogger, AI 봇 차단 프리셋

클릭 한 번으로 미리 만들어진 설정을 불러올 수 있습니다. 전체 허용전체 차단은 양 극단을 커버합니다. WordPress 프리셋은 권장 기본값을 불러옵니다: /wp-admin/을 차단하되 플러그인이 필요로 하는 AJAX 호출을 위해 /wp-admin/admin-ajax.php는 열어둡니다. Blogger 프리셋은 구글이 권장하는 Blogger 설정을 불러옵니다: 중복 콘텐츠 문제를 피하기 위해 /search를 제외한 모든 경로를 허용합니다.

AI 봇 차단 프리셋은 콘텐츠를 Google과 Bing에는 유지하면서 AI 모델 학습에 사용되지 않도록 하고 싶을 때 유용합니다. GPTBot(OpenAI), CCBot(Common Crawl), Google-Extended(Gemini), ClaudeBot(Anthropic), PerplexityBot 등을 차단하면서 일반 검색 크롤러는 그대로 둡니다. 뉴욕타임스, 가디언 등 주요 언론사들이 2023년에 유사한 차단 조치를 추가했습니다.

배포 전에 URL 테스트하기

테스트 기능 없는 생성기는 절반만 하는 것입니다. 내장된 경로 테스터에 URL이나 경로와 크롤러 이름을 입력하면 현재 규칙이 해당 경로를 허용하는지 차단하는지 알려주고, 어떤 Allow 또는 Disallow 규칙이 적용되는지 정확히 보여줍니다 — Google이 적용하는 것과 동일한 최장 일치(longest-match) 로직을 사용합니다(가장 구체적인 규칙이 우선 적용되며 길이가 같으면 Allow가 우선).

입력하는 동안 도구는 실제 robots.txt 파일을 조용히 망가뜨리는 실수들을 실시간 경고로 알려줍니다: 경로 앞의 슬래시 누락, 상대 경로로 작성된 사이트맵 URL, Googlebot을 대상으로 한 Crawl-delay(Googlebot은 이를 무시하며 Search Console에서 별도로 설정해야 합니다) 등입니다. 배포 전에 이를 수정하면 Google Search Console에서 디버깅하는 수고를 덜 수 있습니다.

크롤링 vs 색인화 — 그리고 자주 하는 실수들

가장 흔한 robots.txt 오해: Disallow가 페이지를 Google에서 제거한다는 것입니다. 그렇지 않습니다. 크롤링을 막을 뿐이며, 차단된 URL도 다른 페이지가 링크하고 있으면 검색 결과에 여전히 나타날 수 있습니다. Google이 스니펫 없이 URL만 표시하는 경우도 있습니다. 페이지를 검색에서 제외하려면 크롤링은 허용하고 페이지 자체에 noindex를 추가하세요. robots.txt로 차단하면 Google이 페이지를 크롤링하지 못해 noindex를 읽을 수 없고, URL이 색인에 무기한으로 남을 수 있습니다.

robots.txt는 공개 파일이며 권고적 성격임을 기억하세요. 고정된 URL에서 누구나 읽을 수 있으며 보안 장벽이 아닙니다. 규칙을 준수하는 봇만 따를 뿐입니다. 크롤링 예산을 안내하고 중복되거나 얇은 콘텐츠 페이지를 정리하는 데 활용하세요 — 실제로 보호가 필요한 것을 숨기는 용도로는 쓰지 마세요. 그런 용도에는 인증을 사용하세요. 이 생성기는 전적으로 브라우저에서 실행되므로 사이트의 내부 경로가 기기를 떠나지 않습니다.

Frequently asked questions

robots.txt는 어디에 사용하나요?

robots.txt는 사이트 루트에 위치한 일반 텍스트 파일로, 검색엔진 크롤러에게 어떤 URL을 요청할 수 있는지 알려줍니다. 예를 들어 Disallow: /cart/는 크롤러에게 장바구니 페이지를 건너뛰도록 요청하여 SEO에 실제로 중요한 페이지에 크롤링 예산을 사용하게 합니다. 이는 Google, Bing 등 주요 크롤러가 준수하는 로봇 배제 프로토콜(RFC 9309로 표준화)의 일부입니다 — 단, 크롤링을 제어할 뿐 접근 권한이나 보안을 제어하지는 않습니다. 누구나 yoursite.com/robots.txt에서 파일을 읽을 수 있으므로 개인정보 보호 도구가 아닙니다.

robots.txt 파일을 어떻게 만드나요?

위의 빌더를 사용하세요: 프리셋을 선택하거나 규칙 그룹을 추가하고, User-agent를 설정(모든 크롤러에는 *를 사용)하고, Disallow 또는 Allow할 경로를 나열하고, 필요하면 Crawl-delay를 추가하고, 사이트맵 URL을 붙여넣습니다. 입력하는 즉시 출력이 업데이트됩니다 — 복사 또는 다운로드를 클릭해 robots.txt로 저장한 뒤 https://yoursite.com/robots.txt에서 접근 가능하도록 사이트 루트 폴더에 업로드하세요. 코딩이 필요 없으며, 경로 테스터로 배포 전에 규칙을 확인할 수 있습니다.

technicalseo.com이나 seoptimer.com 같은 다른 robots.txt 생성기와 어떻게 다른가요?

TechnicalSEO.com의 robots.txt 생성기와 SEOptimer는 유효한 파일을 만들어 주지만, 특정 URL에 어떤 규칙이 적용되는지 보여주는 내장 경로 테스터가 없습니다. 이 도구는 다릅니다: 경로와 크롤러 이름을 입력하면 Google이 적용하는 것과 동일한 최장 일치 로직을 사용해 현재 규칙이 허용인지 차단인지 알려줍니다. 또한 실시간으로 일반적인 실수를 감지합니다 — 경로 앞 슬래시 누락, 상대 경로 사이트맵 URL, Googlebot을 대상으로 한 Crawl-delay(Googlebot은 무시함). 이 모든 것이 서버에 데이터를 전송하지 않고 브라우저에서 실행됩니다.

robots.txt 파일은 어디에 두어야 하나요?

도메인의 루트 디렉터리에 위치하여 정확히 https://yoursite.com/robots.txt에서 제공되어야 합니다 — /blog/robots.txt 같은 하위 폴더에 넣으면 크롤러가 무시합니다. 각 서브도메인에는 별도의 파일이 필요하므로 blog.yoursite.com과 shop.yoursite.com에는 각각 별도의 robots.txt가 필요합니다. WordPress에서는 FTP나 호스팅 파일 관리자를 통해 업로드하거나(또는 Yoast SEO 같은 플러그인이 자동으로 관리해 줌) Blogger에서는 설정 → 검색 환경설정에서 커스텀 robots.txt를 활성화하면 됩니다.

robots.txt에서 User-agent는 무엇인가요?

User-agent는 규칙 블록이 적용될 크롤러를 지정합니다. User-agent: *는 모든 크롤러를 대상으로 하고, User-agent: Googlebot은 Google의 메인 웹 크롤러만 대상으로 합니다. 여러 그룹을 사용할 수 있어 예를 들어 모든 봇은 허용하되 GPTBot만 차단하는 설정이 가능합니다. 각 크롤러는 자신의 이름과 일치하는 가장 구체적인 그룹을 따릅니다. 주요 값으로는 Googlebot, Bingbot, Googlebot-Image, GPTBot(OpenAI의 ChatGPT 학습에 사용), CCBot(많은 AI 학습 데이터셋에 사용되는 Common Crawl), Google-Extended(구글의 Gemini에 사용), PerplexityBot이 있습니다.

Allow와 Disallow의 차이는 무엇인가요?

Disallow는 크롤러에게 일치하는 URL을 가져오지 말도록 요청하고, Allow는 허용합니다. Allow는 주로 차단된 폴더 내에서 예외를 만들 때 사용합니다. 예를 들어 Disallow: /wp-admin/ 뒤에 Allow: /wp-admin/admin-ajax.php를 추가하면 WordPress 관리자 영역을 차단하면서 크롤러가 필요로 하는 AJAX 파일 하나만 열어둡니다. 규칙이 충돌할 때 Google은 가장 구체적인(가장 긴) 일치 경로를 따르며, 길이가 같으면 Allow가 우선입니다. Bing도 같은 로직을 사용하며, Yandex는 경계 사례에서 약간 다릅니다.

robots.txt에 사이트맵을 어떻게 추가하나요?

전체 절대 URL로 Sitemap: 줄을 추가하세요. 예: Sitemap: https://example.com/sitemap.xml. 파일 어디에나 위치할 수 있으며 특정 User-agent 그룹에 묶이지 않고, 여러 사이트맵을 별도 줄에 나열할 수 있습니다. 위의 사이트맵 필드에 URL을 붙여넣으면 도구가 올바른 위치에 줄을 추가합니다. Google 문서에서는 Search Console에 사이트맵을 직접 제출하는 방법과 함께 이 방식을 권장하며, 두 방법 모두 Google이 모든 페이지를 발견하는 데 도움이 됩니다.

페이지를 Google 검색에서 차단하려면 어떻게 하나요?

Google의 크롤링을 막으려면 해당 경로에 Disallow: 규칙을 추가하세요. 예: Disallow: /draft-page/. 그러나 크롤링 차단이 검색 결과에서 제거되는 것과 같지 않습니다 — 차단된 URL도 다른 사이트가 링크하면 색인될 수 있습니다. 페이지를 Google 결과에서 완전히 제외하려면 noindex 지시어(meta name='robots' content='noindex')나 X-Robots-Tag 헤더를 추가하고, robots.txt에서는 차단하지 마세요. 그렇지 않으면 Google이 페이지를 크롤링하지 못해 noindex 지시어를 읽을 수 없습니다.

robots.txt가 색인화를 막을 수 있나요?

아니요. robots.txt는 크롤링을 제어하지 색인화를 제어하지 않습니다. URL을 Disallow하면 Google이 콘텐츠를 가져오지 않지만, URL 자체는 다른 곳에서 링크되면 검색 결과에 여전히 나타날 수 있습니다 — 종종 설명 없이 URL만 표시됩니다. 페이지를 색인에서 제거하려면 페이지 자체에 noindex 지시어를 추가하고 페이지를 크롤링 가능한 상태로 두어 Google이 그 지시어를 읽을 수 있도록 하세요. 이것은 가장 흔한 SEO 실수 중 하나입니다: Disallow 규칙으로 페이지를 검색 결과에서 제거하려 했다가 페이지가 여전히 나타나는 이유를 모르는 경우입니다.

Google Search Console에서 'robots.txt에 의해 차단됨'은 무슨 의미인가요?

Google Search Console에서 'robots.txt에 의해 차단됨'은 Google이 URL을 발견했지만 robots.txt가 해당 URL을 크롤링하지 말라고 지시했기 때문에 해당 크롤링에서 페이지가 가져와지거나 색인화되지 않았다는 의미입니다. 페이지가 공개되어야 한다면 일치하는 Disallow 규칙을 제거하거나 좁혀서 수정하세요. 차단이 의도적인 경우(관리자 경로, 스테이징 환경, 얇은 콘텐츠 페이지 등)라면 그대로 두어도 됩니다. 이 생성기의 경로 테스터를 사용해 파일을 편집하기 전에 어떤 규칙이 해당 URL을 차단하는지 정확히 확인하세요.

crawl-delay란 무엇인가요?

Crawl-delay는 크롤러에게 서버 부하를 줄이기 위해 요청 사이에 지정된 초 수만큼 대기하도록 요청합니다. Crawl-delay: 10은 대략 10초에 한 번씩 요청한다는 의미입니다. Bing과 Yandex는 이를 준수하지만 Googlebot은 Crawl-delay를 완전히 무시합니다 — Google의 크롤링 속도는 Search Console의 크롤링 통계 보고서에서 설정하세요. 서버가 크롤링으로 인해 실제로 과부하가 걸리는 경우에만 Crawl-delay를 추가하세요. 높은 값은 사이트 색인화 속도를 늦춥니다.

WordPress 또는 Blogger용 robots.txt는 어떻게 만드나요?

위의 WordPress 또는 Blogger 프리셋을 클릭하세요. WordPress의 표준 파일은 관리자 영역을 차단하되 크롤러가 필요로 하는 Ajax 파일 하나는 열어둡니다: User-agent: * / Disallow: /wp-admin/ / Allow: /wp-admin/admin-ajax.php. Blogger의 기본값은 검색 페이지를 제외한 모든 것을 허용합니다: User-agent: * / Disallow: /search / Allow: /. 사이트맵 URL을 추가한 뒤 결과를 WordPress에 적용하거나(Yoast SEO를 통해 또는 FTP로 파일 업로드) Blogger의 설정 → 검색 환경설정 → 커스텀 robots.txt에 붙여넣으세요.

robots.txt를 테스트하거나 유효성을 검사하려면 어떻게 하나요?

이 도구의 경로 테스터를 사용하세요: URL이나 경로(예: /blog/post-1)와 크롤러 이름을 입력하면 현재 규칙이 허용인지 차단인지, 그리고 어떤 특정 규칙이 결정을 내리는지 알려줍니다 — Google이 적용하는 것과 동일한 최장 일치 로직을 사용합니다. 빌더는 또한 경로 앞의 슬래시 누락이나 상대 경로 사이트맵 URL 같은 일반적인 실수를 실시간으로 감지합니다. 배포 후에는 Google Search Console의 robots.txt 보고서에서 실제 파일을 확인하고 URL 검사 도구로 특정 페이지를 점검하세요.

robots.txt는 안전한가요?

robots.txt는 사용하기에 안전하지만 보안 도구가 아닙니다. yoursite.com/robots.txt에서 누구나 읽을 수 있는 공개 파일이므로 '비밀' 폴더를 나열하면 오히려 해당 폴더를 확인하는 모든 사람에게 알려주는 셈입니다. Google, Bing, Apple 같은 규칙을 준수하는 크롤러는 규칙을 따르지만 악성 봇은 완전히 무시할 수 있습니다. 민감한 페이지를 보호하려면 실제 인증(로그인, 비밀번호, IP 허용 목록) 또는 서버 측 접근 제어를 사용하세요. Disallow로 개인 데이터를 숨기려 하지 마세요.

AI 봇이 내 콘텐츠로 학습하는 것을 막으려면 어떻게 하나요?

각 AI 학습 크롤러에 대해 별도의 User-agent 그룹을 추가하고 각각 Disallow: /를 설정하세요. 주요 대상: GPTBot(OpenAI / ChatGPT), CCBot(많은 AI 학습 데이터셋에 사용되는 Common Crawl), Google-Extended(구글의 Gemini 및 Vertex AI), ClaudeBot(Anthropic / Claude), PerplexityBot, Applebot-Extended, meta-externalagent(Meta / Llama). 이 생성기의 'AI 봇 차단' 프리셋은 클릭 한 번으로 이 모든 것을 추가하면서 일반 검색 크롤러(Googlebot, Bingbot)는 그대로 두어 콘텐츠가 색인에 유지됩니다.