Генератор robots.txt
НовоеСоздайте корректный robots.txt с правилами allow/disallow и строкой sitemap.
Disallow blocks crawling, not indexing. A blocked URL can still
appear in Google if other sites link to it. To remove a page from search results, keep it crawlable
and add a noindex meta tag or X-Robots-Tag header. robots.txt is also a
public file and is not a security measure — protect private pages with real authentication.
robots.txt syntax cheat-sheet
| Directive | What it does |
|---|---|
| User-agent: * | Which crawler the rules apply to (* = all bots). |
| Disallow: /path | Ask crawlers not to crawl URLs that start with this path. |
| Allow: /path | Permit a path, typically an exception inside a disallowed area. |
| Crawl-delay: 10 | Seconds between requests. Bing & Yandex honor it; Google ignores it. |
| Sitemap: https://… | Absolute URL of your sitemap. Can appear anywhere in the file. |
| * | Wildcard — matches any sequence of characters in a path. |
| $ | Anchors a rule to the end of the URL, e.g. /*.pdf$. |
| # | A comment — the rest of the line is ignored by crawlers. |
Runs entirely in your browser. Nothing is uploaded.
Бесплатный генератор robots.txt прямо в браузере
Этот генератор robots.txt превращает простую форму в готовый robots.txt — никакого синтаксиса наизусть, ничего устанавливать не нужно. Выберите шаблон или создайте собственные правила обхода, наблюдайте за формированием файла в реальном времени, затем скопируйте или скачайте его и разместите в корне сайта. Всё работает локально в вашем браузере — написанные правила никогда не отправляются на сервер.
Нужен быстрый пример robots.txt, кастомный robots.txt для конкретного краулера или файл под WordPress, Blogger, или для блокировки ботов ИИ-обучения — всё готово за секунды. Встроенный тестер путей проверит ваши правила до публикации — этого нет у большинства конкурирующих генераторов.
Составляйте правила обхода без знания синтаксиса
Каждая группа правил связывает User-agent с путями, которые нужно Allow или Disallow, и опциональным Crawl-delay. Используйте *, чтобы охватить все краулеры, или укажите конкретного бота: Googlebot, YandexBot — начните вводить, и поле подскажет популярные краулеры. Добавляйте сколько угодно групп, чтобы задавать разным ботам разные правила.
Вводите один путь на строку; инструмент оформит каждый как корректную директиву Disallow: или Allow: и соберёт группы в правильном порядке. Добавьте URL Sitemap — он будет добавлен абсолютной строкой Sitemap:, которая направляет краулеры ко всем страницам, которые вы хотите проиндексировать. Google подхватит его наряду с картой сайта, поданной напрямую в Search Console.
Шаблоны для WordPress, Blogger и блокировки ИИ-ботов
Один клик — и готовая отправная точка. Разрешить всё и Запретить всё покрывают два крайних случая. WordPress загружает рекомендованный стандарт: запретить /wp-admin/, но оставить открытым /wp-admin/admin-ajax.php для AJAX-вызовов плагинов. Blogger загружает предложенную Google настройку: разрешить всё, кроме /search, чтобы избежать проблем с дублирующимся контентом.
Шаблон Блокировка ИИ-ботов пригодится, если вы хотите, чтобы контент оставался в Google и Яндексе, но не использовался для обучения ИИ-моделей. Он запрещает GPTBot (OpenAI), CCBot (Common Crawl), Google-Extended (Gemini), ClaudeBot (Anthropic), PerplexityBot и других — не трогая обычные поисковые краулеры. Подобные блокировки в 2023 году добавили The New York Times, The Guardian и многие крупные издания.
Тестируйте URL до публикации
Генератор без тестирования выполняет лишь половину работы. Встроенный тестер путей позволяет ввести любой URL или путь и имя краулера — и сразу показывает, разрешают или запрещают ваши текущие правила доступ, а также какая именно директива Allow или Disallow принимает решение, используя ту же логику наибольшего совпадения, что применяет Google (побеждает самое конкретное правило, при равной длине побеждает Allow).
По мере ввода инструмент в реальном времени показывает предупреждения об ошибках, которые незаметно ломают реальные robots.txt: путь без начального слэша, относительный URL карты сайта или Crawl-delay для Googlebot (который его игнорирует и требует отдельной настройки в Search Console). Устранить ошибки до публикации — значит сэкономить один лишний круг отладки через Google Search Console.
Обход и индексация — и другие распространённые ошибки
Главное заблуждение о robots.txt: Disallow убирает страницу из Google. Нет. Он останавливает обход, но заблокированный URL всё равно может появиться в результатах поиска, если на него ссылаются другие страницы. Google может даже проиндексировать его без сниппета — просто URL без описания. Чтобы страница не попала в поиск, оставьте её доступной для обхода и добавьте noindex прямо на странице. Если заблокировать её в robots.txt, Google не сможет обойти страницу и прочитать этот noindex — URL может бесконечно оставаться в индексе.
Помните и о том, что robots.txt публичен и носит рекомендательный характер. Он находится по фиксированному, доступному для чтения URL, не является барьером безопасности и соблюдается только добросовестными ботами. Используйте его для управления краулинговым бюджетом и устранения дублей или малоценных страниц — но не для сокрытия того, что действительно требует защиты. Для этого используйте аутентификацию. Данный генератор работает полностью в вашем браузере — внутренние пути вашего сайта не покидают устройство.
Frequently asked questions
Для чего нужен robots.txt?
robots.txt — это текстовый файл в корне сайта, который указывает поисковым краулерам, какие URL они могут или не могут запрашивать. Например, Disallow: /cart/ просит краулеры пропускать страницы корзины, чтобы краулинговый бюджет расходовался на страницы, важные для SEO. Это часть протокола Robots Exclusion Protocol (стандартизирован как RFC 9309), которого соблюдают Google, Bing, Яндекс и другие крупные краулеры. Но файл управляет обходом, а не доступом или безопасностью. Любой может прочитать ваш robots.txt по адресу yoursite.com/robots.txt — это не инструмент приватности.
Как создать файл robots.txt?
Воспользуйтесь конструктором выше: выберите шаблон или добавьте группу правил, задайте User-agent (используйте * для всех краулеров), перечислите пути для Disallow или Allow, при необходимости добавьте Crawl-delay и вставьте URL карты сайта. Результат обновляется в реальном времени по мере ввода — нажмите «Копировать» или «Скачать», сохраните файл как robots.txt и загрузите его в корневую папку сайта, чтобы он был доступен по адресу https://yoursite.com/robots.txt. Знание кода не требуется, а тестер путей проверит правила до публикации.
Чем этот генератор отличается от technicalseo.com или seoptimer.com?
Генератор robots.txt на TechnicalSEO.com и SEOptimer создают корректные файлы, но ни у одного нет встроенного тестера путей, который показывает, какое правило применяется к конкретному URL. Этот инструмент умеет: введите любой путь и имя краулера — он скажет, разрешают или запрещают ваши текущие правила доступ, используя ту же логику наибольшего совпадения, что применяет Google. Инструмент также в реальном времени отмечает типичные ошибки: отсутствующий начальный слэш, относительный URL карты сайта, Crawl-delay для Googlebot (который его игнорирует). Всё это работает в браузере без отправки данных на сервер.
Куда загружать файл robots.txt?
Файл должен находиться в корневом каталоге домена и быть доступен строго по адресу https://yoursite.com/robots.txt — не в подпапке вроде /blog/robots.txt, которую краулеры игнорируют. Каждый поддомен требует собственного файла: blog.yoursite.com и shop.yoursite.com нуждаются в отдельных robots.txt. На WordPress его можно загрузить по FTP или через файловый менеджер хостинга (или использовать плагин Yoast SEO, который управляет им автоматически). На Blogger включите кастомный robots.txt в разделе Настройки → Настройки поиска.
Что такое User-agent в robots.txt?
User-agent указывает краулер, к которому применяется блок правил. User-agent: * охватывает все краулеры, а User-agent: Googlebot — только основной веб-краулер Google. Можно создать несколько групп — например, разрешить всем, но заблокировать GPTBot — каждый краулер соблюдает наиболее специфичную группу, совпадающую с его именем. Распространённые значения: Googlebot, Bingbot, YandexBot, Googlebot-Image, GPTBot (OpenAI, обучение ChatGPT), CCBot (Common Crawl, используется многими датасетами ИИ), Google-Extended (Gemini), ClaudeBot (Anthropic), PerplexityBot.
В чём разница между Allow и Disallow?
Disallow просит краулер не обходить совпадающие URL; Allow — разрешает. Allow в основном используется для создания исключения внутри запрещённой папки. Например, Disallow: /wp-admin/ плюс Allow: /wp-admin/admin-ajax.php блокирует раздел администрирования WordPress, но пропускает один AJAX-файл, который нужен плагинам. При конфликте правил Google следует наиболее специфичному (длинному) совпадающему пути, а при равной длине побеждает Allow. Bing использует ту же логику; Яндекс в ряде крайних случаев ведёт себя немного иначе.
Как добавить карту сайта в robots.txt?
Добавьте строку Sitemap: с полным абсолютным URL, например Sitemap: https://example.com/sitemap.xml. Она может находиться в любом месте файла и не привязана ни к какой группе User-agent; можно указать несколько карт сайта на отдельных строках. Вставьте URL в поле Sitemap выше — инструмент поставит строку корректно. Документация Google рекомендует использовать этот способ вместе с прямой подачей карты сайта в Search Console, поскольку оба метода помогают Google обнаружить все страницы.
Как закрыть страницу от индексации в Google?
Чтобы Google не обходил страницу, добавьте для её пути правило Disallow:, например Disallow: /draft-page/. Но блокировка обхода — не то же самое, что удаление страницы из результатов: заблокированный URL всё равно может быть проиндексирован, если на него ссылаются другие сайты. Чтобы страница точно не попала в Google, добавьте директиву noindex (meta name='robots' content='noindex') или заголовок X-Robots-Tag — и не блокируйте страницу в robots.txt, иначе Google не сможет обойти её и прочитать инструкцию noindex.
Запрещает ли robots.txt индексацию?
Нет. robots.txt управляет обходом, а не индексацией. Если вы запретите URL через Disallow, Google не будет загружать его содержимое, но сам URL всё равно может появиться в результатах — нередко без описания — если на него ссылаются другие страницы. Чтобы удалить страницу из индекса, используйте директиву noindex на самой странице и оставьте её доступной для обхода, чтобы Google мог прочитать эту директиву. Это одна из самых распространённых SEO-ошибок: люди добавляют правила Disallow, чтобы убрать страницы из поиска, а затем удивляются, почему те продолжают там отображаться.
Что значит «заблокировано robots.txt» в Google Search Console?
В Google Search Console статус «Заблокировано robots.txt» означает, что Google обнаружил URL, но ваш robots.txt запретил его обходить — страница не была загружена или проиндексирована в ходе этого обхода. Если страница должна быть публичной, исправьте ситуацию, удалив или сузив соответствующее правило Disallow. Если блокировка намеренная — путь к административной панели, тестовому окружению или малоценной странице — её можно оставить. Используйте тестер путей в этом генераторе, чтобы точно увидеть, какое правило блокирует конкретный URL, прежде чем редактировать файл.
Что такое crawl-delay?
Crawl-delay просит краулер делать паузу в заданное количество секунд между запросами, чтобы снизить нагрузку на сервер. Crawl-delay: 10 означает примерно один запрос каждые 10 секунд. Bing и Яндекс соблюдают это значение; Googlebot полностью игнорирует Crawl-delay — для управления скоростью обхода Google настройте параметр в отчёте «Статистика обхода» в Search Console. Добавляйте Crawl-delay только если сервер действительно испытывает нагрузку от обхода, поскольку высокое значение замедляет индексирование сайта.
Как создать robots.txt для WordPress или Blogger?
Нажмите шаблон WordPress или Blogger выше. Стандартный файл для WordPress блокирует раздел администрирования, оставляя нужный краулерам Ajax-файл: User-agent: * / Disallow: /wp-admin/ / Allow: /wp-admin/admin-ajax.php. Шаблон для Blogger разрешает всё, кроме страниц поиска: User-agent: * / Disallow: /search / Allow: /. Добавьте URL карты сайта, затем скопируйте результат в WordPress (через Yoast SEO или загрузив файл по FTP) или вставьте в Blogger в разделе Настройки → Настройки поиска → Свой robots.txt.
Как протестировать или проверить robots.txt?
Воспользуйтесь тестером путей в этом инструменте: введите URL или путь (например /blog/post-1) и имя краулера — он покажет, разрешают или запрещают ваши текущие правила доступ, и какое конкретное правило Allow или Disallow решает это, используя ту же логику наибольшего совпадения, что применяет Google. Конструктор также в реальном времени предупреждает о типичных ошибках: путь без начального слэша, относительный URL карты сайта. После публикации проверьте живой файл в отчёте robots.txt Google Search Console и используйте инструмент проверки URL для отдельных страниц.
Безопасен ли robots.txt?
Использовать robots.txt безопасно, но это не инструмент защиты. Это публичный файл, который любой может прочитать по адресу yoursite.com/robots.txt — указание «секретной» папки в нём фактически рекламирует её всем желающим. Добросовестные краулеры — Google, Bing, Яндекс, Apple — соблюдают правила, но вредоносные боты могут их полностью игнорировать. Для защиты конфиденциальных страниц используйте настоящую аутентификацию (логин, пароли, ограничение по IP) или серверный контроль доступа. Никогда не полагайтесь на Disallow для сокрытия личных данных.
Как заблокировать ИИ-ботам обучение на своём контенте?
Добавьте отдельные группы User-agent для каждого ИИ-краулера обучения с Disallow: / для каждого. Основные из них: GPTBot (OpenAI / ChatGPT), CCBot (Common Crawl, используется многими датасетами ИИ), Google-Extended (Gemini и Vertex AI от Google), ClaudeBot (Anthropic / Claude), PerplexityBot, Applebot-Extended и meta-externalagent (Meta / Llama). Шаблон «Блокировка ИИ-ботов» в этом генераторе добавляет всех их одним кликом, не затрагивая обычные поисковые краулеры (Googlebot, Bingbot, YandexBot) — ваш контент остаётся проиндексированным.
Related tools
Все инструментыКонструктор UTM
Создавайте отслеживаемые URL кампаний с utm_source, medium, campaign и не только.
Предпросмотр сниппета SERP
Посмотрите, как заголовок и описание выглядят в Google на десктопе и мобильном.
Генератор слагов
Превратите любой заголовок в чистый SEO-слаг для URL — пакетно и с учётом диакритики.
Генератор мета-тегов
Генерируйте мета-теги SEO, Open Graph и Twitter Card с живым предпросмотром.
Проверка надёжности пароля
Оцените надёжность пароля по энтропии, времени взлома и получите советы.
Секундомер и таймер
Точный онлайн-секундомер с кругами и таймер обратного отсчёта с пресетами.