Нажмите Ctrl+D, чтобы добавить страницу в закладки
Генератор Robots. txt — это бесплатный онлайн-инструмент, который легко создаёт файлы robots. txt для управления доступом поисковых роботов.
Как использовать Генератор robots.txt?
Выберите пользовательский агент (робот).
Задайте правила путей Allow и Disallow.
Добавьте URL-адрес карты сайта и скопируйте сгенерированный robots.txt.
Часто задаваемые вопросы о Генератор robots.txt
Что такое robots.txt?
robots.txt — это текстовый файл, размещённый в корне сайта, который сообщает поисковым роботам, какие страницы сканировать или игнорировать.
Может ли robots.txt полностью скрыть страницы из результатов поиска?
Нет. robots.txt управляет только сканированием — страницы всё равно могут появляться в результатах поиска, если на них ссылаются другие сайты. Для полного удаления используйте мета-тег noindex.
Как запретить ИИ-краулерам использовать мой сайт для обучения?
В robots.txt перечислите официально объявленные краулеры — GPTBot, ClaudeBot, PerplexityBot и другие — и пропишите для них Disallow. Более новый подход, Content-Signal, позволяет одной строкой указать разрешения по назначению, например search=yes, ai-train=no. Помните, что robots.txt — просьба, которую соблюдают лишь добровольно подчиняющиеся краулеры, а не техническая блокировка: то, что действительно нельзя забирать, должно быть за логином.
Может ли ошибка в robots.txt выбросить весь сайт из поиска?
Да — одна строка Disallow: / исключает весь сайт из обхода. Выкатить в продакшн robots.txt тестового сервера, забыв убрать эту строку, — по-настоящему частая авария. Открывайте robots.txt в браузере сразу после каждого деплоя и проверяйте ключевые страницы тестером robots.txt в Google Search Console. Восстановление после выпадения из индекса занимает от нескольких дней до недель, уже после исправления файла.
Советы по эффективному использованию Генератор robots.txt
robots.txt закрывает только обход; чтобы убрать страницу из выдачи, нужен мета-тег noindex.
Для YandexBot можно задать отдельный блок User-agent со своими правилами.
В конце файла добавьте строку Sitemap: https://... с абсолютным адресом.