NEW CASE
Antana

Создаем цифровые решения, которые работают на бизнес


Зателефонуйте нам +38 (066) 35-14-529

Сделаем первый шаг к вашему сайту — напишите нам

Закрыть
Инструменты

Генератор robots.txt

Создайте корректный robots.txt: готовые пресеты для WordPress, OpenCart и интернет-магазина, блокировка лишних ботов и подключение Sitemap.

robots.txt

    

Готовый файл положите в корень сайта: example.com/robots.txt

Что такое robots.txt и как он работает

robots.txt — это обычный текстовый файл в корне сайта, который первым читает поисковый робот. В нём вы указываете, какие разделы можно обходить, а какие стоит пропустить. Файл состоит из блоков: сначала идёт User-agent (для какого робота правило), далее — Disallow и Allow.

Основные директивы

  • User-agent: * — правило для всех роботов сразу.
  • Disallow: /admin/ — запретить обход раздела.
  • Allow: /admin/ajax.php — исключение внутри запрещённого раздела.
  • Sitemap: — полный адрес карты сайта; можно указать несколько.
  • Crawl-delay: — пауза между запросами робота (Google игнорирует).

Самые частые ошибки

Первая и самая дорогая — забыть убрать Disallow: / после переезда с тестового домена. Сайт исчезает из поиска за несколько недель. Вторая — закрывать в robots.txt страницы, которые нужно убрать из индекса: робот перестанет их обходить, но уже проиндексированные адреса останутся в выдаче. Для удаления нужен метатег noindex, и страница при этом должна оставаться открытой для обхода. Третья — блокировать CSS и JS: Google не сможет отрендерить страницу и оценит мобильную версию хуже.

Что закрывать интернет-магазину

Страницы корзины, оформления заказа и личного кабинета обходить незачем. Отдельная история — фильтры и сортировка: адреса вроде /*?sort= создают тысячи почти одинаковых страниц и размывают краулинговый бюджет. Их стоит закрыть, а полезные комбинации фильтров — наоборот, сделать отдельными посадочными страницами с собственными текстами.

После загрузки файла проверьте его в Google Search Console: раздел «Настройки» → «robots.txt». Google покажет, когда файл последний раз прочитан и нет ли в нём ошибок.

Частые вопросы

Зачем нужен файл robots.txt?
robots.txt подсказывает поисковым роботам, какие разделы сайта обходить, а какие — нет. Это экономит краулинговый бюджет: робот не тратит время на корзину, личный кабинет или страницы фильтров, а быстрее доходит до товаров и статей. Важно понимать: robots.txt управляет обходом, а не индексацией. Чтобы страница гарантированно не попала в поиск, нужен метатег noindex.
Куда загружать robots.txt?
Только в корень домена — example.com/robots.txt. В подпапке (example.com/site/robots.txt) файл работать не будет, роботы его просто не ищут. Для поддомена нужен отдельный файл: blog.example.com имеет собственный robots.txt.
Можно ли закрыть сайт от Google полностью?
Да, пресет «Закрыть весь сайт» даёт директиву Disallow: / — её стоит ставить только на тестовых доменах. На рабочем сайте это самая дорогая ошибка в SEO: трафик исчезает в течение нескольких недель. Обязательно уберите эту директиву перед запуском и проверьте файл в Google Search Console.
Учитывает ли Google директиву Crawl-delay?
Нет, Google её игнорирует — скорость обхода настраивается в Search Console. А вот Bing и Yandex Crawl-delay понимают. Ставить её имеет смысл только тогда, когда боты реально нагружают сервер; в обычной ситуации оставьте 0.
Telegram Viber Позвонить