Адрес

г. Москва
Проспект Мира 101 с1

Robots.txt

  • 08.07.2026
  • 33

Robots.txt — это текстовый файл в корне сайта, который содержит правила обхода для поисковых и других роботов. Через него можно разрешать или запрещать сканирование отдельных разделов, служебных страниц, параметров, результатов поиска, фильтров и технических файлов. Обычно файл доступен по адресу site.ru/robots.txt.

Важно понимать: robots.txt управляет обходом, а не гарантированным удалением страницы из индекса. Если URL закрыт от сканирования, но на него есть внешние ссылки, поисковая система всё равно может знать о его существовании. Для удаления из индекса обычно используют другие механизмы: noindex, корректные коды ответа, canonical или удаление страницы.

Зачем нужен robots.txt

  • ограничивать обход технических и мусорных разделов;
  • экономить краулинговый бюджет на крупных сайтах;
  • закрывать параметры, фильтры, сортировки и внутренний поиск;
  • указывать путь к sitemap.xml;
  • разделять правила для разных поисковых роботов;
  • снижать риск индексации технических дублей.

Как robots.txt связан с SEO

Ошибки в robots.txt могут резко повлиять на SEO. Одна неверная директива способна закрыть от обхода весь сайт, важный каталог, изображения, CSS, JavaScript или страницы товаров. Поэтому файл нужно проверять перед публикацией и после каждого переезда, редизайна или смены CMS.

ЗадачаЧто учитывать
Закрыть фильтрыНе закрыть важные посадочные страницы
Закрыть служебные разделыПроверить, что они не нужны для рендера страницы
Указать sitemapПуть должен вести на актуальную карту сайта
Настроить правила для ЯндексаУчитывать Clean-param и особенности обработки параметров
Закрыть тестовый сайтНе перенести запрет на рабочий домен

Robots.txt и GEO / ИИ-поиск

Для GEO robots.txt важен как инструмент доступа. Если важные статьи, FAQ, изображения, JS или разделы закрыты от обхода, поисковые и ИИ-системы могут хуже понимать сайт. При этом владелец может отдельно управлять доступом некоторых AI-ботов, если политика проекта требует ограничить использование контента.

Частые ошибки

  • закрыть весь сайт после переноса с тестового домена;
  • путать запрет обхода с удалением из индекса;
  • закрывать CSS и JavaScript, нужные для рендера;
  • оставлять в sitemap закрытые URL;
  • закрывать разделы, которые должны ранжироваться;
  • использовать правила без проверки в инструментах вебмастеров;
  • не обновлять файл после изменения структуры сайта.

Чек-лист проверки

  1. Открыть robots.txt на рабочем домене.
  2. Проверить, нет ли запрета на весь сайт.
  3. Сверить закрытые разделы с SEO-структурой.
  4. Проверить доступность CSS, JS и изображений.
  5. Проверить путь к sitemap.xml.
  6. Сравнить robots.txt с canonical и meta robots.
  7. Протестировать важные URL в Яндекс Вебмастере и Google Search Console.
  8. Зафиксировать изменения перед публикацией.
Комментарий эксперта

Robots.txt — файл, где маленькая ошибка может стоить большого трафика. Его нельзя править вслепую. Перед публикацией нужно проверить важные страницы, карту сайта, CSS, JS, параметры и тестовые запреты. Для SEO и ИИ-поиска главное — не закрыть то, что должно быть доступно и приносить видимость.

FAQ

Robots.txt закрывает страницу от индексации?

Не всегда. Он запрещает обход, но страница может остаться известной поисковой системе по ссылкам. Для удаления из индекса нужны другие методы.

Где должен лежать robots.txt?

В корне сайта. Для основного домена файл обычно доступен по адресу site.ru/robots.txt.

Можно ли закрыть в robots.txt личный кабинет?

Да, но для приватных данных одного robots.txt недостаточно. Доступ должен быть защищён авторизацией и серверными ограничениями.

Нужно ли указывать sitemap.xml?

Да, это полезная практика. Так роботам проще найти актуальную карту сайта.

Как robots.txt связан с ИИ-поиском?

Он определяет, какие роботы могут обходить сайт. Если важный контент закрыт, ИИ-системы могут не получить доступ к материалам.

Связанные термины

  • краулинг;
  • индексация;
  • sitemap.xml;
  • meta robots;
  • noindex;
  • Clean-param;
  • краулинговый бюджет;
  • AI-боты.

Материал был полезен?