SEO

robots.txt: практическое руководство

robots.txt управляет рекомендациями для обхода URL поисковыми роботами. Он не является надёжным способом удалить уже известную страницу из индекса и не заменяет авторизацию.

Что делает robots.txt

Файл находится в корне домена и содержит правила для роботов. Через User-agent задаётся робот, через Disallow — пути, которые не рекомендуется обходить, а директива Sitemap помогает указать карту сайта.

Типовые ошибки

Самая опасная ошибка — случайно закрыть от обхода весь сайт или важные разделы после переноса с тестового домена. Вторая частая проблема — закрывать CSS и JavaScript, из-за чего робот хуже видит итоговую страницу.

robots.txt и индексирование

Если поисковая система уже знает URL из внешних ссылок или других источников, запрет обхода не гарантирует исчезновение адреса из результатов. Для управления индексированием используют корректные HTTP-коды, meta robots и другие механизмы в зависимости от задачи.

Минимальный пример

User-agent: *
Disallow: /admin/
Sitemap: https://example.ru/sitemap.xml

Практический вывод 21SEO: после каждого крупного релиза автоматически проверяйте robots.txt и доступность ключевых шаблонов страниц.
Владимир Николаев — эксперт 21SEO
Практика Владимира Николаева

Robots.txt решает задачу обхода, а не все задачи индексации

Перед Disallow я формулирую цель: сократить обход, закрыть служебный путь или управлять crawler. Если нужно удалить уже известный URL из поиска, могут требоваться другие механизмы.

Что проверить на своём сайте

  • Цель правила
  • User-agent
  • Проверка важных ресурсов
Граница рекомендации: Нельзя одновременно запрещать обход и ожидать, что робот прочитает meta robots на странице.

Как Владимир проверяет SEO/GEO-гипотезы →

Есть сайт или только идея?

Покажем точки роста до начала работ

Разберём поиск, конкурентов, структуру, контент и потенциал AI Search.