User-agent
Для какого робота действует правило
Звёздочка означает применение группы правил ко всем роботам.
User-agent: *
Создайте базовый robots.txt для сайта: настройте User-agent, разрешённые и запрещённые пути, добавьте Sitemap и получите готовый текст файла. Инструмент помогает подготовить правила обхода сайта поисковыми роботами без ручного написания директив.
Robots.txt управляет обходом URL поисковыми роботами, но не является надёжным способом удалить страницу из поискового индекса. Если URL уже известен поисковой системе, один только Disallow не гарантирует его исчезновение из выдачи.
Robots.txt — текстовый файл, который размещается в корне сайта и содержит инструкции для поисковых роботов о том, какие URL или разделы сайта они могут или не должны обходить.
В большинстве базовых конфигураций используются User-agent, Disallow, Allow и Sitemap.
User-agent
Звёздочка означает применение группы правил ко всем роботам.
User-agent: *
Disallow
Указывает путь, который соответствующему роботу не следует обходить.
Disallow: /admin/
Allow
Может использоваться для более точной настройки внутри закрытого раздела.
Allow: /public/
Sitemap
В robots.txt можно указать абсолютный URL файла sitemap.xml.
Sitemap: https://site.kz/sitemap.xmlКонкретный файл зависит от структуры и CMS сайта. Не копируйте чужой robots.txt без проверки собственных URL.
User-agent: * Disallow: /admin/ Disallow: /search/ Allow: / Sitemap: https://example.com/sitemap.xml
Правила применяются ко всем поисковым роботам.
Роботу предлагается не обходить указанные каталоги.
Указывается адрес XML-карты сайта.
Одна из самых частых SEO-ошибок — воспринимать Disallow как команду «удалить страницу из Google».
Robots.txt сообщает роботу, какие URL ему не следует сканировать.
CrawlingДля контроля индексации могут использоваться другие SEO-механизмы, например robots meta directives или HTTP-заголовки.
IndexingОшибка в одном символе может изменить область действия правила, поэтому файл стоит проверять после каждого существенного изменения сайта.
Disallow: /
Такая директива запрещает выбранному User-agent обходить весь сайт.
Коммерческие категории, услуги или товары могут случайно попасть под общее правило.
Disallow регулирует обход, поэтому его нельзя автоматически приравнивать к запрету индексации.
В Sitemap должен быть указан существующий абсолютный URL XML-карты сайта.
Для домена example.com стандартный адрес файла — https://example.com/robots.txt. После публикации URL должен открываться непосредственно в браузере.
Короткие ответы на основные вопросы о файле robots.txt.
Robots.txt — текстовый файл в корне сайта, который содержит инструкции для поддерживающих этот механизм поисковых роботов об обходе URL сайта.
Файл размещается в корне домена. Например, для example.com адрес будет https://example.com/robots.txt.
Звёздочка означает, что группа правил предназначена для всех роботов, которые используют соответствующий стандарт.
Disallow указывает путь, который соответствующему поисковому роботу не следует обходить.
Да. В robots.txt можно указать абсолютный URL XML-карты сайта с помощью директивы Sitemap.
Не обязательно. Robots.txt управляет обходом, а не является универсальной командой удаления URL из поискового индекса.
Конструкция User-agent: * вместе с Disallow: / сообщает поддерживающим эти правила роботам не обходить сайт. Для рабочего публичного сайта использовать такую настройку нужно крайне осторожно.
Да. Инструмент Competent можно использовать бесплатно без регистрации.
Анализируем индексацию, robots.txt, sitemap.xml, canonical, редиректы, структуру страниц, мета-теги, Schema.org, внутреннюю перелинковку и другие технические элементы сайта.
SEO-продвижение ↗