Страница может индексироваться
Используется для обычных индексируемых страниц сайта, предназначенных для поиска.
index, follow
Создавайте robots meta tag для управления индексированием конкретной HTML-страницы. Выберите index или noindex, follow или nofollow, настройте дополнительные директивы и скопируйте готовый код для размещения внутри head.
Meta robots относится к конкретной HTML-странице и не заменяет robots.txt. Если URL полностью закрыт от обхода через robots.txt, поисковый робот может не получить HTML страницы и не увидеть размещённый на ней meta robots.
Meta robots — HTML-элемент, который размещается внутри head страницы и передаёт поисковым роботам директивы об индексировании страницы, ссылках и отдельных элементах сниппета.
Основное различие: index допускает индексирование, а noindex сообщает, что страницу не следует оставлять в поисковом индексе.
Используется для обычных индексируемых страниц сайта, предназначенных для поиска.
index, follow
Может использоваться для служебных, технических или других страниц, которые не нужны в выдаче.
noindex, follow
Эти директивы относятся к обработке ссылок на странице. Для обычных страниц чаще используется стандартный вариант follow.
Помимо index и follow можно передавать более точные настройки для сниппетов, изображений и сохранённых версий.
noarchive
Используется для ограничения использования сохранённой кешированной копии страницы там, где директива поддерживается.
nosnippet
Ограничивает отображение текстового сниппета страницы в поддерживающих эту директиву системах.
noimageindex
Используется для ограничения индексирования изображений, размещённых на странице.
max-snippet
Позволяет передать ограничение максимального объёма текстового сниппета.
max-image-preview
Позволяет задать допустимый размер изображения в превью.
max-video-preview
Позволяет передать максимальную длительность видеопревью.
Robots.txt в первую очередь управляет обходом URL, а meta robots находится внутри HTML и задаёт инструкции для конкретной страницы.
<meta name="robots" ...>
Используется для директив index, noindex, follow, nofollow и других.
Disallow: /admin/
Используется для управления доступом поисковых роботов к определённым путям.
Robots.txt Generator →Решение зависит от структуры сайта. Noindex не стоит применять автоматически ко всем техническим URL без анализа их назначения.
Внутренние технические страницы, которые не предназначены для поисковой выдачи.
Например отдельные страницы, созданные только для внутренних сценариев сайта.
Материалы, которые временно доступны, но не должны индексироваться.
Только если noindex действительно соответствует выбранной SEO-архитектуре проекта.
Тег размещается внутри HTML-элемента head страницы.
<head>
<title>Название страницы</title>
<meta
name="robots"
content="index, follow, max-image-preview:large"
>
</head> Ошибочная директива noindex может убрать важную страницу из поиска, поэтому robots meta особенно важно проверять перед публикацией.
Коммерческая или информационная страница случайно закрыта от индексации.
Робот не может получить страницу и поэтому может не увидеть размещённый внутри meta robots.
В разных частях страницы или HTTP-заголовках передаются несогласованные инструкции.
Дублирующая страница закрывается noindex, хотя архитектура требует канонизации.
Nofollow массово применяется ко всей странице, хотя это не соответствует задаче.
Тестовая директива остаётся на опубликованной версии сайта.
Одна случайная директива noindex способна изменить индексируемость страницы. После переноса сайта, редизайна, публикации staging-версии или изменения шаблонов стоит отдельно проверять robots meta на коммерчески важных URL.
Основные вопросы об index, noindex, follow и других директивах.
Meta robots — HTML-элемент, который размещается внутри head страницы и передаёт поисковым роботам директивы об индексировании страницы, ссылках и отдельных элементах сниппета.
Директива index допускает индексирование страницы поисковой системой.
Директива noindex сообщает, что страницу не следует оставлять в поисковом индексе.
Директива follow указывает, что ссылки на странице могут обрабатываться поисковым роботом.
Директива nofollow используется для ограничения обработки ссылок на странице.
Robots.txt в первую очередь управляет обходом URL, а meta robots находится внутри HTML и задаёт инструкции для конкретной страницы.
Да. Такая комбинация сообщает, что страницу не следует индексировать, но ссылки на ней могут обрабатываться.
max-image-preview позволяет передать ограничение на размер изображения, которое поддерживающая поисковая система может использовать в превью.
Да. Meta Robots Generator Competent можно использовать бесплатно без регистрации.
Анализируем noindex, robots.txt, canonical, Sitemap, редиректы, ошибки 4xx, структуру URL, внутренние ссылки и страницы, которые не попадают в поиск.
SEO-продвижение ↗