Короткий ответ. В sitemap.xml включайте новые и существующие URL, которые отвечают кодом 200, доступны для индексации и являются предпочтительными каноническими версиями. Редиректы, ошибки, технические параметры, закрытые и дублирующие страницы обычно нужно исключать.
Что на самом деле делает sitemap.xml
Sitemap помогает поисковым роботам обнаруживать URL и понимать актуальную структуру сайта. Он особенно полезен для больших проектов, новых страниц и документов, до которых роботу трудно добраться по обычным ссылкам.
Но Sitemap — сигнал, а не команда. Наличие URL в файле не гарантирует ни обход, ни индексирование, ни позицию в выдаче. Google прямо называет отправку Sitemap подсказкой, а Яндекс предупреждает, что не гарантирует показ всех переданных URL в поиске.
Важно: Sitemap не заменяет внутреннюю перелинковку
На значимые страницы должны вести обычные HTML-ссылки. Файл помогает обнаружению, но не исправляет изолированную архитектуру сайта.
Главное правило: какие страницы включать
Перед добавлением URL задайте один вопрос: «Хотим ли мы, чтобы именно этот адрес был самостоятельной страницей поисковой выдачи?»
Если ответ «да», проверьте ещё три условия: URL возвращает 200 OK, разрешён к индексации и соответствует выбранной канонической версии. Обычно в Sitemap попадают:
- главная страница;
- страницы услуг;
- категории и подкатегории;
- самостоятельные SEO-посадочные;
- индексируемые карточки товаров;
- статьи, кейсы и другие полезные материалы;
- региональные страницы с самостоятельным содержанием;
- новые нужные URL, даже если поисковик ещё не успел их проиндексировать.
Google рекомендует добавлять URL, которые сайт хочет видеть в поиске, прежде всего канонические версии. Яндекс тоже советует сначала определить canonical для включаемых страниц.
| Тип URL | Sitemap | Почему |
|---|---|---|
| Услуга: 200, self-canonical | Да | Целевая страница |
| Категория | Да | Целевая страница |
| SEO-фильтр | Да | Если это самостоятельная посадочная |
| Технический фильтр | Нет | Не нужен в поиске |
| URL с noindex | Нет | Конфликт сигналов |
| 301 или 302 | Нет | Добавляется конечный URL |
| 404 или 410 | Нет | Страница удалена |
| UTM-параметр | Нет | Неканоническая версия |
| Внутренний поиск | Нет | Техническая страница |
Какие URL обычно нужно исключать
Страницы с noindex
Если страница сознательно закрыта от индексации через noindex или заголовок X-Robots-Tag, одновременно предлагать её поиску через Sitemap нелогично. Уберите URL из файла или пересмотрите запрет, если страница всё-таки должна участвовать в поиске.
URL с редиректами
Не держите в Sitemap старые адреса с 301 или временными 302-редиректами. Указывайте конечный рабочий URL. После миграции это особенно важно: генератор не должен продолжать выгружать прежнюю структуру.
404, 410 и ошибочные URL
Удалённые документы и серверные ошибки не должны автоматически оставаться в файле. Их наличие расходует внимание на заведомо нерабочие адреса и обычно говорит о проблеме в логике генерации.
Неканонические версии и дубли
HTTP и HTTPS, www и без www, адреса со слешем и без него, метки и параметры не должны одновременно жить в Sitemap, если показывают один и тот же документ. Из группы дублей оставьте предпочтительную версию.
Технические страницы
Обычно исключают внутренний поиск, корзину, авторизацию, личный кабинет, сравнение, сортировки, технические параметры и служебные URL системы управления. Но ориентируйтесь не на название раздела, а на его ценность как самостоятельной страницы поиска.
Самые спорные случаи
Фильтры интернет-магазина
Исключать все фильтры одним правилом — ошибка. Комбинация ?sort=price&view=grid обычно техническая. А страница «Красные диваны шириной до 200 см» может быть полноценной посадочной, если у неё есть спрос, уникальный понятный URL, полезный ассортимент, собственные метаданные, внутренние ссылки и self-canonical.
Логика простая: технические комбинации исключаем; подготовленные SEO-фильтры можем оставить.
Пагинация
Универсального правила «всегда удалять /page/2/» нет. Если товары и материалы доступны роботам только через страницы пагинации, эти URL важны для обхода. Если каждая страница должна участвовать в поиске самостоятельно, она может оставаться в Sitemap.
Решение зависит от архитектуры каталога, внутренней перелинковки, каноникализации и назначения конкретных URL. Сначала убедитесь, что робот доберётся до всех карточек по HTML-ссылкам, и только затем меняйте состав файла.
Товары не в наличии
Если карточка отвечает 200, остаётся полезной — например, содержит характеристики, отзывы, аналоги или срок поступления — и должна сохраняться в поиске, её можно оставить. Если товар удалён, URL отдаёт 404/410 или перенаправлен, исключите его.
Параметры URL
Не каждый параметр означает мусор и не каждый ЧПУ означает ценную страницу. Разделяйте подготовленные индексируемые посадочные и технические варианты: сортировку, вид отображения, идентификатор сессии, UTM-метки и случайные сочетания фильтров.
Sitemap и canonical: сигналы не должны конфликтовать
Google рассматривает наличие URL в Sitemap как слабый сигнал канонизации. Поэтому файл должен поддерживать выбранный canonical, а не спорить с ним.
Плохая схема
Sitemap: /catalog/red/
canonical: /catalog/
Sitemap предлагает один URL, страница — другой.
Чистая схема
Sitemap: /catalog/red/
canonical: /catalog/red/
Все сигналы указывают на предпочтительный URL.
Если canonical ведёт на другую страницу, сначала решите, какой URL должен ранжироваться. Затем согласуйте Sitemap, canonical, редиректы и внутренние ссылки. Подробный разбор — в статье о настройке canonical.
Дерево решения для одного URL
Нет → исключить. Да → дальше.
Нет → исправить или исключить. Да → дальше.
Нет → устранить конфликт. Да → дальше.
Да → включать в Sitemap.
Как использовать lastmod, changefreq и priority
lastmod
Указывайте дату последнего значимого изменения страницы: основного содержания, структурированных данных или важных ссылок. Не обновляйте lastmod каждый день автоматически и не считайте смену года в copyright достаточной причиной.
Google использует lastmod, если даты стабильно соответствуют реальным изменениям и это можно проверить. Поддельные даты снижают полезность сигнала.
changefreq и priority
Здесь важно различать поисковые системы. Google игнорирует changefreq и priority. Яндекс официально поддерживает оба необязательных элемента и учитывает priority при очередности загрузки URL.
При этом priority="1.0" не повышает позицию страницы. Не проставляйте максимальное значение всем URL: одинаковый приоритет не помогает отличить важное от второстепенного.
Плохой и чистый Sitemap
Плохой пример смешивает целевые страницы, дубль с UTM-меткой, редирект и удалённый URL:
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
<url><loc>https://example.ru/services/seo/</loc></url>
<url><loc>https://example.ru/services/seo/?utm_source=mail</loc></url>
<url><loc>https://example.ru/old-catalog/</loc></url> <!-- 301 -->
<url><loc>https://example.ru/deleted-product/</loc></url> <!-- 404 -->
</urlset>
Чистый вариант содержит только предпочтительные рабочие URL и правдивые даты:
<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
<url>
<loc>https://example.ru/services/seo/</loc>
<lastmod>2026-09-12</lastmod>
</url>
<url>
<loc>https://example.ru/blog/sitemap-guide/</loc>
<lastmod>2026-09-15</lastmod>
</url>
</urlset>
Sitemap для большого сайта
Один файл может содержать не более 50 000 URL и весить не более 50 МБ без сжатия. Эти ограничения одинаковы в актуальной документации Google и Яндекса.
При превышении лимита создайте несколько файлов и объедините их через Sitemap index. Полезно делить их логически: товары, категории, статьи, регионы. Так проще сравнивать число отправленных и проиндексированных URL и искать проблему в конкретном типе страниц.
Разбиение само по себе не повышает позиции. Его ценность — в управляемости и диагностике.
Как проверить Sitemap после настройки
- Откройте XML вручную и убедитесь, что он корректно отображается.
- Проверьте ответ файла: нужен 200 OK.
- Выгрузите все URL из Sitemap.
- Проверьте их HTTP-коды и найдите редиректы, 404, 410 и 5xx.
- Сопоставьте список с директивами
noindexи ограничениями доступа. - Сравните каждый URL с canonical страницы.
- Найдите параметры, поиск, сортировки и другие технические шаблоны.
- Сопоставьте результат с эталонным списком страниц, предназначенных для поиска.
- Отправьте файл в Google Search Console и Яндекс Вебмастер, затем следите за ошибками обработки.
Для проверки синтаксиса можно использовать официальный инструмент «Анализ файлов Sitemap» Яндекса. Чтобы понять, почему отдельные URL не попадают в поиск, переходите к проверке индексации страниц и отдельно анализируйте ошибки 404 и 410.
«Я обычно отношусь к sitemap.xml как к списку страниц, за которые сайт готов отвечать перед поисковой системой: вот эти URL мы считаем полноценными и хотим видеть в поиске. Если в файле вперемешку лежат услуги, редиректы, параметры, 404 и технические фильтры, Sitemap перестаёт быть хорошим ориентиром и для робота, и для самого SEO-специалиста».
Константин Шипилов
SEO-специалист, руководитель Шипилов SEO
Что не делать
- генерировать Sitemap из всей базы URL системы управления без фильтрации;
- оставлять старые адреса после миграций;
- одновременно отправлять canonical и его параметрические дубли;
- добавлять noindex, 301, 404 ради количества URL;
- применять одно правило ко всем фильтрам и пагинации без анализа;
- искусственно обновлять
lastmodкаждый день; - назначать всем страницам
priority="1.0"в надежде улучшить позиции; - использовать устаревший ping-адрес Google: он больше не поддерживается.
Частые вопросы
Нужно ли добавлять в Sitemap все страницы сайта?
Нет. Добавляйте предпочтительные канонические URL, которые должны участвовать в поиске. Технические и дублирующие страницы обычно исключаются.
Нужно ли включать страницы с noindex?
Обычно нет. noindex запрещает индексирование, а Sitemap предлагает URL поисковику — сигналы конфликтуют.
Нужно ли добавлять страницы пагинации?
Зависит от архитектуры и назначения URL. Не исключайте их автоматически, если через пагинацию робот обнаруживает товары или материалы.
Нужно ли включать фильтры?
Подготовленные SEO-посадочные — да. Технические комбинации, сортировки и дубли — нет.
Нужно ли указывать priority?
Google игнорирует тег. Яндекс его поддерживает, но это не фактор ранжирования и не способ поднять позицию страницы.
Как часто обновлять Sitemap?
При добавлении, удалении или значимом изменении входящих в файл страниц. Дата lastmod должна отражать реальное изменение документа.
Нужно ли вручную отправлять Sitemap после каждого изменения?
Обычно нет. Один раз укажите стабильный адрес файла в поисковых кабинетах и robots.txt, затем обновляйте содержимое. Для Google используйте Search Console, API или строку Sitemap в robots.txt — старый ping-адрес закрыт.
Может ли страница индексироваться без Sitemap?
Да. Поисковик может найти её по внутренним или внешним ссылкам. Sitemap помогает обнаружению, но не является обязательным условием индексирования.
Источники
Технические рекомендации сверены с официальной документацией:
- Google: создание и отправка файла Sitemap;
- Google: canonical и сигналы канонизации;
- Google: закрытие Sitemap ping и рекомендации по lastmod;
- Яндекс: использование файла Sitemap.