Sitemap.xml — служебный XML-список URL, который сайт отдаёт поисковым системам как подсказку: какие адреса считать значимыми. Это не HTML-страница «карта сайта» в подвале. Если файл битый, устаревший или наполнен мусором, робот тратит бюджет обхода впустую — при формальном наличии «карты» индексация всё равно страдает.
Где найти файл
Три рабочих точки входа:
https://ваш-сайт/sitemap.xml- строка
Sitemap:в/robots.txt - генератор в CMS/конструкторе (раздел SEO / карта сайта)
Живая карта показывает теги <url> либо индекс других sitemap-файлов. HTML-заглушка 404 с дизайном сайта для робота означает: карты по этому адресу нет.
Критерии качества
Ориентир для управленческой приёмки:
- ответ без ошибки (обычно 200);
- содержимое — XML, не лендинг;
- URL на основном домене и схеме
https://; - нет служебного мусора: корзина, ЛК, «спасибо за заявку», бесконечные комбинации фильтров;
- нет массовых дублей с UTM и параметрами сортировки вместо канонических адресов.
Плохие признаки: тестовый dev.-домен, смесь http/https, массовые 404 по ссылкам из карты, файл настолько большой, что тормозит даже в браузере.
Частая ошибка: после смены структуры URL генератор продолжает отдавать старые пути. Карта «есть», пользы нет.
Связь с robots.txt
Держите согласованность:
- в robots указан актуальный адрес карты;
- карта не перечисляет то, что Disallow закрывает для обхода;
- коммерческие страницы не выпали из генерации из‑за настроек плагина.
Sitemap не отменяет robots: запись в карте не открывает запрещённый путь.
Практическая проверка без спецоборудования
- Откройте sitemap, выберите 5–10 URL: главная, 2–3 услуги/категории, материал блога, контакты.
- Откройте каждый как внешний посетитель.
- Убедитесь: нужная страница, без лишних редиректов, без 403/404, без пароля на весь сайт.
- Задайте критерий отбора: эти URL должны быть в поиске? Если в карте только технические хвосты — правила генерации надо менять.
На конструкторах карту обычно не пишут руками. Задача — контролировать состав: не попали ли черновики, скрытые лендинги, дубли.
Типовые поломки
| Ситуация | Что происходит | Действие |
|---|---|---|
| Переезд на https | В карте остались http | Пересобрать на каноническом зеркале |
| Смена ЧПУ | Старые пути в XML | Обновить шаблон генерации |
| Два плагина sitemap | Конкурирующие списки | Оставить одну схему |
| Каталог без фильтра | Тысячи комбинаций в карте | Исключить фасетный мусор |
| Нет коммерческих URL | Плагин их пропускает | Добавить в правила / вручную |
Отправка карты в кабинете вебмастера полезна после того, как файл стал корректным. «Отправлено» не чинит 404 внутри XML.
> Быстрая внешняя сверка видимости карты и соседних SEO-сигналов: Проверить сайт в поиске бесплатно
Порядок исправлений
- Восстановить доступность файла по ожидаемому URL.
- Выровнять домен и схему.
- Убрать мёртвые и служебные адреса.
- Вернуть в генерацию важные коммерческие страницы.
- При чрезмерном объёме — разбить на несколько файлов и sitemap index.
- Прописать актуальный Sitemap в robots.
- При необходимости — запросить переобход в вебмастере.
Приёмка у подрядчика
Запросите не «карту включили», а артефакты:
- URL карты, который должен быть в robots;
- скрин или выгрузку первых/последних URL после правок;
- подтверждение, что 5–10 коммерческих адресов из меню присутствуют и отдают 200;
- правило исключений: какие типы страниц намеренно вне карты.
Накатайте регресс после крупных релизов ЧПУ: sitemap часто ломается тихо. В регламенте поддержки достаточно пункта «после смены структуры URL — пересобрать и выборочно открыть 10 ссылок из XML».
Индекс нескольких sitemap нормален для крупного каталога. Главное — чтобы корневой индекс открывался, дочерние файлы отдавались и не дублировали противоречивые наборы. Две независимые генерации от разных плагинов без индекса — хуже, чем один полный файл.
После крупного релиза каталога заложите в регресс 15 минут: открыть XML, выбрать случайные 10 SKU/услуг, убедиться в 200 и каноне. Это дешевле недели «почему не индексируется».
Итог
Проверить sitemap.xml — значит убедиться, что поиск получает актуальный список значимых канонических URL, а не пустышку и не свалку параметров. Начните с открытия файла, пройдите выборочно по ссылкам и сверьте с robots — этого достаточно, чтобы отделить «файла нет» от «файл врёт».
Снаружи: Проверить сайт в поиске бесплатно.