Техническое SEO
Проверка каннибализации ключевых слов
Перечислите страницы вашего сайта — URL, заголовок, мета-описание, H1 и целевое ключевое слово — и найдите все пары, которые пересекаются настолько, что конкурируют друг с другом в поисковой выдаче, отсортированные по уровню риска.
Формат: URL | Заголовок | Мета-описание | H1 | Целевое ключевое слово (одна страница на строку, разделитель " | "). Обязательны только URL и Заголовок — мета-описание, H1 и целевое ключевое слово необязательны, но повышают точность результата.
Сопоставление использует пересечение слов (индекс Жаккара) после фильтрации стоп-слов, поэтому работает для любого языка с латиницей. Языки без пробелов между словами (китайский, тайский, кхмерский) дают более грубый сигнал — считайте оценку лишь ориентировочной.
Что проверяет этот инструмент
Каннибализация ключевых слов происходит, когда две или более ваших собственных страниц нацелены на один и тот же поисковый intent — одинаковое ключевое слово, почти идентичный заголовок или пересекающиеся H1 и мета-описание. Поисковым системам приходится выбирать одну страницу для ранжирования, часто разделяя авторитетность и ссылки между ними, что вредит обеим. Этот инструмент сравнивает каждую пару перечисленных вами страниц и отмечает те, что, вероятно, каннибализируют друг друга, с указанием конкретных полей, которые пересекаются.
Как рассчитывается оценка
Заголовки, H1, мета-описания и целевые ключевые слова токенизируются и очищаются от распространённых стоп-слов, затем попарно сравниваются с помощью индекса Жаккара (число общих слов делится на общее число уникальных слов). Четыре оценки полей объединяются в одну взвешенную оценку каннибализации на пару, при этом точное совпадение целевого ключевого слова или заголовка сразу переводит пару в категорию «критично» независимо от остальных оценок.
Пересечение заголовка и H1
Заголовок сильнее всего влияет на ранжирование, поэтому его пересечению придаётся наибольший вес, за ним следует H1. Две страницы с почти идентичными заголовками рассказывают одну и ту же историю и пользователям, и поисковым системам.
Совпадение целевого ключевого слова
Если вы указали целевое ключевое слово для каждой страницы, точное совпадение (после удаления «a/an/the») между двумя разными URL — самый сильный сигнал каннибализации, и такая пара отмечается как критичная независимо от остальных оценок.
Пересечение мета-описания
Мета-описание напрямую не влияет на ранжирование, но сильное пересечение обычно означает, что обе страницы написаны для ответа на один и тот же запрос — вторичный подтверждающий сигнал.
Итоговая оценка риска
Каждая пара получает одну оценку 0-100%, объединяющую все указанные вами поля, а затем степень серьёзности: критично (точное совпадение ключевого слова или заголовка), высокая (≥55%) или умеренная (≥30%). Пары ниже этого порога не показываются — небольшое пересечение нормально для реального сайта.
Часто задаваемые вопросы
Что делать с парой каннибализации, которую отметил инструмент?
Выберите страницу с лучшим ранжированием или большим числом обратных ссылок и расширьте её, чтобы полностью раскрыть intent, затем сделайте 301-редирект более слабой страницы на неё, добавьте канонический тег, либо перепишите слабую страницу под действительно другой ракурс или подключевое слово и свяжите обе страницы перекрёстными ссылками.
Любое пересечение между страницами — это всегда проблема?
Нет. Опорная (pillar) страница и вспомогательная статья могут закономерно использовать общую лексику. Инструмент отмечает только пары с существенным пересечением (от 30% или точным совпадением ключевого слова/заголовка) — этот порог является сигналом для проверки, а не автоматическим приговором.
Где взять заголовок, мета-описание и H1 для каждой страницы?
Посмотрите исходный код каждой страницы (или используйте инструменты «View Page Source Online» и «Get HTML Meta Header» этого сайта) и скопируйте текст <title>, мета-описания и <h1>. Для нескольких страниц это занимает около минуты на страницу.
Отправляет ли этот инструмент мои данные куда-либо?
Вставленный вами список отправляется один раз по HTTPS на наш сервер для выполнения попарного сравнения (это необходимо, чтобы логика сопоставления оставалась на стороне сервера и была согласованной), и не сохраняется после обработки запроса.