Перейти к содержимому

Дублированный контент

Один и тот же контент по нескольким адресам

Когда идентичный или почти идентичный текст доступен по нескольким адресам — за это нет наказания, но есть выбор, который делает сама Google.

  1. Одно содержимое оказывается по нескольким адресам
  2. Google фильтрует, а не наказывает
  3. Один адрес выбирается как основной
  4. Вес концентрируется, если сигналы совпадают

Что означает Дублированный контент?

Дублированный контент возникает почти всегда непреднамеренно: одна и та же страница с www и без www, с номером сессии из рекламной кампании, в виде версии для печати, как вид с фильтром в интернет-магазине, или потому что текст стоит одновременно в блоге и в тематическом обзоре. Из единственного содержимого так получается несколько адресов, которые для человека выглядят одинаково, а для поисковой системы сначала выглядят как несколько разных страниц.

Вокруг этого понятия закрепилось стойкое заблуждение: представление о «наказании за дублированный контент», которое якобы активно понижает сайт за повторяющееся содержимое. Google в собственной документации прямо это опровергает — такого наказания в обычном смысле не существует. Вместо этого происходит то, что Google называет фильтрацией или канонизацией: из нескольких равнозначных адресов для результатов выбирается один, остальные отодвигаются, а не наказываются.

Этот выбор поисковая система делает алгоритмически на основе сигналов — внутренней перелинковки, переадресаций, записей в адресном списке и canonical-тега, который служит указанием, какой адрес должен считаться основным. Google в большинстве случаев следует этому указанию, но не обязан. При противоречивых сигналах может быть выбран не тот адрес, который нужен, — без какого-либо сообщения об ошибке.

Настоящий ущерб заключается не в понижении, а в рассеивании: если половина сайта ссылается на вариант с www, а другая половина — на вариант без www, вес, накопленный страницей, распределяется между двумя адресами вместо того, чтобы концентрироваться на одном. Кроме того, поисковая система тратит ресурс обхода на варианты, которые в итоге всё равно не будут показаны.

Есть исключение, которое добавляет путаницы: при массовом копировании чужого содержимого через множество доменов, например в спам-сетях, Google действительно может вмешаться — но это идёт через правила против спама, а не через отдельное правило о дублированном контенте. Обычный случай на собственном сайте, о котором идёт речь здесь, следует отличать от этого — он значительно безобиднее.

На практике это означает: закрепить один вариант адреса (с www или без, со слэшем в конце или без), последовательно отразить это решение в canonical-теге, действительно перенесённое содержимое вести через переадресацию, а не через указание, и не публиковать один и тот же текст дважды на одном сайте без необходимости. Подробности технической реализации указания приведены в статье о canonical-теге, здесь же важнее всего базовое правило, которое за этим стоит.

Проверьте сами

Для этой статьи мы намеренно не приводим цифру — измеримой «величины наказания», которую можно было бы подтвердить, не существует, потому что не существует самого наказания.

Подтверждаемый факт здесь — это утверждение, а не показатель: Google в собственной документации прямо указывает, что «в большинстве случаев» наказания за дублированный контент не происходит, а происходит автоматическая фильтрация. Придумать к этому цифру, например мнимую потерю позиций в процентах, было бы как раз тем видом утверждений, от которых мы здесь предостерегаем. Что действительно можно измерить — это конкретный случай: какой адрес Google фактически выбрала, видно в Google Search Console.

Источник: Google Search Central, документация о дублированном содержимом и о канонизации. Наказание за дублированное содержимое там не описано.

Частые вопросы

Наказывается ли мой сайт, если текст встречается дважды?

В обычном смысле нет. Сама Google говорит о фильтрации, а не о наказании: из нескольких одинаковых или похожих адресов один выбирается и показывается, остальные отодвигаются. Ущерб возникает скорее косвенно — из-за рассеянного веса и впустую потраченного ресурса обхода.

Достаточно ли установить canonical-тег, чтобы решить проблему?

В большинстве случаев да, потому что он сообщает поисковой системе, какой адрес должен действовать. Но это указание, а не команда — при противоречивых внутренних ссылках или отсутствующих переадресациях Google всё же может выбрать другой адрес.

Не хватает термина? Напишите нам

Мы спокойно объясним любой термин без профессионального жаргона — и честно скажем, что вам действительно нужно, а что нет.

ProvenExpert