SEO html5css.dev
html5css.dev

SEO продвижение сайтов

Полный цикл: от проектирования и семантики до ссылочного, перелинковки и текстов.

0. Старт С чего начинается работа: цели, инструменты, сервисы 2 1. Проектирование сайта Структура, семантика, title и description 11 2. Прототипирование Карточка товара и страница категории на примере магазина 3 3. Контент и ключевые слова Ключи в тексте, заголовки, объём, читаемость, изображения, внутренние ссылки 20 3.1. Сайт целиком и коммерция Структура, sitemap, крошки, домен, контакты, ассортимент, доставка, поддержка 22 3.2. Поведенческие факторы Домен и бренд, релевантность title, вложенность, удовлетворённость пользователя 11 4. Техническая оптимизация Скорость, дубли, robots.txt, sitemap.xml, битые страницы 9 5. Внешние факторы Ссылочное, доноры, анкоры, линкбилдинг 13 6. Продвижение бренда Брендовый трафик и его оценка 3 7. Нестандартные методы Актуализация контента, нулевая позиция, SILO, обрезка контента 17 8. Крауд-маркетинг Форумы, отзовики, Q&A, соцсети, поиск площадок и сервисы 16 8.1. Стратегии крауда Стратегии размещения, выживаемость постов, объёмы, делегирование 11 9. Юзабилити сайта Макет, навигация, формы, корзина, контрастность 10 10. Внутренняя перелинковка Вес страниц, анкоры, схемы связывания 10 11. Работа с текстами LSI, структура текста, применение ключей 8

С чего начать

Последовательный курс: проектирование → внутренняя оптимизация → техничка → ссылочное → тексты.

15глав
166уроков

Мобильная выдача

Отдельный курс про мобильный индекс: скорость, интерфейс, голосовой поиск и регионы.

6глав
44урока

Новый курс

Поиск всё чаще отвечает текстом. Курс о том, как попадать в источники этих ответов и не потерять доверие.

5глав
15уроков
  1. html5css.dev
  2. SEO
  3. SEO продвижение
  4. Техническая оптимизация
  5. Дубли контента
Глава 4 · Техническая оптимизация Урок 5 из 9 Обновлено 26.08.2026

Дубли контента

Дубли размывают сигналы: вместо одной сильной страницы поисковик видит несколько слабых. Разбираем источники, инструменты склейки и типичные ошибки применения canonical.

Что изменилось с прошлой версии урока Прежний текст пугал «фильтром за дубли» и советовал переписывать тексты ради уникальности. Отдельного фильтра за внутренние дубли не существует, а проблема решается технически — склейкой адресов, а не рерайтом.

Откуда берутся дубли

ИсточникПримерРешение
Протокол и wwwhttp://, https://www.301 на один вариант
Слеш в конце/page и /page/301 на выбранный формат
Регистр/Page/ и /page/301 на нижний регистр
Индексный файл/ и /index.php301 на короткий вид
Метки кампаний?utm_source=…canonical на чистый URL
Сортировки и вид?sort=price&view=listcanonical на базовую категорию
Фильтры?color=red&size=42Ценные — свои страницы, остальные — canonical
Пагинация?page=2Свой title, canonical сам на себя
Товар в разных категорияхДва пути к одной карточкеОдин основной URL, canonical с остальных
Версия для печати/page/print/noindex или canonical
Тестовый поддоменdev.site.ruЗакрыть авторизацией

Три инструмента и когда какой

ИнструментКогда применятьЧто происходит
301Дубль не нужен ни людям, ни поискуАдрес исчезает, сигналы переходят на целевой
canonicalОбе страницы нужны людям, в индексе — однаРекомендация: в выдаче показывается каноническая
noindexСтраница нужна людям, но не поискуИз выдачи убирается, ссылки с неё работают
robots.txtТолько для экономии бюджета обходаНе убирает из индекса; закрытую страницу робот не увидит и не прочтёт noindex
Частая ошибка: noindex вместе с robots.txt Если адрес закрыт в robots.txt, робот не загрузит страницу и не увидит на ней noindex — адрес может остаться в индексе. Порядок правильный: сначала noindex и доступ открыт, дождаться выпадения из индекса, и только потом при желании закрывать обход.

Canonical: правила применения

<!-- каноническая страница указывает сама на себя -->
<link rel="canonical" href="https://site.ru/catalog/smesiteli/">

<!-- страница с метками указывает на чистый адрес -->
<link rel="canonical" href="https://site.ru/catalog/smesiteli/">
<!-- фактический URL: /catalog/smesiteli/?utm_source=ads -->
  • Абсолютный URL с протоколом и доменом.
  • Каноническая страница указывает сама на себя — это снимает неоднозначность.
  • Один canonical на странице. Два — противоречие, оба игнорируются.
  • Цель должна отдавать 200 и быть открыта для индексации.
  • Содержание должно совпадать. Canonical с карточки на категорию — сигнал, который система проигнорирует.
  • Внутренние ссылки ведут на канонический адрес, иначе сигналы противоречат разметке.

Пагинация и фильтры

Для страниц пагинации правильный вариант — canonical сам на себя и свой title с номером. Ставить canonical всех страниц на первую нельзя: товары со второй и последующих выпадут из индекса. Подробности — в уроке о пагинации.

Для фильтров решение зависит от спроса:

  • Есть спрос («смесители чёрные») — делаем полноценную страницу со своим title, описанием и canonical на себя.
  • Спроса нет — canonical на базовую категорию, а комбинации фильтров закрываем от обхода.
  • Комбинаций тысячи — обязательно ограничить обход, иначе бюджет уйдёт на них.

Как найти дубли

  1. Краулер: одинаковые title, h1 и совпадение содержания.
  2. Search Console → Индексирование: категории «Дубликат: страница не выбрана в качестве канонической» и «Google выбрал другую каноническую страницу».
  3. Яндекс.Вебмастер → Страницы в поиске: исключённые как дубли.
  4. Поиск по фрагменту текста в кавычках с оператором site: — быстрый способ увидеть копии.
  5. Логи: какие адреса с параметрами реально обходит робот.
# сколько уникальных адресов с параметрами обходит робот
grep -i googlebot access.log | awk '{print $7}' | grep '?' \
  | sed 's/=[^&]*//g' | sort | uniq -c | sort -rn | head -20

Последняя команда показывает наборы параметров без значений — так видно, какие именно комбинации плодят дубли.

Порядок работ

  1. Свести все варианты адресации к одному: протокол, www, слеш, регистр.
  2. Проставить canonical на всех шаблонах, включая «сам на себя».
  3. Разобраться с фильтрами: что открываем, что закрываем.
  4. Проверить внутренние ссылки — они должны вести на канонические адреса.
  5. Закрыть от обхода бесполезные комбинации параметров.
  6. Через месяц сверить отчёт индексирования.

Итог

Дубли — техническая, а не редакторская проблема: их не лечат переписыванием текстов. Сведите варианты адресации к одному, расставьте canonical и следите, чтобы внутренние ссылки не противоречили разметке. Дальше — организация пагинации.

Частые вопросы

Есть ли санкции за дубли контента внутри сайта?

Отдельных санкций нет. Проблема механическая: сигналы делятся между копиями, поисковик сам выбирает каноническую версию и может выбрать не ту, а бюджет обхода тратится впустую.

Canonical или 301: что выбрать?

301 — когда дубль не нужен людям и должен исчезнуть. Canonical — когда обе страницы нужны пользователю (например, товар в двух категориях), но в индексе должна быть одна.

Является ли canonical директивой?

Нет, это рекомендация. Поисковик может выбрать другую каноническую версию, если сигналы противоречат: разные внутренние ссылки, разный контент, canonical указывает на нерелевантную страницу.

Как быть с одним товаром в нескольких категориях?

Лучше всего — один URL товара вне категорий, а из категорий на него ссылаться. Если структура вложенная, выберите основной путь и укажите его в canonical на всех остальных.

Вся глава «Техническая оптимизация» — 9 уроков
  1. Техническая оптимизация сайта
  2. Скорость доступа к сайту
  3. Битые страницы и ссылки
  4. Дубли мета-тегов и заголовков H1
  5. Дубли контента
  6. Организация пагинации
  7. Ошибки в robots.txt
  8. Ошибки в sitemap.xml
  9. Типичные технические ошибки