SEO html5css.dev
html5css.dev

SEO продвижение сайтов

Полный цикл: от проектирования и семантики до ссылочного, перелинковки и текстов.

0. Старт С чего начинается работа: цели, инструменты, сервисы 2 1. Проектирование сайта Структура, семантика, title и description 11 2. Прототипирование Карточка товара и страница категории на примере магазина 3 3. Контент и ключевые слова Ключи в тексте, заголовки, объём, читаемость, изображения, внутренние ссылки 20 3.1. Сайт целиком и коммерция Структура, sitemap, крошки, домен, контакты, ассортимент, доставка, поддержка 22 3.2. Поведенческие факторы Домен и бренд, релевантность title, вложенность, удовлетворённость пользователя 11 4. Техническая оптимизация Скорость, дубли, robots.txt, sitemap.xml, битые страницы 9 5. Внешние факторы Ссылочное, доноры, анкоры, линкбилдинг 13 6. Продвижение бренда Брендовый трафик и его оценка 3 7. Нестандартные методы Актуализация контента, нулевая позиция, SILO, обрезка контента 17 8. Крауд-маркетинг Форумы, отзовики, Q&A, соцсети, поиск площадок и сервисы 16 8.1. Стратегии крауда Стратегии размещения, выживаемость постов, объёмы, делегирование 11 9. Юзабилити сайта Макет, навигация, формы, корзина, контрастность 10 10. Внутренняя перелинковка Вес страниц, анкоры, схемы связывания 10 11. Работа с текстами LSI, структура текста, применение ключей 8

С чего начать

Последовательный курс: проектирование → внутренняя оптимизация → техничка → ссылочное → тексты.

15глав
166уроков

Мобильная выдача

Отдельный курс про мобильный индекс: скорость, интерфейс, голосовой поиск и регионы.

6глав
44урока

Новый курс

Поиск всё чаще отвечает текстом. Курс о том, как попадать в источники этих ответов и не потерять доверие.

5глав
15уроков
  1. html5css.dev
  2. SEO
  3. SEO продвижение
  4. Техническая оптимизация
  5. Ошибки в robots.txt
Глава 4 · Техническая оптимизация Урок 7 из 9 Обновлено 26.08.2026

Ошибки в robots.txt

Главное недоразумение вокруг robots.txt: он управляет обходом, а не индексом. Из этого следуют почти все ошибки — разбираем их и правильный минимум для сайта.

Что изменилось с прошлой версии урока В старом тексте были директивы Host и Crawl-delay. Обе больше не поддерживаются: главное зеркало определяется редиректами и canonical, а скорость обхода — настройками в панелях вебмастеров и реальной скоростью ответа сервера.

Что robots.txt делает и чего не делает

ДелаетНе делает
Запрещает загружать указанные адресаНе убирает страницу из индекса
Экономит бюджет обходаНе защищает содержимое — файл публичен
Указывает путь к sitemapНе влияет на ранжирование напрямую
Разграничивает правила по user-agentНе гарантирует соблюдения недобросовестными ботами
Главный парадокс Чтобы убрать страницу из индекса через noindex, робот должен её загрузить и прочитать мета-тег. Если адрес закрыт в robots.txt, робот этого не сделает — и страница может остаться в выдаче с пометкой, что описание недоступно.

Правильный порядок для скрытия страницы

  1. Поставить <meta name="robots" content="noindex"> или заголовок X-Robots-Tag: noindex.
  2. Оставить адрес открытым в robots.txt.
  3. Дождаться, пока страница пропадёт из индекса — обычно недели.
  4. Только после этого, если нужно экономить бюджет обхода, закрыть адрес директивой Disallow.

Типичные ошибки

ОшибкаПоследствие
Disallow: / на боевом сайтеСайт выпадает из выдачи. Обычно едет с тестового сервера при релизе
Закрыты /css/, /js/, изображенияРобот видит неотрисованную страницу
Disallow вместо noindexСтраница остаётся в индексе без описания
Файл отдаёт 404 или 5xxЧасть роботов трактует как ошибку; при 5xx обход может приостановиться
Файл не в корнеНе учитывается: только /robots.txt
Директивы для несуществующих ботовМёртвый код, вводит в заблуждение
Забыт SitemapУпущенная возможность подсказать карту сайта
Правила для * раньше конкретного ботаКонкретный бот читает только свой блок и игнорирует общий

Как читаются правила

Робот выбирает один блок — наиболее подходящий для своего user-agent — и применяет только его. Остальные блоки игнорируются целиком.

User-agent: Googlebot
Disallow: /search/

User-agent: *
Disallow: /search/
Disallow: /cart/

В этом примере Googlebot прочитает только первый блок и не закроет /cart/. Общие правила нужно повторять в каждом блоке.

Приоритет Allow и Disallow

Disallow: /catalog/
Allow: /catalog/smesiteli/

Побеждает более длинное правило, поэтому /catalog/smesiteli/ останется открытым, а остальной каталог — закрытым. Порядок строк значения не имеет.

Спецсимволы

СимволЗначениеПример
*Любая последовательностьDisallow: /*?sort=
$Конец адресаDisallow: /*.pdf$
#Комментарий# служебные разделы

Рабочий минимум

User-agent: *
Allow: /

# служебное, что не должно тратить бюджет обхода
Disallow: /search/
Disallow: /*?q=
Disallow: /cart/
Disallow: /checkout/
Disallow: /*?sort=
Disallow: /*?utm_

# ресурсы для отрисовки — открыты
Allow: /assets/
Allow: /*.css$
Allow: /*.js$

Sitemap: https://site.ru/sitemap.xml

Всё, что действительно требует скрытия (личные кабинеты, админка, тестовые контуры), закрывается авторизацией, а не строкой в публичном файле.

Проверка

  1. Открыть https://site.ru/robots.txt в браузере — код 200, кодировка UTF-8, обычный текст.
  2. Search Console → Настройки → robots.txt: какой файл видит Google и когда обращался.
  3. Яндекс.Вебмастер → Инструменты → Анализ robots.txt: проверка конкретных адресов.
  4. Search Console → Проверка URL: не заблокированы ли ресурсы для отрисовки.
  5. После каждого релиза — убедиться, что Disallow: / не приехал с тестового сервера.
# быстрая проверка после деплоя
curl -s https://site.ru/robots.txt | grep -E '^Disallow: /$' && echo 'ВНИМАНИЕ: сайт закрыт целиком'

Итог

robots.txt управляет обходом, а не индексом. Держите его минимальным, никогда не закрывайте CSS и JS, не используйте его вместо noindex, повторяйте общие правила в каждом блоке user-agent и проверяйте файл после каждого релиза. Дальше — ошибки в sitemap.xml.

Частые вопросы

Убирает ли robots.txt страницу из индекса?

Нет. Директива Disallow запрещает загружать страницу, но адрес может остаться в индексе — например, если на него ведут внешние ссылки. Для исключения из выдачи нужен noindex, а он требует, чтобы страница была доступна роботу.

Можно ли закрывать CSS и JS?

Нельзя. Без них робот не отрисует страницу и увидит «поехавший» макет. Это прямо ухудшает оценку удобства и может повлиять на индексацию содержимого.

Какая директива важнее: Allow или Disallow?

Побеждает более длинное (конкретное) правило, а не порядок в файле. При равной длине приоритет у Allow. Это позволяет закрыть каталог целиком и открыть внутри него нужное.

Нужен ли robots.txt небольшому сайту?

Файл должен существовать и отдавать 200 — иначе часть роботов сочтёт это ошибкой. Но содержимое может быть минимальным: открыть всё и указать sitemap.

Вся глава «Техническая оптимизация» — 9 уроков
  1. Техническая оптимизация сайта
  2. Скорость доступа к сайту
  3. Битые страницы и ссылки
  4. Дубли мета-тегов и заголовков H1
  5. Дубли контента
  6. Организация пагинации
  7. Ошибки в robots.txt
  8. Ошибки в sitemap.xml
  9. Типичные технические ошибки