- html5css.dev
- SEO
- SEO продвижение
- Сайт целиком и коммерция
- Соотношение текста и HTML
Соотношение текста и HTML
Text-to-HTML ratio — метрика из аудитов десятилетней давности. Фактором ранжирования она не является, но раздутая разметка действительно вредит — только измерять это нужно другими показателями.
Откуда взялась метрика
Text-to-HTML ratio — доля видимого текста в общем объёме исходного кода страницы. Метрика родилась в эпоху, когда вёрстка делалась таблицами: тогда огромный HTML при паре абзацев текста действительно указывал на страницу-пустышку. Инструменты аудита подхватили показатель, добавили «нормативы» из воздуха — и он дожил до наших дней, хотя вёрстка изменилась до неузнаваемости.
Сегодня низкое значение бывает и у отличных страниц: современная разметка включает JSON-LD, инлайновый критический CSS, SVG-иконки, атрибуты доступности. Всё это — код, который приносит пользу.
Когда показатель всё-таки о чём-то говорит
Плохое соотношение — не диагноз, а повод открыть исходный код и посмотреть, чем он занят. Типичные находки:
- Инлайновые стили в каждом теге. Следы визуальных конструкторов:
style="margin:0px;padding:0px;font-family:…"сотни раз. - Глубокая вложенность без причины. Десять вложенных
divвокруг одного абзаца. - Base64 прямо в разметке. Картинка на 200 КБ, вшитая в HTML, не кешируется отдельно и раздувает каждый ответ.
- Огромное состояние фреймворка.
__NEXT_DATA__или аналог на сотни килобайт, дублирующий содержимое страницы. - Мёртвая разметка. Скрытые блоки старых версий шаблона, комментарии с закомментированным кодом.
- Действительно пустая страница. Категория без описания, карточка без характеристик — и вот это уже проблема для ранжирования, но по совсем другой причине.
Чем заменить метрику
| Вместо | Смотрим | Ориентир | Чем измерить |
|---|---|---|---|
| Text-to-HTML ratio | Размер HTML-документа | до 100–150 КБ до сжатия | DevTools → Network, документ |
| Число узлов DOM | примерно до 1500 | Lighthouse, отчёт по DOM | |
| TTFB | до 0,8 с | PageSpeed Insights | |
| LCP | до 2,5 с | Core Web Vitals, полевые данные |
# размер документа и степень сжатия
curl -s -o /dev/null -w "без сжатия: %{size_download} байт\n" https://site.ru/page/
curl -s -o /dev/null -H "Accept-Encoding: br,gzip" \
-w "со сжатием: %{size_download} байт\n" https://site.ru/page/
Что действительно стоит сделать
- Вынести стили в CSS-файл. Инлайновые стили не кешируются и повторяются на каждой странице.
- Убрать лишние обёртки. Современная вёрстка на flex и grid требует заметно меньше вложенности.
- Заменить base64 на обычные файлы. Отдельный ресурс кешируется браузером и не тянется при каждом заходе.
- Включить Brotli. Самая дешёвая мера с самым большим эффектом.
- Проверить дублирование состояния. Если фреймворк отдаёт весь текст ещё и в JSON — это двойной вес.
- Наполнить пустые страницы. Если текста действительно мало, проблема не в отношении, а в содержании: категория без описания и карточка без характеристик плохо ранжируются сами по себе.
Итог
Соотношение текста к HTML — не фактор ранжирования и не цель оптимизации. Используйте его как индикатор: увидели низкое значение — откройте исходный код и посмотрите, чем он занят. Чинить нужно найденные причины, а измерять результат — весом документа, TTFB и LCP. Дальше в главе: выделения слов в тексте.
Частые вопросы
Влияет ли соотношение текста к HTML на позиции?
Нет. Ни Google, ни Яндекс не называют эту величину фактором ранжирования, и прямого влияния у неё нет. Плохое соотношение — это симптом, а не причина.
Какое соотношение считается нормальным?
Норматива не существует. Цифры вроде «должно быть больше 15 %» придуманы авторами аудиторских инструментов и ничем не подтверждены. У качественной страницы с богатой разметкой значение может быть низким.
О чём тогда говорит низкое значение?
Обычно о раздутом HTML: инлайновые стили в каждом теге, десятки вложенных div, огромные base64-строки в разметке, встроенные JSON-состояния фреймворков. Это стоит починить — но ради веса страницы и скорости, а не ради метрики.
Что измерять вместо этого?
Размер HTML-документа в килобайтах, время до первого байта, LCP и глубину DOM. Эти показатели связаны с реальной скоростью и понятны инструментам.
Вся глава «Сайт целиком и коммерция» — 22 урока
- Соотношение текста и HTML
- Выделения слов в тексте
- Использование заголовков H1, H2, H3
- Наличие мобильной версии сайта
- Структура сайта
- Число страниц сайта
- Простота и удобство использования
- Карта сайта или Sitemap
- Хлебные крошки
- Доменные зоны: ccTLD и gTLD
- Возраст домена
- Выделенный IP-адрес
- Коммерческие факторы ранжирования
- Контактная информация
- Профили компании в социальных сетях
- Отсутствие сторонней рекламы
- Ассортимент товаров
- Карточка товара
- Доставка и транспортные услуги
- Служба поддержки клиента
- Онлайн-консультант
- Скидки и акции