Подписывайтесь на Telegram-канал Анатолия Половинкина основателя компании TolkaDigital
Главная - Глоссарий - Тошнотность текста

Тошнотность текста

Keyword stuffing ratio

SEO

Тошнотность текста — показатель частоты употребления ключевых слов и фраз относительно общего объема текста, который применяется для выявления переспама ключевиками и оценки естественности написания.

Что такое тошнотность текста

Тошнотность текста — цифровое выражение того, насколько навязчиво одно слово или фраза повторяется в тексте. Метрика появилась в среде SEO-специалистов как ответ на массовое злоупотребление ключевыми словами в начале 2000-х, когда поисковики ранжировали страницы во многом по плотности ключей. Тогда вебмастера буквально набивали тексты ключевыми фразами, повторяя их по 30-50 раз на страницу — результат смотрелся жутко, но работал. Название «тошнотность» прижилось именно потому, что от таких текстов буквально становилось неприятно — они были нечитаемы для человека, хотя и понятны алгоритмам того времени. Сегодня этот термин используется в двух смыслах: как инструмент проверки текста на переспам и как сигнал качества при оценке контента перед публикацией. Понимать разницу между умеренным и чрезмерным использованием ключей — базовый навык SEO-специалиста.

История термина связана с инструментом Advego — одной из первых русскоязычных SEO-платформ, которая в середине 2000-х предложила автоматический подсчет частоты слов в тексте. Advego разработал собственный алгоритм «академической тошнотности», основанный на законе Ципфа, который описывает, как слова распределяются по частоте употребления в естественном языке. Классическая же тошнотность — это просто процент от общего числа слов: если слово встретилось 5 раз в тексте из 500 слов, классическая тошнотность равна 1%. Оба подхода по-прежнему используются, хотя в SEO-среде сложились разные взгляды на то, насколько эти метрики важны в 2024 году. Несмотря на то что современные алгоритмы поисковиков стали несравнимо умнее, тошнотность не потеряла практической ценности как инструмент базовой проверки текста. Именно с её помощью быстро выявляют очевидный переспам, который алгоритмы до сих пор наказывают.

В digital-маркетинге тошнотность текста играет двойную роль. С одной стороны, она помогает оптимизатору убедиться, что ключевые слова присутствуют в тексте в нужном количестве — не слишком мало, чтобы страница ранжировалась по целевым запросам, и не слишком много, чтобы не попасть под фильтр поисковика. С другой стороны, она служит индикатором читаемости: текст с тошнотностью ключевого слова выше 5-7% почти всегда выглядит неестественно и раздражает живого читателя. Яндекс официально не публикует пороговые значения, но практика показывает: статьи с тошнотностью ключевой фразы выше 8% регулярно попадают под фильтр «Баден-Баден», который алгоритм запустил в 2017 году. Google работает похоже — алгоритм Panda, запущенный в 2011 году, целенаправленно снижал позиции страниц с признаками низкого качества контента, включая переспам ключевиками. Поэтому тошнотность остается рабочим инструментом проверки даже для специалистов, которые давно перешли на более сложные метрики качества контента.

Понимать тошнотность важно не только SEO-специалисту, но и любому предпринимателю, который работает с сайтом самостоятельно или ставит задачи копирайтерам. Заказчик, который не знает об этом показателе, рискует получить от исполнителя «оптимизированный» текст, где ключевая фраза вставлена через каждые два-три предложения — это переспам, и такой текст почти наверняка навредит позициям. Обратная проблема — слишком осторожный копирайтер, который боится повторений настолько, что не пишет ключевое слово совсем: страница тогда просто не ранжируется по нужному запросу. Золотая середина — 1-3% классической тошнотности для основного ключа, при этом академическая тошнотность по Advego должна быть в диапазоне 7-9 баллов для наиболее частотного слова. Эти цифры не догма, но дают ориентир при создании и проверке контента. Специалист, который умеет читать показатели тошнотности и правильно их интерпретировать, защищен от большинства типичных ошибок при написании SEO-текстов.

Как работает тошнотность текста

  1. Подсчет вхождений слова. Инструмент анализа (Advego, text.ru, онлайн-счетчики) разбивает текст на отдельные токены — слова или словоформы. Каждое уникальное слово подсчитывается независимо от его формы: «агентство», «агентства», «агентству» — три разных токена при классическом подсчете, но могут быть объединены при лемматизации. Результат — список всех слов с указанием частоты, то есть сколько раз каждое слово встретилось в тексте. На этом этапе обычно исключаются стоп-слова (предлоги, союзы, частицы), которые не несут смысловой нагрузки и у которых заведомо высокая частота.
  2. Расчет классической тошнотности. Для каждого слова или фразы частота делится на общее количество слов в тексте и умножается на 100%. Например, фраза «интернет-маркетинг» встретилась 8 раз в тексте из 800 слов — классическая тошнотность равна 1%. Этот показатель прост и понятен, но у него есть ограничение: он не учитывает, как выглядит текст в целом. Два слова с тошнотностью по 1% — норма, а 15 слов с тошнотностью по 1% каждое — это уже текст, перегруженный разными ключами, что тоже сигнал проблемы.
  3. Расчет академической тошнотности. Advego считает академическую тошнотность иначе: берется корень квадратный из числа вхождений самого частотного значимого слова. Если слово встретилось 49 раз, академическая тошнотность равна 7 (корень из 49). Оптимальный диапазон по методике Advego — 7-9 баллов. Значение ниже 7 говорит о том, что текст, возможно, слишком «водянистый» — в нем нет четкой темы или ключевые слова присутствуют в недостаточном количестве. Значение выше 9 — сигнал переспама, текст нужно перерабатывать.
  4. Сравнение с пороговыми значениями. После расчета инструмент или специалист сравнивает полученные значения с рекомендуемыми диапазонами. Для классической тошнотности ориентир — 1-3% для основного ключа, 0.5-1.5% для вспомогательных. При анализе конкурентов полезно замерить тошнотность страниц в топ-3 Яндекса или Google по целевому запросу — это даст понимание нормы именно для конкретной ниши и типа контента. Например, в медицинских текстах профессиональные термины объективно встречаются чаще, и алгоритмы это учитывают.
  5. Оценка семантического поля. Современные подходы к анализу тошнотности выходят за рамки простого подсчета одного ключа. Инструменты типа text.ru или Content Watch анализируют, насколько текст богат синонимами, LSI-словами (латентно-семантическими) и тематически связанными понятиями. Страница, где ключевое слово «продвижение сайта» встречается умеренно, но зато есть слова «SEO», «оптимизация», «позиции», «трафик», «ранжирование» — воспринимается алгоритмами намного лучше, чем страница с просто высокой плотностью одного ключа. Это отражает современное понимание качества контента поисковиками.
  6. Применение фильтра поисковиком. Если страница при обходе краулером имеет признаки переспама, алгоритм понижает её в выдаче или убирает из топа. Яндекс применяет фильтр «Баден-Баден» автоматически — без уведомления вебмастера, что подтверждено в официальном блоге компании. Google работает аналогично через алгоритм оценки качества контента. Восстановление позиций после фильтра возможно: нужно переработать текст, снизить тошнотность, и при следующем обходе краулер зафиксирует изменения — обычно на восстановление уходит от 3 до 8 недель.

Виды тошнотности текста

  • Классическая тошнотность. Самый простой вид — процент конкретного слова или фразы от общего количества слов в тексте. Считается вручную или любым онлайн-калькулятором за секунды. Применяется как быстрая проверка: если ключевое слово встречается в каждом абзаце по 2-3 раза, классическая тошнотность явно зашкаливает. Для основного ключа безопасным считается диапазон 1-3%, для вспомогательных LSI-слов — до 1%.
  • Академическая тошнотность. Методика Advego, основанная на законе Ципфа о распределении частот слов в естественных текстах. Вычисляется как корень из числа вхождений самого частотного значимого слова. Академическая тошнотность 7-9 считается нормой для SEO-текста: слишком низкая говорит о размытости темы, слишком высокая — о переспаме. Этот показатель полезен при глубоком аудите большого массива текстов — например, при проверке 50-100 статей блога.
  • Тошнотность фразы. Отдельный показатель для мультисловных запросов. Если оптимизатор продвигает страницу по запросу «купить квартиру в Москве», важна не только тошнотность каждого слова отдельно, но и плотность полного вхождения всей фразы. Для точного вхождения ключевой фразы нормой считается 1-2 вхождения на 1000 слов текста. Превышение этого порога — один из первых сигналов, которые алгоритмы распознают как попытку манипуляции.
  • Семантическая насыщенность. Более сложная метрика, которая оценивает не один ключ, а все тематически связанные слова вместе. Страница с богатым семантическим полем — синонимами, смежными понятиями, профессиональными терминами — воспринимается алгоритмами как экспертный материал. Инструменты типа «Главред» или «ТурбоСЕО» помогают оценить семантическую связность текста. На практике: статья о «продвижении сайта» без слов «SEO», «поисковые системы», «трафик», «позиции» вызовет вопросы у алгоритма Яндекса — он ожидает определенный семантический профиль для тематической страницы.
  • Тошнотность по всему документу. Оценивается не только в теле статьи, но и во всех элементах страницы: заголовке (Title), мета-описании (Description), h1-h6, alt-атрибутах изображений. Если ключевое слово стоит в title, h1 и повторяется 10 раз в тексте — суммарная концентрация сигнала очень высокая, и поисковик это учитывает. Поэтому при расчете тошнотности аудиторы иногда проверяют полный HTML-код страницы, а не только видимый текст. Суммарный вес сигнала по всем элементам важнее, чем тошнотность только в теле статьи.
  • Динамическая тошнотность. Менее известный, но практически важный вид — анализ того, как ключевое слово распределено по тексту. Текст, где ключ встречается равномерно через каждые 100-150 слов, выглядит искусственно и легко детектируется как машинно-оптимизированный. Естественный текст имеет неравномерное распределение: ключ появляется чаще в начале (где тема вводится), реже в середине и умеренно в конце. Некоторые инструменты строят визуальный график плотности ключа по тексту — это помогает выявить механически вставленные повторения.

Сравнение

Параметр Классическая тошнотность Академическая тошнотность
Формула расчета (кол-во вхождений / кол-во слов) x 100% корень квадратный из числа вхождений самого частотного слова
Оптимальное значение 1-3% для основного ключа 7-9 баллов по шкале Advego
Что учитывает только частоту одного слова или фразы распределение всего словарного запаса текста
Скорость расчета мгновенно, вручную за 30 секунд требует полного анализа текста инструментом
Лучше применять быстрая проверка конкретного ключа глубокий аудит качества контента

Пример использования

Блог B2B-компании, продающей программное обеспечение для управления складом, в феврале 2023 года опубликовал статью «Система управления складом: как выбрать». Трафик на статью через три месяца составил 210 визитов в месяц, хотя по аналогичным запросам конкуренты собирали 1200-1800 визитов. Анализ через Advego показал классическую тошнотность по фразе «система управления складом» — 6.8%, академическая тошнотность топ-слова достигла 12 баллов. Страница не попала под жесткий фильтр, но занимала 18-22 позиции по основным запросам вместо ожидаемого топ-10.

Копирайтер переработал статью: убрал прямые повторения ключевой фразы, заменив часть вхождений синонимами «WMS», «складской модуль», «система учета», добавил LSI-слова — «штрихкодирование», «адресное хранение», «инвентаризация». Классическая тошнотность по основной фразе снизилась до 2.1%, академическая тошнотность — до 8 баллов. Через 5 недель после переиндексации статья вышла на позиции 6-8 по основному кластеру запросов, трафик вырос до 870 визитов в месяц. При среднем чеке продукта 120 000 рублей даже 2 дополнительных лида в месяц с органики дали ROI правки контента в 40 раз.

Частые вопросы

Тошнотность и плотность ключевых слов — это одно и то же?

Это близкие, но не идентичные понятия. «Плотность ключевых слов» (keyword density) — более широкий термин из английской SEO-практики, он обозначает процент конкретного ключевого слова от общего объема текста. «Тошнотность» — термин, который прижился в русскоязычном SEO-сообществе и охватывает несколько метрик сразу: и классическую (аналог keyword density), и академическую (методика Advego по закону Ципфа). Кроме того, в русскоязычной практике слово «тошнотность» несет оценочный оттенок: высокая тошнотность — это нехорошо, это сигнал проблемы. Тогда как keyword density — нейтральный показатель, который может быть как слишком низким, так и слишком высоким. На практике, когда SEO-специалист говорит «проверь тошнотность», он почти всегда имеет в виду полный анализ в Advego или text.ru — это и классическая, и академическая метрика одновременно.

Есть ли точные пороговые значения тошнотности, которые использует Яндекс?

Яндекс не публикует конкретные цифры и официально не подтверждает, что использует «тошнотность» как таковую. При этом фильтр «Баден-Баден», запущенный в марте 2017 года, работает именно с текстами, где ключевые слова используются неестественно часто — это подтверждено в официальном блоге Яндекса. На практике SEO-специалисты ориентируются на следующие ориентиры: классическая тошнотность выше 5-7% по основному ключу уже рискованна, выше 8% — высокая вероятность фильтра. Академическая тошнотность выше 10-11 баллов по Advego — тревожный сигнал. Для Google точных данных тоже нет, но алгоритм Panda (с 2011 года, теперь часть основного алгоритма) регулярно снижает позиции страниц с признаками низкого качества контента. Лучший способ не угадывать порог — анализировать топ-10 выдачи по целевому запросу и ориентироваться на тошнотность лидирующих страниц.

Как быстро сайт восстанавливает позиции после снижения тошнотности?

Срок восстановления зависит от того, насколько серьезным был переспам и как быстро краулер обойдет обновленную страницу. В большинстве случаев Яндекс переобходит активные страницы в течение 1-3 недель после правок — особенно если сайт регулярно обновляется и имеет хороший показатель краулинга. Google обычно работает быстрее: популярные страницы переиндексируются за 3-7 дней. Практика показывает: если тошнотность снизилась умеренно (с 7% до 2.5%) и других проблем на странице нет, позиции начинают восстанавливаться через 3-5 недель. Если же переспам был тяжелым — страница вылетела из топ-100 — восстановление займет 6-10 недель. Чтобы ускорить процесс, страницу можно принудительно отправить на переобход через Яндекс.Вебмастер (инструмент «Переобход страниц»), но только после того, как правки реально внесены и видны на живом сайте — отправлять на переобход неисправленную страницу бессмысленно.

Все термины