«Тошнота высокая — переписывай». Фраза звучит как приговор, но за ней стоит число, у которого есть формула и есть происхождение. Мы посчитали это число на собственном блоге — 193 статьи — и сверили пороги с теми, кто их придумал.
Ответ короткий: одна из двух тошнот измеряет длину текста, а не спам. Ниже — как это видно на цифрах.
Две тошноты и одна формула
Определение берём у Адвего — сервиса, который эту метрику и популяризировал: «Классическая тошнота определяется по самому частотному слову — как квадратный корень из количества его вхождений». Пример там же: слово встречается 16 раз, классическая тошнота равна 4.
Посмотрите на формулу внимательно. В ней нет длины текста. Корень из шестидесяти восьми — это 8,25, и неважно, на двух тысячах слов или на двадцати тысячах эти шестьдесят восемь набрались.
Сам сервис это признаёт: «Максимально допустимое значение классической тошноты зависит от объема текста — для 20 000 знаков тошнота, равная 5, будет нормальной, а для 1000 знаков — слишком высокой». То есть число без указания объёма смысла не имеет, а именно так его обычно и называют.
Вторая метрика — академическая тошнота — определена туманнее: «отношение самых частотных и значимых слов по специальной формуле. Нормальное значение — в пределах 5-15%». Какие именно слова и какая формула, не сказано. Повторить расчёт со стороны нельзя.
Что вышло на 193 статьях
Прогнали весь блог. Медиана объёма — 792 слова, разброс от 399 до 5070.
| Классическая тошнота | Статей |
|---|---|
| Меньше 4 | 158 |
| 4–5 | 25 |
| 5–6 | 6 |
| 6–7 | 1 |
| 7–8 | 2 |
| Больше 8 | 1 |
Медиана — 3,16, максимум — 8,25. Порог «пять», который называют чаще прочих, перешагнули десять статей.
Теперь главное. Разложим те же статьи по объёму.
| Объём статьи | Статей | Медиана классической тошноты |
|---|---|---|
| До 800 слов | 100 | 2,92 |
| 800–1200 | 65 | 3,46 |
| 1200–1600 | 19 | 4,58 |
| 1600–2200 | 6 | 5,64 |
Метрика удваивается вместе с объёмом. Это не наблюдение о качестве текстов — это прямое следствие квадратного корня без деления на длину.
Проверим обратным счётом. Доля самого частого значимого слова — та же величина, но поделённая на объём — держится ровно: медиана 1,27%, разброс от 0,66% до 3,84%, и от длины статьи она почти не зависит. Один и тот же корпус по одной мерке выглядит спокойным, по другой — растущим.
Кто возглавил список
Три самые «тошнотные» статьи блога выглядят так:
| Статья о чём | Слово | Раз | Слов в статье | Тошнота |
|---|---|---|---|---|
| Канонические адреса | url | 68 | 1769 | 8,25 |
| Техническая оптимизация | сайта | 63 | 1696 | 7,94 |
| Большое руководство | 52 | 5070 | 7,21 |
Статья про канонический адрес шестьдесят восемь раз произносит «url». Статья о технической оптимизации — «сайта». Руководство на пять тысяч слов — «google».
Заменить эти слова не на что: термин в тексте о термине повторяется по необходимости. Третья строка особенно показательна — на пяти тысячах слов доля «google» всего 1,03%, самая низкая в тройке, а тошнота высокая. Метрика наказала статью за длину.
Пороги, которых не существует
Мы искали слово «тошнота» в справке Яндекса для вебмастеров — по полному указателю раздела. Ноль упоминаний. Метрика придумана сервисами проверки, и поисковая система о ней ничего не обещает.
С «водой» ещё нагляднее. Два известных сервиса используют одно слово и расходятся втрое.
Текст.ру: «до 15% — естественное содержание „воды“ в тексте; от 15% до 30% — превышенное содержание; от 30% — высокое содержание».
Адвего: «Процент воды в Адвего определяется как отношение незначимых слов к общему количеству слов… нормальный показатель — 55%-75%».
То, что у одного «высокое содержание», у другого вдвое ниже нормы. Спорить тут не о чем: это разные определения незначимого слова, а значит — разные величины под одним названием.
Наш собственный инструмент считает третью: долю слов из списка в полторы сотни служебных. Медиана по блогу — 31,6%, и порог у нас стоит на тридцати. Цифра случайно совпала с порогом Текст.ру, но меряет другое.
Что с этим делать
Отсюда следуют четыре правила, и все они про осторожность с числом.
Число без объёма — не число. «Тошнота 6» — это плохо для заметки на тысячу знаков и нормально для руководства на двадцать тысяч. Сравнивать тексты разной длины по этой метрике нельзя.
Сравнивать можно только внутри одного сервиса. Перенести порог Адвего на показания Текст.ру — всё равно что сравнить градусы Цельсия с Фаренгейтом.
Смотреть, какое слово вышло в лидеры. Если это термин статьи — метрика показала тему, а не спам. Если это «компания», «услуги», «качественный» — тогда да, есть о чём поговорить.
Мерить долю, а не корень. Доля самого частого слова от общего числа слов честнее ведёт себя на разных объёмах. Это те самые проценты, которые в SEO называют плотностью ключа, и порог там обычно ставят на трёх процентах.
Границы замера
Считали 23 сентября 2026 года по собственному блогу: 193 файла, из текста убраны служебная шапка, куски кода и адреса ссылок. Чужих текстов в выборке нет, так что говорить «в среднем по рынку» мы не можем.
Классическую тошноту считали по опубликованной формуле Адвего и проверяли на их же примере. Академическую не считали вовсе: формула не раскрыта, а подгонять свою под чужое название бессмысленно.
Список служебных слов для водности — наш, из инструмента проверки. С определениями Адвего и Текст.ру он не совпадает, поэтому наши 31,6% с их шкалами сравнивать нельзя. Это и есть главный вывод статьи, только про нас самих.
Коротко
Классическая тошнота — квадратный корень из числа повторов самого частого слова, без деления на объём. На нашем блоге она растёт с длиной статьи почти вдвое: 2,92 у коротких против 5,64 у полуторатысячных. Спама в длинных статьях при этом не прибавилось — прибавилось слов.
Порогов у поисковика нет: слово «тошнота» в справке Яндекса не встречается. Пороги есть у сервисов, и они противоречат друг другу — «вода» от 30% у одного считается высокой, у другого нормой названы 55–75%.
Польза у метрики одна: она быстро показывает, какое слово в тексте главное. Дальше смотреть надо глазами. Как это связано с поведением читателя — в разборе конверсии, а про честность измерений — в «Трафике, которого нет».
