Перейти к содержимому
SEO/Опубликовано 22 сентября 2026 г./5 мин

Уникальность текста: один абзац, два числа — 3 % и 98 %

Посчитали уникальность одного своего абзаца сами, меняя только настройки проверки: длину шингла и корпус сравнения. Получили от 3 до 98 процентов. Плюс замер справки Яндекса: слова «уникальность» как метрики там нет.

Уникальность текста: один абзац, два числа — 3 % и 98 %
С
Команда NEXFORCE
SEO-эксперт NEXFORCE

«Проверьте текст на уникальность» — совет, который дают, не уточняя, чем проверять. Уточнение решает всё: один и тот же абзац получает и 3 %, и 98 % в зависимости от настроек, которых проверяющий не видит. Мы посчитали это сами, на своём тексте и своим кодом.

Что мы посчитали

Что проверялиРезультат
Один абзац, шингл 3 слова, корпус со статьёй-источником3,1 %
Тот же абзац, шингл 10 слов, корпус без статьи-источника97,8 %
Разброс на одном тексте от смены двух настроек3–98 %
Кусок 300 знаков против того же текста в 1302 знака100 % против 92,6 %
Страниц в справке Яндекса для вебмастеров272
Из них упоминают корень «уникальн»35, порога в процентах — ни одного
Наших статей с дословными цитатами42 из 187, до 29,5 % объёма
Уникальность наших статей на фоне своего же блогамедиана 96,4 %, минимум 65,4 %
Сервисов, которые удалось проверить машиной0 из 3

Как устроена проверка

Текст режется на шинглы — цепочки подряд идущих слов. Каждый шингл ищется в корпусе: в индексе поиска, в базе сервиса, в списке страниц. Уникальность — доля шинглов, которые нигде не нашлись.

Отсюда то, о чём не пишут на странице результата: число зависит от двух настроек. Первая — длина шингла: чем он длиннее, тем реже совпадает и тем выше процент. Вторая — корпус: нашлась ли в нём страница, где текст уже опубликован.

Ни один из четырёх проверенных нами сервисных разделов длину шингла не называет. Мы искали слово «шингл» на страницах text.ru, content-watch.ru и be1.ru — ноль вхождений.

Один абзац, два числа

Взяли 1302 знака из своей статьи «Трафик, которого нет», опубликованной и доступной поиску. Корпус — 187 статей нашего блога, 157 678 слов. Считали сами, кодом в десять строк.

Длина шинглаКорпус со статьёй-источникомКорпус без неё
3 слова3,1 %87,4 %
4 слова4,7 %92,6 %
5 слов6,3 %94,7 %
7 слов9,6 %96,3 %
10 слов14,7 %97,8 %

Текст один, разброс — от 3 до 98 %. Левый столбец увидит сервис, нашедший исходную страницу; правый — сервис, до неё не добравшийся: страница молодая, закрыта от индексации или не попала в его базу.

Правильного среди этих чисел нет: каждое верно при своих настройках.

Длина куска двигает число тоже

Тот же текст, тот же корпус, шингл в четыре слова — меняем только сколько знаков проверяем:

Длина кускаУникальность
300 знаков100 %
500 знаков95,8 %
800 знаков96,6 %
1000 знаков90,3 %
1302 знака92,6 %

Короткий кусок почти всегда уникальнее: шинглов меньше, и одно совпадение весит больше. Проверять абзацами и проверять статью целиком — две разные проверки с разными ответами.

В справке Яндекса нет слова «уникальность»

Мы скачали все страницы справки для вебмастеров — их 272. Корень «уникальн» встречается на 35, почти всегда про уникальный идентификатор объявления, адрес страницы или описания. Порога в процентах нет ни на одной странице.

Нарушение, о котором идёт речь, называется иначе:

Малополезный контент — это информация, которая не несет дополнительную ценность пользователю и не решает его задачу.

Копирование описано признаками:

Контент скопирован полностью или частично с других ресурсов. Информация с нескольких страниц первоисточника собрана в одну. Материал скопирован из меняющегося источника. Информация взята из первоисточника с минимальными изменениями (например, заменили несколько слов).

Последняя строка закрывает рерайт: замена слов от нарушения не спасает, хотя процент поднимает. Само слово «скопирован» справка определяет через затраты, а не через совпадение:

Это способ создания контента, который не требует затрат времени, усилий и специальных навыков, а также ручного редактирования или обработки текста.

Сервис штрафует то, что поиск разрешает

В той же справке есть список того, что малополезным не признаётся:

Оригинальные описания товаров, услуг, событий, организаций, компьютерных программ, инструкций к применению и руководств по эксплуатации. Тексты книг, песен, анекдотов, цитат и афоризмов. Официальные документы, законы, стандарты, шаблоны документов. Пресс-релизы. Собственные тексты сайта, опубликованные на других платформах.

Каждая строка списка в любой проверке даёт совпадение. Закон совпадает с текстом закона, цитата — с источником, свой текст из соцсети — сам с собой.

Для нас это не теория. В 42 наших статьях из 187 есть дословные цитаты: справки Яндекса, законов, приказов. У статьи про уведомление в РКН они занимают 29,5 % объёма — 265 слов из 897. Проверка отнимет эти проценты, а справка Яндекса ровно такой контент из-под нарушения выводит.

Наш блог на фоне самого себя

Честный замер про себя. Мы сравнили каждую из 187 статей со всеми остальными статьями блога — шингл в четыре слова, чужих сайтов в корпусе нет:

  • медиана — 96,4 %;
  • ниже 95 % — 63 статьи, ниже 90 % — 32;
  • минимум — 65,4 %.

Внизу списка — серия городских обзоров: сайты строительных компаний, ветклиник, мебельных производств, автошкол. У них общий каркас: одна методика, одни заголовки разделов, одни формулировки выводов. По существу каждая статья про свою выборку, а по шинглам треть текста повторяется.

Внешний сервис этого не покажет: он ищет по всему интернету, а не внутри одного блога. Но при разборе малоценных страниц смотреть надо сюда — на собственную шаблонность.

Три сервиса проверить машиной не вышло

План был прогнать абзац через три бесплатные проверки и показать разброс. Не получилось, и причина показательна:

  • be1.ru после нажатия «Проверить» выдаёт капчу с картинками;
  • content-watch.ru прямо пишет в условиях: «Использовать любые средства автоматического доступа к сервису запрещено»;
  • text.ru без регистрации и ключа к программному интерфейсу не пускает.

Обходить капчу и запрет мы не стали. Вывод: у чисел, полученных руками в трёх окнах, нет журнала и нет повторяемости. Сравнивать их между собой — сравнивать три замера с неизвестными настройками.

Свой замер воспроизводим: корпус лежит в репозитории, настройки названы, код умещается в десяток строк.

Что делать вместо погони за процентом

Смотреть на список совпадений, а не на число. Сервис показывает, с какими страницами совпал текст. Дальше три случая:

  1. Совпадение с чужой статьёй длинными кусками — проблема, и число тут не нужно, видно и так.
  2. Совпадение с текстом закона, ГОСТа, справки — не проблема, справка Яндекса прямо выводит это из-под нарушения.
  3. Совпадение с самим собой: своей страницей, своим постом в соцсети, своей прошлой статьёй. Первые два безобидны, третий стоит посмотреть — это про шаблонность, а не про плагиат.

Рерайт ради процента — работа против себя: цифру поднимает, а по признакам из справки не меняет ничего.

Границы замера

Мы считали своим кодом по своему корпусу — 187 статей одного блога. Это не интернет: сервисы ищут по индексу поиска, и их числа с нашими сравнивать нельзя. Замер показывает, как настройки двигают результат, а не какой процент выдаст конкретный сервис.

Три сервиса мы не проверили — капча и запрет автоматического доступа. Разброс между сервисами у нас не измерен: измерен разброс от настроек, а различие настроек у них предполагается, раз длину шингла не публикует ни один.

Лемматизацию мы не делали: шинглы считались по словоформам. Сервисы, которые приводят слова к начальной форме, на тех же текстах дадут числа ниже наших.

Справку Яндекса мы читали 22 сентября 2026 года в машинной версии страниц. Справку Google в этот замер не брали.

Коротко

  • Уникальность — не свойство текста, а результат сравнения с настройками.
  • Меняя только длину шингла и корпус, мы получили на одном абзаце 3 % и 98 %.
  • Короткий кусок почти всегда «уникальнее» длинного.
  • В справке Яндекса на 272 страницах нет порога уникальности в процентах.
  • Нарушение называется «малополезный контент» и описано признаками.
  • Цитаты законов и свои тексты с других площадок справка выводит из-под нарушения, а проверка их считает совпадением.
  • Смотреть надо на список совпадений, а не на процент.
Вопросы и ответы

FAQ по теме

Почему сервисы показывают разную уникальность одного текста?+
Потому что «уникальность» — не свойство текста, а результат сравнения, и у сравнения есть настройки. Главные две: длина шингла, то есть цепочки слов, которую сервис считает совпадением, и корпус, с которым он сравнивает. Мы меняли только их и получили на одном абзаце от 3 до 98 процентов.
Какая уникальность нужна для Яндекса?+
В справке Яндекса такого порога нет. Мы скачали все 272 страницы справки для вебмастеров: корень «уникальн» встречается на 35 из них, и почти везде речь про уникальные идентификаторы и адреса, а не про процент текста. Нарушение называется «малополезный контент», и описано оно признаками, а не числом.
Почему проверка показывает низкую уникальность у текста с цитатами закона?+
Потому что дословная цитата совпадает с источником по построению. При этом справка Яндекса прямо выводит такой контент из-под нарушения: в списке того, что не признаётся малополезным, стоят официальные документы, законы, стандарты, шаблоны документов, а также тексты цитат. Сервис и поиск здесь оценивают текст противоположно.
Уникальность своего текста на чужой площадке считается плагиатом?+
По справке Яндекса — нет. В том же списке исключений: собственные тексты сайта, опубликованные на других платформах, например в социальных сетях. Сервис проверки этого различия не делает и покажет совпадение.
Что проверять вместо процента уникальности?+
Совпадения дословно, а не итоговую цифру. Любой сервис показывает список найденных источников — смысл имеет он: если ваш текст совпадает с чужой страницей длинными кусками, это видно и без процента. Если совпадения — это ваши же цитаты закона и ваши же формулировки с других площадок, число можно игнорировать.