«Малоценная или маловостребованная страница» — самая обидная строка в Яндекс.Вебмастере. Обидная, потому что технических претензий нет: сайт отвечает, robots в порядке, карта читается, скорость в норме. Робот пришёл, прочитал страницу целиком и решил, что показывать её не будет.
В справке про это сказано ровно одно предложение. Дальше вебмастер идёт читать советы, и советы везде одинаковые: «сделайте контент полезнее», «увеличьте объём», «уберите дубли». Мы проверили эти советы измерением на собственном сайте — и три из них не подтвердились.
Ниже — разбор по 341 событию индексации. Это не пересказ справки и не подборка мнений: все числа сняты из Яндекс.Вебмастера по одному домену, за которым мы наблюдаем каждый день с июня.
Что мы наблюдали
Сайт молодой, восстановлен из бэкапа в конце июня. За время наблюдения Вебмастер записал 341 событие индексации: 236 появлений в поиске и 105 удалений. Из 105 удалений 103 — с пометкой «малоценная или маловостребованная». Остальные два: одно по редиректу, одно по canonical.
То есть у этого вердикта монополия. Если страница уходит из поиска, почти наверняка она ушла именно так.
Второе наблюдение: удаления идут не поштучно, а волнами. 30 июня за один день сняли 85 страниц. Не пять и не десять — восемьдесят пять, почти весь сайт разом, через три дня после восстановления. Никаких изменений на сайте в этот день не было.
Это важно понять правильно, потому что отсюда растёт первая ошибка. Увидев такую волну, вебмастер начинает искать, что он сломал именно в тот день. Ломать было нечего: страницы стояли неделю без правок. Робот просто дошёл до переоценки всего хоста сразу.
Какие страницы снимают, а какие нет
Мы разложили индексацию по типам страниц. Разница оказалась не постепенной, а качественной.
Держатся полностью или почти полностью:
- страницы городов — 24 из 24;
- страницы проверок (по одной на конкретную проверку) — 9 из 9;
- термины словаря — 46 из 48;
- служебные страницы и разделы — 17 из 18.
Держатся частично:
- страницы отраслей — 10 из 14;
- статьи блога — 16 из 26;
- страницы услуг — 3 из 7.
Не держатся почти совсем:
- кейсы — 2 из 11;
- «отрасль × город» — 1 из 8;
- «услуга × отрасль» — 0 из 42;
- «мессенджер × отрасль» — 0 из 6.
Закономерность видна сразу, и она не про объём и не про тему. Стопроцентно держатся страницы, каждая из которых — самостоятельная единица: один город, один термин, одна проверка. Ноль дают страницы, каждая из которых — клетка перемноженной таблицы: семь услуг умножить на шесть отраслей.
Причём тексты в этих клетках были не шаблонные. Мы их переписали: своего текста стало 92%, пересечение между соседями 15%, замечаний внутреннего контроля ноль из сорока двух. После этого их открыли для индексации и подождали.
Робот их прочитал. В день открытия из 51 скачанной страницы 46 были как раз этими клетками, на следующий день ещё шесть, потом ещё одиннадцать. Через пять дней в поиске — ноль из сорока двух. Для сравнения: двенадцать терминов словаря, опубликованных в тот же период, были в поиске на следующие сутки.
Вывод, которым мы теперь пользуемся как правилом: заводя новое семейство страниц, надо сначала честно ответить себе на вопрос — это самостоятельная сущность или ячейка таблицы. Если ячейка, её не возьмут, сколько ни переписывай.
Пять метрик, которые вердикт не предсказали
Дальше мы попробовали найти измеримое отличие между теми страницами, которые остались в поиске, и теми, которые сняли. Если бы такое отличие нашлось, появился бы понятный критерий: меряем перед публикацией и не выпускаем то, что не проходит.
Отличия не нашлось. Проверяли по очереди:
Объём текста. У снятых страниц он оказался больше, чем у оставшихся. Совет «добавьте текста» на этих данных работает в обратную сторону.
Конкретика. Считали числа с единицами измерения на тысячу знаков — это обычная прокси-метрика «полезности». У снятых 1,70, у оставшихся 1,00. Снова у снятых больше.
Уникальность внутри сайта. 97% у всех проверенных статей, разницы между группами нет.
Внешняя уникальность. Сравнивали пятёрками слов с текстами конкурентов по тем же темам. Совпадение 0% у всех. Пятёрки ловят дословное копирование, а два независимо написанных русских текста на одну тему общих пятисловных цепочек почти не имеют. Заимствования не было ни у кого.
Насыщенность темы. Смотрели, сколько тематических подтем раскрыто, против конкурентов: 4 против 6. Разница есть, но она одинаковая и у снятых, и у оставшихся.
Шестую проверку мы сделали позже, когда возникла гипотеза, что статьи конкурируют между собой. Попарное пересечение между всеми десятью снятыми статьями — максимум 2,0%, а у двух самых похожих по теме («основы CRO» и «оптимизация конверсии») меньше 0,8%. Дублирования между ними нет.
Шесть измерений подряд, и ни одно не отделяет снятые страницы от оставшихся. Это неприятный результат, и мы публикуем его именно потому, что он неприятный: в статьях про этот вердикт обычно перечисляют признаки, которых на данных не видно.
Что всё-таки различает снятые и оставшиеся
Одно различие видно, но оно не измеряется числом — оно жанровое.
Сняли и не вернули: «полное руководство по SEO», «технический SEO», «чек-лист аудита», «контент-стратегия», «основы CRO», «digital-маркетинг», «мобильная версия», «настройка аналитики», «SEO для интернет-магазина».
Держатся: «canonical-url», «LSI-слова», «Core Web Vitals», «локальное SEO», «поиск с ИИ».
Первый список — широкие обзорные руководства по чужой большой теме. Второй — узкие темы с конкретным предметом. По таким широким темам в интернете уже есть сотни материалов, каждый из которых полнее и старше. Наш текст к ним ничего не добавляет — и именно это, судя по всему, и означает «маловостребованная».
Косвенно это подтвердилось так: мы проверили спрос по фразам этих широких тем у десяти профильных агентств — и не нашли ни одного, кто бы по ним стоял. Тема, по которой не борется никто из тех, кто живёт с поиска, скорее всего не приносит и им.
Помогает ли переобход
Короткий ответ: нет.
Мы поставили на этом отдельный опыт. Взяли статью с вердиктом, полностью переписали её вокруг собственных замеров — с числами, которых нет ни у кого, и с отдельным разделом о том, что оказалось неправдой, включая наши же ошибки. Отправили на переобход. Вместе с ней отправили ещё четырнадцать страниц — кейсы и услуги, которым перед этим добавили авторство, даты публикации и собственную графику.
Прошло двое суток — ровно тот срок, за который на этом же сайте в поиск входит любая здоровая новая страница. Не вернулась ни одна из пятнадцати.
Ещё показательнее история одной страницы про digital-маркетинг: она была снята 30 июня, вернулась 29 июля сама по себе — и была снята снова 6 августа. То есть страницу с таким вердиктом пересматривают и отклоняют повторно.
Отсюда практический вывод: тратить квоту переобхода на страницы с этим вердиктом бессмысленно. Квота маленькая, и она нужнее новым страницам, которые заходят за двое суток.
Что делать с теми, кто не вернулся
Мы приняли такое решение и советуем его же.
Закрыть от индексации метатегом noindex при открытом доступе для робота. Не запретом в robots.txt: запрет закрывает обход, а не показ. Робот, которого не пустили на страницу, не может прочитать стоящий на ней запрет индексации, и адрес остаётся в выдаче без описания.
Убрать из карты сайта. Держать в карте адрес, который сам же помечен noindex, — значит звать робота прийти и уйти ни с чем.
Не делать 301. Редирект необратим, а тексты обычно нормальные и посетителю полезны. Страница остаётся на сайте и работает для человека, просто не претендует на место в выдаче.
Зачем это вообще нужно, если страница и так не показывается. Две причины. Во-первых, доля малоценных страниц — это сигнал по всему хосту, а не по одному разделу: у нас в худший момент их было 48 из 202. Во-вторых, обход конечен: когда 90% дневного внимания робота уходит в страницы, которые он всё равно отклонит, новые страницы ждут дольше.
Мы этот приём уже применяли к сорока двум клеткам матрицы. После закрытия индексация здоровых семейств выправилась.
Чего наш опыт не доказывает
Здесь стоит остановиться и очертить границы, иначе получится ещё одна статья с уверенными советами на пустом месте.
Это один сайт, молодой, с непростой историей: восстановление из бэкапа, массовая переоценка через три дня. На большом сайте с историей картина может быть другой.
Мы не знаем механизма. Мы видим, какие типы страниц держатся, а какие нет, и знаем, что шесть измеримых признаков различия не объясняют. Почему именно широкие обзорные темы отклоняются — наша интерпретация, а не факт, который мы можем показать числом.
И отдельно: вердикт не связан с техническим состоянием сайта. Мы проверили тридцать три диагностических признака Вебмастера — тридцать два в состоянии «отсутствует». Ни ошибок сервера, ни медленного ответа, ни проблем с robots и картой. Искать причину в технике на этих данных бесполезно.
Короткий чек-лист
Если вы увидели этот вердикт у себя:
- Посмотрите события, а не только счётчик. В Вебмастере видно поимённо, что и когда сняли. Волна за один день означает переоценку хоста, а не вашу правку в этот день.
- Разложите снятое по типам страниц. Если снимают целым семейством — дело в устройстве семейства, а не в текстах. Особенно если это перемноженная таблица.
- Не начинайте с объёма. На наших данных у снятых страниц объём и конкретика были выше, чем у оставшихся.
- Посмотрите на жанр. Широкое обзорное руководство по чужой большой теме — главный кандидат на этот вердикт.
- Не тратьте квоту переобхода на страницы, которые уже получили вердикт. Пятнадцать наших не вернулись, а одна была снята повторно.
- Закройте невозвратные в
noindexи уберите из карты сайта, чтобы они не тянули хост и не съедали обход.
Если хотите проверить свой сайт на то, что действительно измеряется, — у нас есть бесплатные проверки: дубли страниц, микроразметка, доступность и платформа сайта. Они не выносят вердиктов за поисковую систему, но показывают то, что видно снаружи, и делают это честно.
