«Сайт работает?» — вопрос, на который отвечают нажатием: адрес открылся, значит, работает. Мы обошли 260 адресов компаний Екатеринбурга и проверили каждый семью способами вместо одного. Открылись почти все. Спокойно прошли все семь проверок — далеко не все.
«Открывается» — самая слабая из проверок
22 сентября 2026 года мы запросили главную у 260 адресов. Не отозвался один. Остальные ответили, но ответ ответу рознь:
| Что ответил адрес | Сколько адресов из 260 в обходе |
|---|---|
| Страница отдана, код 200 | 248 |
| Ошибка на стороне сервера (500 или 502) | 5 |
| Закрыто паролем или запретом (401, 403) | 4 |
| Главной нет (404) | 1 |
| Слишком частые обращения (429) | 1 |
| Не отозвался совсем | 1 |
Двенадцать адресов из обойдённых не открываются вовсе — при том, что в выдаче они стоят и телефон на них указан. Но интереснее те, что ответили кодом 200.
Мы посчитали видимый текст на каждой отданной главной: медиана — 6700 знаков. У девяти страниц из разобранных оказалось меньше восьмисот, у двух — ноль. Формально это работающий сайт: код 200, сервер жив, браузер не ругается. Человек видит пустоту.
Семь вопросов вместо одного
Проверка «открывается» отвечает только на первый из них. Остальные шесть задают себе редко — а ломается именно там.
| Вопрос | Как проверить | Сколько адресов не прошли |
|---|---|---|
| Главная отдаётся? | открыть адрес | 12 |
| На странице есть содержимое? | посмотреть видимый текст | 9 |
| Сертификат живой и не кончается? | срок в свойствах соединения | 8 |
| Несуществующий адрес отвечает «нет такой страницы»? | дописать к адресу любую чепуху | 16 |
| Адрес один или их два? | открыть версию с www и без | 23 |
robots.txt не запрещает лишнего? | открыть /robots.txt | 21 |
| Роботу отдаётся то же, что человеку? | запросить страницу от имени робота | 2 |
Дальше — про каждую строку, кроме первых двух.
Сертификат: валиден у всех, кончается у восьми
Замок в адресной строке проверяют глазами и на этом успокаиваются. Мы посмотрели сроки: из 245 сертификатов, которые удалось прочитать при обходе, невалидным не оказался ни один. Зато у восьми до конца оставалось меньше двух недель, а у 37 — меньше месяца.
Это не придирка. Сертификаты выдаются на 90 дней (223 из прочитанных — от Let's Encrypt) и продлеваются автоматически; медиана остатка по обходу — 59 дней, ровно середина срока. Значит, продление работает. Но там, где оно однажды сломается, сайт перестанет открываться целиком и сразу — с красным предупреждением во весь экран.
Ещё 14 адресов из обойдённых открылись только по http: защищённое соединение не ответило. Браузеры такую страницу показывают с пометкой «Не защищено», а форму заявки на ней помечают отдельно.
Несуществующий адрес: проверка, которая ничего не стоит
Допишите к своему адресу любую чепуху. Правильный ответ — «страница не найдена», код 404. Мы запросили у каждого сайта заведомо выдуманный путь:
- честный код 404 вернули 232 адреса;
- код 200 на несуществующей странице — 16, и у 13 из них это оказалась копия главной.
Подробный разбор — что должно быть на самой странице 404 и чем она отличается от 410 — в отдельной статье: «Страница 404: как проверить свою».
Когда несуществующее отвечает «всё хорошо», поисковик видит бесконечное множество страниц с одинаковым содержимым: любая опечатка в ссылке, любой обрезанный адрес из письма становится отдельной страницей. Заодно ломается и проверка для человека: по такому сайту нельзя понять, есть ли раздел, или адрес набран неверно.
Один адрес или два
Версия с www и версия без него — для поисковика два разных сайта, пока их не склеили. Проверка простая: открыть обе и посмотреть, куда приводит.
| Что получилось со вторым адресом | Сколько адресов при обходе |
|---|---|
| Переадресация на основной | 172 |
| Копия, склеенная каноническим адресом | 25 |
| Две живые копии без склейки | 23 |
| Второй адрес не отвечает или отдаёт ошибку | 35 |
Двадцать три адреса из обойдённых отдают одно и то же содержимое по двум разным именам, ничем не указывая, какое главное. Робот выберет сам — и выбранное не всегда совпадёт с тем, что раздают в рекламе.
Стоит заметить: «не отвечает» здесь не ошибка. Если вторая версия просто не поднимается, склеивать нечего.
robots.txt: строчка, которая выключает сайт из поиска
Файл /robots.txt — указание роботам, куда ходить нельзя. Он есть у 242 адресов из обойдённых. У остальных его нет: семь отвечают «не найдено», четыре — ошибкой сервера, три вместо текста отдают обычную страницу с версткой.
Отсутствие файла безобидно: нет запретов — робот ходит везде. Опаснее обратное. Мы разобрали содержимое по группам и нашли три случая:
stom-akadem.ru—User-agent: *иDisallow: /: сайт запрещён всем роботам целиком.bmc-ural.ru— запрет только для Яндекса, остальным открыто.3615999.ru— Яндексу запрещено всё, кроме главной и нескольких страниц из белого списка.
Как это выглядит в выдаче, видно без доступов. По запросу «бмц урал екатеринбург» первым стоит bmc-ural.ru — и вместо названия компании в ссылке стоит голый адрес, а описание пустое. То же у второго: по запросу stom-akadem — голый адрес и пустота под ним, а по человеческому запросу про стоматологию его в первой десятке нет вовсе.
Сайт открывается. Сайт красивый. В поиске у него вместо названия — доменное имя, потому что прочитать страницу роботу запрещено.
Сервер может отвечать роботу иначе, чем человеку
Последняя проверка самая неочевидная: мы запросили каждую главную дважды — от имени браузера и от имени поискового робота — и сравнили ответы.
У 239 адресов, ответивших в обоих заходах, совпало всё, кроме двух. bkfcarwash.ru отдаёт браузеру 520 КБ, а тому, кто назвался Googlebot, — код 200 и ноль байт. goodmoi.ru ведёт себя так же: 58 КБ браузеру, пустота роботу. Повторили трижды с паузами — результат тот же. При этом роботу Яндекса оба отдают полную страницу.
Формулировка здесь важна. Мы приходили со своего адреса, лишь называясь роботом; настоящий Googlebot узнаётся по обратному разрешению имени, а не по строке в запросе. Поэтому честный вывод такой: сервер принимает решение по строке агента — и внешняя проверка, которая смотрит только на код ответа, увидит здесь бодрое «200, всё работает».
Чего проверка снаружи не видит вообще
Форма заявки нашлась в коде у 184 главных страниц из отданных. Работает ли она — снаружи не проверяется никак: отправить заявку означает прислать человеку ложное обращение.
Это не теоретическая оговорка. На сайте, который мы разбирали, форма выглядела полностью рабочей: поля, кнопка, сообщение «спасибо за обращение». Обработчика за ней не было — заявки не уходили никуда. Снаружи такое видно только одним способом: отправить пробную заявку со своего сайта и проверить, дошла ли она.
Так же не читаются снаружи: доходят ли письма с сайта до почты, не блокирует ли их спам-фильтр, работает ли оплата, не сломалась ли выгрузка цен. Всё это «сайт работает» в том смысле, в каком слово понимает владелец, — и ни одна внешняя проверка сюда не достаёт.
Как проверить свой сайт за десять минут
- Открыть главную и посмотреть на замок в адресной строке, а в свойствах соединения — дату окончания сертификата.
- Дописать к адресу чепуху и убедиться, что ответ — «страница не найдена», а не копия главной.
- Открыть версию с
wwwи без него: одна должна перебрасывать на другую. - Открыть
/robots.txtи прочитать его целиком — в первую очередь ища строкуDisallow: /. - Найти свой сайт в поиске по названию компании: если вместо названия стоит голый адрес, а описания нет, робот страницу не читает.
- Отправить пробную заявку через форму и проверить, дошла ли она на почту и в телефон.
- Открыть сайт с телефона по мобильной сети, а не по домашнему Wi-Fi.
Для порядка — наши собственные числа по тем же проверкам: код 200, сертификат до конца срока 75 дней, несуществующий адрес отвечает 404, версия с www переадресуется на основную, robots.txt на месте и с картой сайта. Формы на главной в коде нет вовсе: она открывается по кнопке, и внешняя проверка её не видит — как не увидит и у трети тех, у кого форма спрятана так же.
Границы замера
Смотрели одну страницу — главную, и один день. Время ответа мы намеренно не приводим: запросы шли через посредника, и в такой замер попадает дорога, а не работа сервера. «Назваться роботом» — не то же самое, что быть им: сервер мог отвечать иначе настоящему Googlebot. Содержимое robots.txt разбиралось по стандарту, и один спорный случай — где пустая группа сливается со следующей — мы в счёт не взяли, хотя по букве стандарта он закрывает сайт для всех. Наконец, проверка «есть ли содержимое» считает текст в коде: страницы, которые рисуются скриптами в браузере, могут выглядеть пустыми в замере и полными на экране.
Коротко
«Открывается» — одна проверка из семи, и самая слабая. В обходе 260 адресов Екатеринбурга 248 ответили кодом 200, но у 16 несуществующая страница тоже отвечает «всё хорошо», у 23 сайт живёт по двум адресам сразу, у восьми сертификат кончается в ближайшие две недели, а три запрещают себя роботам — и в выдаче у них вместо названия голый адрес. Ни одна из этих поломок не видна по кнопке «открыть».
