Мы сгенерировали 5058 страниц. Яндекс выбросил 3808 из них
Коротко: что произошло
Мы сгенерировали 5058 страниц по схеме «ниша × город × район»: продвижение логистики в Талдыкоргане, ветклиника в центре Туркестана и так далее. Логика казалась разумной: чем больше посадочных страниц, тем больше точек входа из поиска.
Через несколько недель выгрузили из Яндекс.Вебмастера список исключённых страниц — 3818 записей. Разбивка по статусам не оставила простора для интерпретаций: 3808 (99%) исключены со статусом «нет поискового спроса». Ещё 8 — неканонические дубли, 2 — редиректы.
То есть проблема была не в технике. Страницы отдавались корректно, контент рендерился на сервере и был доступен роботу без выполнения скриптов — мы это проверили отдельно. Просто по этим запросам никто ничего не ищет.
Почему выгрузка важнее догадок
До выгрузки у нас была своя версия случившегося: незадолго до этого мы чинили канонические адреса и логично предположили, что дело в них. Версия выглядела убедительно и совпадала по времени.
Данные её опровергли: на канонические дубли пришлось 0,2% исключений. Мы бы потратили недели на исправление того, что почти ни на что не влияло.
Практический вывод: при массовом исключении страниц первым делом выгружайте список со статусами, а не стройте гипотезы. В Яндекс.Вебмастере это раздел с исключёнными страницами, экспорт даёт колонку с причиной по каждому адресу. Дальше достаточно посчитать распределение — картина становится однозначной за пять минут.
Яндекс строже Google в этом вопросе
Google принял почти все 5058 страниц и держал их в индексе — просто на низких позициях. Яндекс отсёк по спросу заметно жёстче.
Это важное различие для казахстанского и российского рынка, где доля Яндекса значима. Стратегия «сгенерируем много, что-нибудь да зацепится» в Google даёт хотя бы иллюзию результата, а в Яндексе упирается в стену почти сразу.
Ещё один эффект: тысячи пустых страниц — это не нейтральный балласт, а сигнал о качестве всего сайта. Мы столкнулись с этим повторно, но уже по другой причине — в разборе 5453 страниц-дублей, где мусор породила мультиязычность.
Что не так с генерацией по шаблону
Классическая ошибка массовой генерации — страница, где меняется только название города, а остальной текст идентичен. Формально это уникальные адреса, фактически — одна страница в тысяче копий.
Вторая проблема глубже и не лечится текстом: даже отличный материал про «SEO для логистики в Талдыкоргане» не принесёт трафика, если такой запрос задают ноль раз в месяц. Качество не создаёт спрос.
Отсюда простое правило: спрос проверяется ДО создания адреса, а не после. Частотность через Вордстат или сервисы подсказок — работа на пару часов, которая экономит недели на разгребание последствий.
Как мы это исправили
Ввели избирательную индексацию. В коде появилась функция, которая решает для каждой комбинации, попадать ей в индекс или нет. Правила простые: базовые страницы ниш — да, ниша в крупном городе — да, ниша в районе небольшого города — нет.
Список городов для индексации ограничили пятью крупнейшими. Остальные комбинации остались доступными по прямой ссылке, но закрыты от индексации и убраны из карты сайта. Робот по ним не ходит, индекс не засоряется.
Ключевая деталь: в карту сайта попадают только индексируемые страницы. Держать в ней адреса, закрытые от индексации, — прямое противоречие сигналов, которое поисковик считывает как небрежность.
Расширять список городов планируем по мере роста спроса — когда по конкретной связке появится подтверждённая частотность, а не «вдруг кто-то будет искать».
Что это значит для клиентских проектов
Мы перестали обещать «N тысяч страниц в индексе» — это обещание, которое поисковик не даст выполнить. Вместо количества страниц в договорённостях фигурируют запросы с подтверждённой частотностью и заявки.
Если подрядчик предлагает сгенерировать вам тысячи страниц под все возможные комбинации — попросите показать, по скольким из этих запросов есть реальный спрос. Обычно на этом разговор заканчивается.
Наш алгоритм теперь такой: собрать семантику → отсечь нулевую частотность → сгенерировать страницы только под остаток → наполнить каждую фактурой, а не подстановкой города. Меньше страниц, но каждая имеет шанс. Этот подход входит в технический аудит — мы проверяем не только состояние сайта, но и обоснованность его структуры.
Третий разбор наших инцидентов подряд объединяет одно: система рапортовала об успехе, а правду показывали отчёты поисковика. Похожая история — с уведомлениями, которые обгоняли выкладку сайта.
Частые вопросы
Как понять, что страницы исключены именно из-за отсутствия спроса?+
Выгрузите список исключённых страниц из Яндекс.Вебмастера — в экспорте есть колонка со статусом по каждому адресу. Статус «нет поискового спроса» говорит прямо: страница технически в порядке, но запросов по её теме нет. Не стройте гипотезы до выгрузки: у нас правдоподобная версия про канонические адреса объяснила лишь 0,2% случаев.
Сколько страниц вообще стоит генерировать?+
Столько, сколько запросов с подтверждённой частотностью вы нашли. Не «все возможные комбинации», а те, которые люди действительно ищут. У нас из 5058 сгенерированных осмысленными оказались около трети — остальное было создано впрок и не имело шансов.
Закрыть лишние страницы от индексации или удалить?+
Зависит от роли. Если страница нужна пользователям (переход по прямой ссылке, внутренняя навигация) — закрывайте от индексации, но оставляйте доступной и обязательно убирайте из карты сайта. Если она не нужна никому — не генерируйте вовсе, это дешевле для краулингового бюджета.
Работает ли этот подход в Google так же?+
Google терпимее: он принял почти все наши страницы, просто ранжировал их низко. Но результат тот же — трафика нет, а риск оценки качества сайта остаётся. Разница в том, что Яндекс показывает проблему сразу, а Google позволяет долго не замечать её.