Когда страницы не появляются в Google, причина почти всегда уже написана в отчёте об индексировании. Разбираем основные статусы: что стоит за каждым и какие действия имеют смысл.
Коротко
- Отчёт об индексировании прямо называет причину по каждому адресу.
- «Обойдено, но не проиндексировано» — вопрос ценности страницы.
- «Найдено, но не обойдено» — вопрос нагрузки и приоритетов.
- Повторная отправка в большинстве случаев не помогает.
Где смотреть
Отчёт об индексировании страниц
Общая картина по сайту.
Список причин
Сгруппирован по статусам.
Адреса внутри каждой причины
Можно выгрузить.
Проверка конкретного адреса
Отдельный инструмент.
Работать нужно со вторым уровнем, а не с общим числом. «Не проиндексировано 4000 страниц» ничего не говорит: половина может быть закрыта намеренно, а половина — по причине, которую стоит исправить. Смысл появляется только в разбивке по статусам.
«Обойдено, но не проиндексировано»
Google посетил страницу, но не включил её в индекс. По документации, она может быть проиндексирована позже, и повторно отправлять адрес на обход не нужно.
| Вероятная причина | Что делать |
|---|---|
| Страница почти пустая | Наполнить содержательно |
| Похожа на другие страницы сайта | Объединить или различить |
| Нет спроса по теме | Пересмотреть необходимость страницы |
| Мало внутренних ссылок | Связать с разделами |
| Страница новая | Подождать |
Это самый частый статус и самый неприятный, потому что прямой инструкции к действию в нём нет. Google сообщает решение, а не причину: он посмотрел и решил не брать. Работать приходится с содержимым и связностью страницы, а не с техникой.
«Найдено, но не обойдено»
Адрес известен, но робот до него не дошёл. По документации, обход часто откладывается, чтобы не перегружать сайт.
Что помогает
- Ускорить ответ сервера
- Убрать мусорные адреса
- Сократить число страниц в очереди
- Добавить внутренние ссылки на важное
Что не помогает
- Отправлять адреса повторно
- Пересобирать карту сайта каждый день
- Добавлять новые страницы быстрее
Этот статус чаще всего встречается на больших сайтах и на медленных серверах. Он говорит не о качестве страницы, а о пропускной способности: роботу есть что обходить, но он не хочет создавать нагрузку. Про экономию обхода — в статье про краулинговый бюджет.
Статусы про дубли и запреты
| Статус | Что означает | Что делать |
|---|---|---|
| Дубль без выбранного канонического адреса | Google выбрал каноническим другой адрес | Указать канонический явно или различить страницы |
| Исключено тегом noindex | Робот встретил запрет индексирования | Снять, если страница нужна в поиске |
| Заблокировано в robots.txt | Обход запрещён | Разблокировать и поставить noindex, если цель — убрать из поиска |
Третья строка содержит рекомендацию, которая на первый взгляд выглядит парадоксально. Чтобы страница не попадала в поиск, документация советует разблокировать обход и использовать noindex: робот должен иметь возможность прочитать запрет. Подробно — в статье про закрытие страниц от индексации.
Порядок разбора
Отделите намеренно закрытое
Служебные разделы, корзина, фильтры.
Исправьте технические статусы
Запреты, ошибки сервера, редиректы.
Разберитесь с дублями
Канонические адреса и различение страниц.
Займитесь содержимым
Там, где решение принято по ценности.
Проверьте результат через месяц
Отчёт обновляется не мгновенно.
Первый шаг сокращает объём работы вдвое и делается за час. На любом сайте часть адресов закрыта намеренно и попадает в отчёт как «не проиндексировано» — это нормально и трогать это не нужно. Работать стоит с тем, что должно быть в поиске и там не оказалось.
Частые вопросы
Где смотреть причину, почему страница не в индексе?
В отчёте об индексировании страниц: причины сгруппированы по статусам, адреса внутри каждой можно выгрузить. Отдельный инструмент проверяет конкретный адрес.
Что значит «обойдено, но не проиндексировано»?
Google посетил страницу и не включил её в индекс. По документации она может быть проиндексирована позже, и повторно отправлять адрес не нужно — работать стоит с содержимым и связностью.
Что значит «найдено, но не обойдено»?
Адрес известен, но обход отложен, чтобы не перегружать сайт. Это вопрос скорости сервера и объёма очереди, а не качества страницы.
Что делать со страницами, заблокированными в robots.txt?
Если они должны быть в поиске — разблокировать. Если не должны — документация советует разблокировать обход и поставить noindex, чтобы робот смог прочитать запрет.
Продвинем сайт в поиске
Соберём семантику, доведём структуру и текст до уровня топа и будем вести проект до заявок.
Обсудить SEO-продвижение