Фильтры в каталоге — главный источник разрастания сайта. Пять фильтров по четыре значения дают больше тысячи сочетаний, а порядок параметров в адресе умножает это ещё раз. Разбираемся, какие сочетания имеет смысл открывать для поиска, как закрыть остальные и чем проверять, что запрет работает.
Коротко
- Число сочетаний фильтров растёт как произведение, а не как сумма.
- Открывают единичные сочетания под подтверждённый спрос, остальное закрывают.
- Закрывать нужно мета-тегом robots, а не только запретом в robots.txt.
- Открытое сочетание должно иметь свой заголовок, описание и достаточно товаров.
Откуда берутся миллионы адресов
Каждый выбранный фильтр добавляет параметр в адрес. Комбинаторика делает остальное.
| Фильтров | Значений в каждом | Сочетаний |
|---|---|---|
| 3 | 4 | 124 |
| 5 | 4 | 1 023 |
| 7 | 5 | 32 767 |
| 10 | 5 | более 9 миллионов |
И это только по одной категории. Добавьте сортировку, пагинацию и разный порядок параметров в адресе — число вырастет ещё в несколько раз.
Чем это плохо на практике. Робот тратит обход на почти одинаковые страницы вместо товаров и новых поступлений. В индекс попадают наборы из двух-трёх позиций. Похожие страницы конкурируют между собой и с категорией. И всё это приходится на каждую категорию каталога.
Какие сочетания открывать
Правило одно: открывается то, что люди ищут отдельной формулировкой. Обычно это один фильтр, изредка два.
Открывать
- Бренд внутри категории
- Ключевая характеристика с явным спросом
- Назначение: «для дачи», «в ванную»
- Материал, если по нему ищут
- Редко — пара «категория + бренд + размер»
Закрывать
- Цена и любые диапазоны
- Сортировку и вид отображения
- Пагинацию внутри фильтра
- Три и более фильтров сразу
- Сочетания с нулём или парой товаров
- Наличие, акции, «новинки»
Проверьте спрос по формулировке
Есть ли запросы вида «категория + значение фильтра». Нет запросов — нет смысла открывать.
Посчитайте товары
Открывать сочетание, где осталось две позиции, не нужно даже при наличии спроса.
Убедитесь, что есть что написать
Свой заголовок и описание. Если текст будет отличаться только подставленным словом, страница слабая.
Как закрывать остальное
| Способ | Что делает | Когда применять |
|---|---|---|
| Мета-тег robots noindex | Выводит страницу из индекса | Основной способ для фильтров |
| Canonical на категорию | Указывает основную версию | Для сортировки и вида отображения |
| Clean-param | Сообщает, какие параметры не меняют содержимое | Для служебных меток и сортировок |
| Запрет в robots.txt | Не пускает робота на страницу | Только для заведомо служебного |
Самая частая ошибка — закрыть фильтры в robots.txt и считать вопрос решённым. Запрет на обход не выводит страницу из индекса: если на неё есть ссылки, она может там остаться без описания. Чтобы страница вышла из индекса, робот должен зайти на неё и увидеть мета-тег robots. Значит, в robots.txt она закрыта быть не должна.
Про canonical для фильтров. Он подходит для сортировок, где содержимое то же самое в другом порядке. Для фильтра, который реально сокращает набор товаров, canonical на категорию — подсказка, которую поиск может и не принять, потому что содержимое отличается. Для таких страниц надёжнее noindex.
Порядок внедрения
Соберите список фильтров по категориям
Какие есть, сколько значений, что попадает в адрес.
Проверьте спрос по значениям
Отберите десятки сочетаний, а не тысячи.
Сделайте отобранные полноценными страницами
Свой заголовок, описание, крошки, ссылка из категории.
Закройте всё остальное мета-тегом
По правилу: открыто только из белого списка, остальное закрыто.
Уберите ссылки на закрытые страницы из меню и блоков
Чтобы робот на них не ходил без нужды.
Проверьте результат в панели вебмастера
Через две-четыре недели: сколько страниц в индексе и на что тратится обход.
Белый список — важная деталь: правило «закрываем то, что нашли» не работает, потому что новые сочетания появляются сами. Правило «открываем только перечисленное» устойчиво к росту каталога.
Как убедиться, что всё работает
- Откройте страницу фильтра и посмотрите исходный код. Должен быть мета-тег robots с запретом.
- Проверьте открытое сочетание. На нём запрета быть не должно — частая ошибка при настройке правил.
- Посмотрите число страниц в индексе. Если их в разы больше, чем товаров и категорий вместе, фильтры продолжают попадать в индекс.
- Загляните в статистику обхода. Она показывает, какие адреса робот скачивает чаще всего.
- Проверьте, что товары обходятся. Смысл работы в том, чтобы обход тратился на них.
Что считать нормой. Если в индексе примерно столько страниц, сколько у вас товаров, категорий и открытых фильтров вместе взятых, — порядок. Если в разы больше, где-то остались незакрытые сочетания, и начинать надо с того, чтобы найти шаблон их адресов в статистике обхода.
Частые вопросы
Нужно ли открывать страницы фильтров для индексации?
Точечно — да, если под формулировку «категория плюс значение фильтра» есть спрос и на странице достаточно товаров. Массово открывать сочетания нельзя: их число растёт как произведение, и в индексе окажутся тысячи почти одинаковых страниц.
Можно ли закрыть фильтры через robots.txt?
Этого недостаточно. Запрет на обход не выводит страницу из индекса — она может остаться там без описания. Нужен мета-тег robots на самой странице, а значит, робот должен иметь возможность её загрузить.
Подходит ли canonical для страниц фильтров?
Для сортировок и вида отображения — да, содержимое там то же самое. Для фильтра, который реально сокращает набор товаров, canonical остаётся подсказкой, которую поиск может не принять; надёжнее закрыть такую страницу мета-тегом.
Сколько сочетаний фильтров стоит открыть?
Обычно десятки на весь сайт, а не тысячи. Работает принцип белого списка: открыто только то, что перечислено явно, всё остальное закрыто по умолчанию — иначе новые сочетания будут попадать в индекс сами.
Читайте также
Продвинем сайт в поиске
Соберём семантику, доведём структуру и текст до уровня топа и будем вести проект до заявок.
Обсудить SEO-продвижение