В магазине тысячи товаров, а Google индексирует только часть – почему

Интернет-магазин · проблемы и решения

В CMS тысячи страниц. Но какие из них Google вообще знает и считает нужными для поиска?

Разбираем путь карточки товара от создания в магазине до индекса Google и определяем, где именно могут потеряться важные URL.


Проверить путь страницы →


СНАЧАЛА – НЕ КОЛИЧЕСТВО, А СОСТАВ

30 000 URL в магазине не означают, что все 30 000 должны находиться в индексе

Каталог может содержать товары, категории, бренды, SEO-фильтры, сортировки, параметры, страницы поиска и технические комбинации. Для Google эти URL имеют разную ценность.


ДОЛЖНЫ РАБОТАТЬ В ПОИСКЕ


Категории, товары, бренды и выбранные коммерческие фильтры


То есть канонические страницы, способные отвечать на самостоятельный поисковый спрос.


НЕОБЯЗАТЕЛЬНО ИНДЕКСИРОВАТЬ


Сортировки, параметры, дубли и технические комбинации


Сам факт существования URL ещё не делает его полезной поисковой страницей.


ГДЕ ПОТЕРЯЛАСЬ СТРАНИЦА

Между CMS и индексом Google находится несколько разных этапов

Если не определить конкретный этап потери, можно месяцами исправлять совсем не ту проблему.

Страница может потеряться на любом из этапов – и для каждого этапа требуется свой набор проверок.

01
Страница создана в CMS
URL физически существует.
02
Google может обнаружить URL
Есть ссылка, sitemap или другой путь обнаружения.
03
URL обнаружен
Google уже знает адрес страницы.
04
Страница просканирована
Googlebot получил содержимое URL.
05
Определён canonical
Выбрана основная версия страницы.
06
URL находится в индексе
Теперь страница вообще может участвовать в поиске.


СЦЕНАРИЙ 1 · GOOGLE НЕ ЗНАЕТ URL

В CMS 10 000 товаров, а Google обнаружил только 7 000

В такой ситуации пока бессмысленно переписывать описания остальных карточек. Сначала нужно понять, каким способом поисковик вообще должен был узнать об их существовании.


ВНУТРЕННИЕ ССЫЛКИ


Можно ли дойти до товара из обычного каталога?

Главная → категория → подкатегория → карточка товара.


SITEMAP


Передаёт ли карта сайта нужный URL?

Если коммерчески важной страницы нет даже там, сначала проверяем сам сайт.


СИРОТСКИЕ СТРАНИЦЫ


URL существует, но почти ниоткуда не связан с каталогом

Часто появляется после импорта товаров, миграции или перестройки категорий.


КАТАЛОГ ДОЛЖЕН БЫТЬ ДОСТУПЕН РОБОТУ

«Показать ещё», фильтры и JavaScript могут визуально работать – но плохо раскрывать каталог Google

Пользователь нажимает кнопку и видит следующие товары. Но поисковый робот не обязан повторять человеческие действия.

Если до карточки можно добраться только после пользовательского действия, этот путь нужно отдельно проверять для поискового робота.
РИСКОВАННЫЙ СЦЕНАРИЙ

Товары появляются только после кнопки или бесконечной прокрутки
ПОНЯТНЫЙ СЦЕНАРИЙ

Следующие страницы имеют собственные URL и доступны обычными ссылками


СЦЕНАРИЙ 2

Что означает «Обнаружена, не проиндексирована»

Google уже знает URL, но пока его не просканировал. Поэтому из одного этого статуса нельзя делать вывод, что содержимое страницы было признано слабым.


СМОТРИМ НЕ ОДНУ СТРАНИЦУ, А ЗАКОНОМЕРНОСТЬ

Один раздел или весь магазин?
Сколько новых URL создаётся ежедневно?
Есть ли тысячи параметров и комбинаций?
Нормально ли отвечает сервер?


НЕ ПРЕВРАЩАЙТЕ CRAWL BUDGET В УНИВЕРСАЛЬНОЕ ОБЪЯСНЕНИЕ

Иногда проблема действительно в масштабе каталога – но далеко не всегда

Для крупных, быстро меняющихся магазинов важно, на какие URL поисковый робот расходует обход. Но магазин на несколько тысяч нормальных страниц не стоит автоматически лечить «краулинговым бюджетом».


Правильная цель


Не заставить Google обходить больше, а убрать бессмысленные URL и сделать важные страницы проще для обнаружения.


СЦЕНАРИЙ 3

«Просканирована, пока не проиндексирована» – это уже другой уровень проверки

Google уже посетил страницу. Здесь уже имеет смысл брать группу таких URL и искать общие признаки.

СОДЕРЖИМОЕ
Насколько карточки действительно отличаются друг от друга?
ТОВАРНЫЕ ДАННЫЕ
Есть ли характеристики, цена, наличие, фото, варианты?
ПОЛЕЗНОСТЬ
Есть ли отзывы, доставка, аналоги и другая самостоятельная ценность?
СВЯЗНОСТЬ
Насколько страница связана с каталогом внутренними ссылками?


Не превращайте это в «перепишем 5000 описаний ради уникальности»


Задача – понять, является ли каждая нужная карточка самостоятельной полезной поисковой страницей.


СЦЕНАРИЙ 4 · ДУБЛИ

Google может знать страницу – но считать основной другой URL

Один товар способен существовать сразу в нескольких адресах. Тогда поисковику приходится определить главную версию.

ОДИН ТОВАР

/product-123/

/catalog/product-123/

/brand/product-123/

/product-123/?color=black

Canonical говорит: URL A
Внутренние ссылки ведут: URL B
Sitemap содержит: URL C


Это уже не один сигнал – а три конфликтующих версии


Canonical, sitemap и внутренняя перелинковка должны логически поддерживать одну основную страницу.


ФИЛЬТРЫ – ОТДЕЛЬНАЯ ЗОНА РИСКА

Несколько параметров способны создать тысячи дополнительных URL

Некоторые фильтры полезны как самостоятельные посадочные страницы. Другие создают лишь технические комбинации, которые не нужно продвигать.

/catalog/?brand=x
/catalog/?brand=x&color=black
/catalog/?brand=x&color=black&size=m
/catalog/?brand=x&color=black&size=m&sort=price


Задача не в том, чтобы открыть или закрыть все фильтры


Нужно отделить реальные поисковые посадочные страницы от служебных комбинаций.


SITEMAP – НЕ КНОПКА «ИНДЕКСИРОВАТЬ»

URL находится в sitemap – но это ещё ничего не гарантирует

Карта сайта помогает обнаруживать важные страницы. Но она не заставляет Google сканировать или индексировать каждую из них.

ХОРОШО
Канонические товары и категории
ПЛОХО
Редиректы и 404
ПЛОХО
Страницы с noindex
ПЛОХО
Параметры и дубли
ПРОТИВОРЕЧИЕ
URL в sitemap, но canonical ведёт на другую страницу


ПРОВЕРЬТЕ ТЕХНИЧЕСКИЕ ПРИЧИНЫ

Иногда проблема индексации лежит не в контенте, а в одной директиве

Для важного неприндексированного URL сначала исключите базовые технические препятствия.

Статус в Search Console – это начало диагностики, а не готовый диагноз страницы.
01
HTTP-ответ – 4xx, 5xx, 403
02
robots.txt
03
noindex
04
canonical на другую страницу
05
redirect


САМАЯ ПОЛЕЗНАЯ ПРОВЕРКА

Сравните CMS, sitemap и Search Console

Три набора URL быстро показывают, на каком уровне начинается потеря страниц.

Сравнение трёх наборов URL помогает понять, где именно теряются нужные страницы.

CMS
12 400
коммерчески важных страниц существует
SITEMAP
9 800
URL сам магазин отправляет Google
SEARCH CONSOLE
5 420
страниц находятся в индексе

Три ситуации – три совершенно разных направления проверки


СИТУАЦИЯ 1


CMS – 12 000 → Sitemap – 7 000

Google здесь ещё ни при чём. Сначала выясняем, почему сайт сам не передаёт 5 000 нужных URL.


СИТУАЦИЯ 2


Sitemap – 8 000 → Google знает 5 500

Проверяем внутреннюю структуру, пагинацию, доступность URL и JavaScript.


СИТУАЦИЯ 3


Google знает 8 000 → индексирует 4 200

Обнаружение уже работает. Смотрим причины исключения, canonical, дубли и сами страницы.


НЕ СЧИТАЙТЕ ИНДЕКС ЧЕРЕЗ SITE:

Оператор site: полезен для проверки, но не для точного подсчёта страниц

site:example.com

Для системной оценки большого каталога используйте Search Console и собственный список коммерчески важных URL.


ПОРЯДОК ИСПРАВЛЕНИЙ

Что проверять первым

01 · БЛОКИРОВКИ
robots, noindex, ошибки, redirects, canonical
02 · ОБНАРУЖЕНИЕ
Сиротские страницы, пагинация, sitemap и ссылки
03 · МУСОРНЫЙ СЛОЙ
Параметры, сортировки, фильтры и дубли
04 · САМИ СТРАНИЦЫ
Только теперь анализируем уже просканированные карточки


ЧЕК-ЛИСТ

Что проверить владельцу интернет-магазина

01
Определите количество действительно нужных SEO-страниц
02
Сравните CMS и sitemap
03
Сравните sitemap и Search Console
04
Разделите URL по статусам индексирования
05
Проверьте внутреннюю перелинковку и пагинацию
06
Найдите сиротские страницы
07
Проверьте robots.txt, noindex и HTTP-ответы
08
Проверьте canonical
09
Оцените количество фильтров и параметров
10
Возьмите выборку просканированных, но не проиндексированных URL
11
Проверьте JavaScript-каталог
12
Не отправляйте тысячи URL вручную – устраните системную причину


ИНДЕКС ≠ ТРАФИК

Страница может находиться в Google и всё равно не получать посетителей

Индексация лишь даёт техническую возможность участвовать в поиске. Дальше остаются спрос, релевантность, оптимизация, конкуренция и позиции.

ДВА РАЗНЫХ ВОПРОСА


1. Страница находится в индексе?


2. Страница способна конкурировать и получать поисковый спрос?


НЕ ЛЕЧИТЕ СИСТЕМУ РУЧНЫМ ПЕРЕОБХОДОМ

Кнопка «Запросить индексирование» не исправит архитектуру магазина

Для отдельных новых или исправленных страниц ручная отправка полезна. Но если проблема затрагивает сотни или тысячи URL, нужно исправлять сам механизм обнаружения и индексирования.


Индексация большого каталога должна быть свойством архитектуры


Новые товары должны корректно обнаруживаться и обрабатываться без постоянной ручной отправки.


ГЛАВНЫЙ ВЫВОД

«Google индексирует только половину магазина» – слишком общая формулировка

Проблему нужно превратить в конкретный статус и конкретную группу URL.


СЛИШКОМ ОБЩО


«Google не индексирует товары»


УЖЕ МОЖНО ДИАГНОСТИРОВАТЬ


«Из 6500 нужных карточек Google не обнаружил 1800 URL»

Частые вопросы об индексации интернет-магазина

Почему Google не индексирует все товары интернет-магазина?

Google может не обнаружить URL, ещё не просканировать его, встретить технический запрет, выбрать другую canonical-страницу или после сканирования пока не включить страницу в индекс.

Должны ли все товары интернет-магазина индексироваться?

Не каждый существующий URL. Важно, чтобы индексировались канонические коммерчески полезные страницы, а не сортировки, служебные параметры и дубли.

Что означает «Обнаружена, не проиндексирована»?

Google уже знает URL, но пока его не просканировал. Сам статус не означает, что поисковик уже оценил содержимое страницы как плохое.

Что означает «Просканирована, пока не проиндексирована»?

Google посетил URL, но пока не включил его в индекс. Нужно анализировать группу таких страниц, а не делать вывод по одному адресу.

Поможет ли добавление страницы в sitemap?

Sitemap помогает обнаруживать URL, но сам по себе не гарантирует ни сканирование, ни индексирование.

Нужно ли вручную отправлять все карточки на индексирование?

Нет. Для массовой проблемы нужно исправить системную причину – структуру, sitemap, ссылки, canonical, фильтры или технические настройки.

Почему страница есть в индексе, но трафика нет?

Индексация только допускает страницу к участию в поиске. Для трафика ещё нужны релевантность, спрос, оптимизация и достаточные позиции.


ЧИТАЙТЕ ТАКЖЕ

Что проверить после диагностики индексации

Дальнейшая работа зависит от того, находится ли проблема в структуре каталога, техническом SEO или продвижении уже индексируемых страниц.


01 · ЕСЛИ ИНДЕКС ЕСТЬ, А ЗАКАЗОВ НЕТ


Есть посетители, но нет заказов – почему интернет-магазин не продаёт →


Разбираем уже не индексирование, а коммерческую воронку магазина.


02 · КОМПЛЕКСНАЯ РАБОТА С КАТАЛОГОМ


SEO для интернет-магазина – категории, фильтры, карточки и продажи →


Для системной работы со структурой, посадочными страницами и товарным спросом.


03 · ЕСЛИ НУЖНО НАЙТИ СИСТЕМНУЮ ПРИЧИНУ


Аудит сайта →


Проверка технических ограничений, структуры и проблем индексирования.


НУЖНО НАЙТИ ТОЧКУ ПОТЕРИ URL?

В CMS тысячи страниц, а Google видит только часть?

Сравним каталог, sitemap и данные Search Console, разделим URL по причинам исключения и определим, что действительно мешает нужным страницам попадать в индекс.



Обсудить проблему индексации →