SEOFAQ Telegram, маркетинг и SEO Канал SEOFAQT в мессенджере Telegram

Все чаты​Сколько раз клиенты спрашивали вас о росте количества...

 14  


​Сколько раз клиенты спрашивали вас о росте количества URL-адресов в статусе "Crawled - currently not indexed" в Google Search Console.

Они паникуют, потому что кажется, будто Google всё активнее деиндексирует их страницы.

[Летят срочные сообщения в Slack]

И вот вы идете в отчет "Crawled - currently not indexed" и проверяете примеры.

И многие из них, раз за разом, оказываются проиндексированными! 😡 🤬

Как вообще использовать этот отчет, если он врет?

Вопрос в том, сколько из этих URL-адресов реально проиндексированы?

И меняется ли этот процент со временем?

Теперь я могу ответить на эти вопросы с парой оговорок.

Дважды в месяц я беру все 1 000 примеров из "Crawled - currently not indexed", проверяю каждый и фиксирую, в индексе он или нет, пишет Эй-Джей Кон.

Результаты показывают, что значительный объем URL-адресов в "Crawled - currently not indexed" на самом деле проиндексирован.

"Pages in bucket" — это количество URL в статусе "Crawled - currently not indexed", а "% actually indexed" — ну... тут всё понятно из названия.

Нюанс в том, что мы принимаем эти 1 000 примеров за репрезентативную выборку данных.

Это сложно проверить, и данные могут искажаться с учетом размера некоторых из этих групп.

Но, вероятно, я выясню это, продолжая отслеживать ситуацию в течение следующих нескольких месяцев.

Среди прочего я буду смотреть, меняются ли абсолютные цифры и меняется ли процент индексации.

Потому что я по-настоящему боюсь сценария, когда у клиента с большой долей урлов в "Crawled - currently not indexed", где индексация сейчас, скажем, 97%, этот процент внезапно упадет до 70%.

Без этих проверок я могу просто пропустить момент, когда страницы начнут реально вылетать из индекса.

Инсайты комьюнити

— Причины статуса Crawled - currently not indexed спорны: Гленн Гейб связывает ранжирование таких URL в топ-1000 с задержкой отчетности у крупных сайтов, тогда как оппоненты считают статус точным и намеренным; при этом даже на сайтах до 100 страниц 10–15 таких URL часто фактически проиндексированы и получают показы.

— Устаревшие данные в GSC касаются также каноникализации и ошибок 404 (особенно для редко сканируемых страниц), а их точная верификация проводится через URL Inspection API, доступный в том числе нетехническим специалистам благодаря AI.

— Лимит в 1 000 примеров обходится созданием папочных ресурсов (directory) с ручной проверкой со скоростью ~7 минут на тысячу URL (что плохо масштабируется на клиентские пулы), а фильтрация по XML-сайтмапам нестабильна из-за багов с миганием статуса отправки страниц.

— Примеры в отчете обновляются вместе с общими цифрами индексации каждые 3–5 дней (на небольших сайтах реже), а их актуальность подтверждается свежей датой последнего сканирования.

— Из-за отсутствия прямого API к отчету и ограничения истории в GSC 3 месяцами долгосрочный трекинг требует локального сохранения (например, через расширение GSC Helper, которое также отделяет статус indexed, blocked by robots.txt, строит тренды и выгружает тестовые URL).

@MikeBlazerX

📈 "Пушки" — в @MikeBlazerPRO

Ссылки из поста:
https://www.linkedin.com/posts/ajkohn_seo-gsc-them...
https://t.me/MikeBlazerX
https://t.me/tribute/app?startapp=sE4X

Источник новости https://t.me/mikeblazerx/6677...