SEOFAQ Telegram, маркетинг и SEO Канал SEOFAQT в мессенджере Telegram

Все чаты​Рик: GSC показывает мне кучу неканонических URL с добавленными...

 191  


​Рик:

GSC показывает мне кучу неканонических URL с добавленными хэшбэнгами.

Я передал это инженерам, и они сказали, что нашли и исправили проблему.

Это было 2-3 недели назад, а неканонические URL с хэшбэнгами до сих пор появляются в GSC.

Я пытался провести валидацию фикса дважды за прошедшие 3 недели, но фикс не валидируется.

Инспектор URL не показывает реферер.

Если запретить Google краулить URL с хэшбэнгами, это уменьшит количество краулящихся URL примерно на 33%.

Поскольку инженеры не могут найти никаких рефереров на эти страницы, я рассматриваю два сценария:

1. Данные в GSC устарели, и эти URL будут отображаться еще какое-то время

2. Эти URL где-то есть на сайте, и мы можем решить проблему с помощью постоянного редиректа, пока инженеры не найдут баг.

-

Дэйв Смарт:

#! — это неудобная штука, пережиток старых дней краулинга JavaScript,

robots.txt не может их заблокировать,

Disallow: /*#!

фактически то же самое, что и

Disallow: /

Это первый раз, когда я заметил, что там написано, что индексация разрешена, хотя страница неканоническая.

Это вполне стандартно, любая страница "не индексируется: альтернативная страница с правильным каноникал-тегом" будет отображаться таким образом, так это выглядит в GSC.

Учитывая, что каноникалы, похоже, уважаются, я бы особо не беспокоился об этом, учитывая отсутствие реального контроля, и то, что каноникалы, похоже, делают свою работу.

Я бы предположил, как и ты, что это что-то историческое, всплывшее для проверки того, что происходит в наши дни с этими URL, или, возможно, с внешних сайтов, но отсутствие рефереров на любом из них указывает на первую версию.

-

Рик:

Вот что я пытаюсь решить.

Эти URL с хэшбэнгами составляют около 1/3 неиндексируемых страниц, которые краулятся.

Я хочу сократить порог от серого до зеленого.

Кроме того, общее количество запросов краулинга падает с такой же скоростью.

-

Дэйв Смарт:

Я тебя понимаю, но здесь мало что можно сделать, ИМХО.

Ты не можешь заблокировать или средиректить эти URL на стороне сервера, так как # и !

не передаются как часть сетевого запроса

Ты не можешь использовать robots.txt, во-первых, из-за того, как он парсится, но опять же, запрос будет на URL без #!

Так что есть две реалистичные опции:

1. Полагаться на каноникалы, как ты сейчас делаешь, и жить с тем, что показывает отчет

2. В крайнем случае, ты мог бы использовать клиентские JavaScript-редиректы, но я думаю, что будет хуже с точки зрения расхода краулингового бюджета (ему придется краулить это, рендерить И ЗАТЕМ редиректить), и всё это для того, чтобы в конечном итоге просто переместить их из одной причины, по которой они не индексируются, в другую причину в отчете.

@MikeBlazerX

Ссылки из поста:
https://theseocommunity.slack.com/archives/C05HJDD...
https://t.me/MikeBlazerX

Источник новости https://t.me/mikeblazerx/4891...