Мошенники вызывают наплыв спамных URL-адресов в Google Search Console
212
Мошенники вызывают наплыв спамных URL-адресов в Google Search Console
Эсбен Расмуссен заметил, что крупные сайты столкнулись с внезапным наплывом подозрительных URL в GSC.
При правильной настройке robots.txt такие ситуации на самом деле не влияют на SEO-показатели.
Схема всегда одна и та же: кто-то обнаруживает тысячи странных URL, внезапно появившихся в GSC за ночь, помеченных как "заблокировано файлом robots.txt".
При проверке этих URL через инструмент инспектирования GSC, пользователи в шоке видят, что они помечены как "проиндексированные" (с примечанием "Проиндексировано, хотя заблокировано файлом robots.txt").
Дальнейшее расследование может даже показать минимальные данные по производительности — возможно, один клик и три показа за несколько месяцев на сайте, который обычно генерирует миллионы показов.
На самом деле происходит спланированный скам.
Эти атакующие нацелены на динамические страницы, такие как результаты поиска или страницы ошибок, которые отражают пользовательский ввод.
Они манипулируют параметрами URL в надежде, что Google проиндексирует либо бэклинк, либо текстовое упоминание.
Динамическая природа этих страниц позволяет скамерам генерировать бесконечные вариации URL против одной уязвимой конечной точки.
Ирония в том, что для работы этой схемы спам-сеть должна создавать dofollow ссылки на "сайт-жертву", чтобы Google обнаружил эти манипулированные URL.
Вот почему правильно настроенный файл robots.txt делает эту атаку безвредной:
— Robots.txt предотвращает краулинг, что означает, что Google не хранит и не индексирует сигналы на странице, хотя и сохраняет обнаруженные URL в своем индексе.
— Поскольку Google никогда не краулит содержимое, краулинговый бюджет не тратится впустую, и Google никогда не видит потенциально спамный контент.
— Те 100 000 URL в GSC — это просто сообщение Google: "Я знаю, что этот URL существует, потому что на него указывают ссылки, но я не знаю, что он содержит".
— Эти проиндексированные, но не прокрауленные URL не могут ранжироваться по обычным поисковым запросам, что объясняет незначительные метрики производительности.
Некоторые сеошники предлагают добавить теги noindex к этим динамическим страницам, но это потребует удаления блокировки в robots.txt — позволяя Гуглоботу тратить ресурсы на краулинг тысяч спам-URL только для того, чтобы увидеть директиву noindex.
Правильный подход — проверить в GSC, не проскакивают ли какие-либо URL через вашу защиту robots.txt.
Проверьте отчеты "Проиндексированные страницы" и "Не проиндексировано" на необычные всплески, совпадающие с проблемой плохих URL.
Если обнаружены, скорректируйте ваш robots.txt для лучшей защиты всех динамических страниц, которые могут эксплуатировать скамеры.
Для сайтов, которые уже правильно блокируют эти страницы в robots.txt, никаких действий не требуется, несмотря на раздражающие данные в GSC.
Чем крупнее ваш сайт или бренд, тем вероятнее, что вы столкнетесь с такими попытками скама.
@MikeBlazerX

– https://t.me/MikeBlazerX
Источник новости https://t.me/mikeblazerx/4792...

